{"as_of":"2026-08-03T23:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0cda46c6dd95a9f1c0a643f5a715c0f13cc2abe9ba8103e2f98a05e643f382a6","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T15:56:55.547579Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.24173/citation-record","integrity":"/paper/2605.24173/integrity","json":"/paper/2605.24173/citation-record.json","paper":"/paper/2605.24173"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.614089Z","title":"https://deepmind.google/models/gemini-diffusion/","venue":null,"work_id":"a650d48d-ba30-4b4d-9caa-3e6b240ca74d","year":null},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:067149be61794a9262a4fdde12b5b66717ce8240f65a89f4fd728c7d5141e7ea","observation_id":"ad5de18c-1b83-49c6-8833-561b61bfaf62","resolution":{"observed_at":"2026-07-08T15:25:03.615605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:26:05.824183Z","title":"Block diffusion: Interpolating between autoregressive and diffusion language models","venue":null,"work_id":"5d67f6a1-ee58-4120-99f4-fbd9f6127fa0","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:f816d8cfcf62471605f38f6caf7ac027e558817294f1502b4d6e42da471f77ca","observation_id":"1962eb32-ac4a-4291-8762-6c8c8520eaef","resolution":{"observed_at":"2026-07-08T15:25:03.630771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:26:05.754154Z","title":"Structured denoising diffusion models in discrete state-spaces.Advances in neural information processing systems, 34:17981–17993","venue":null,"work_id":"b3c340e2-b557-4352-95ba-6967124a292d","year":2021},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:5925d3d5af3c88fe3d4aa599232f53b1e906c56f916c57742af0b14d1bdc4f49","observation_id":"f66b3adb-3215-4096-a5f7-134a5534afc1","resolution":{"observed_at":"2026-07-08T15:25:03.617998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15745","last_updated":"2025-12-24T03:46:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-10T09:26:18Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","version":2},"cited_work":{"arxiv_id":"2512.15745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.15745","snapshot_observed_at":"2026-07-11T03:07:51.909523Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","venue":"cs.LG","work_id":"a1b1080d-0a91-44a4-8f70-2bf3e7a27e0b","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2512.15745","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:9923a93ee3e4bd0dcceb951542a994a61b074432abf96acb2f9d459b2b665ae2","observation_id":"51027602-d7de-4501-a050-936d93d87aa6","resolution":{"observed_at":"2026-06-30T16:04:53.273530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:07:52.049493Z","title":"LLaDA2.1 : Speeding up text diffusion via token editing","venue":null,"work_id":"e3c404e2-a097-4443-8acd-3b073ce2156e","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:98302365a5249a60a8665bcb17dcad3ab26f0f2592ecfe6b2c36fb0ee5b1ee66","observation_id":"13a9a7ef-b8ed-4769-a688-943f7f6674de","resolution":{"observed_at":"2026-06-30T16:04:53.271186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.550120Z","title":"Extracting training data from large language models","venue":null,"work_id":"7d8cfcbb-971a-4428-b03b-ffbb0bef1530","year":2021},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:2a78d02beea6c751e924bb5e3138cf96a543546e48cac43a8d1c63dc3ff2cc24","observation_id":"30ed30b9-68c5-460d-b095-fb9ca85f9d7b","resolution":{"observed_at":"2026-07-08T15:05:03.551751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.626934Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":"77e185c6-4831-4873-ad97-5e2dac977b78","year":2023},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:cb0ae61520f785b618b36b2531f54a5cad54b9da63e2a703ff269e3b5e71b77a","observation_id":"8af5b25d-b9ab-4f12-a8da-5adb1f10ac35","resolution":{"observed_at":"2026-07-08T15:25:03.628467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.585008Z","title":"Tracedet: Hallucination detection from the decoding trace of diffusion large language models","venue":null,"work_id":"e0b60648-702b-400b-8de7-2f203ea9958b","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:3590ffbdd6843a58bf56860990526574d02cc9ee293053110aeb6b80ecab949f","observation_id":"9fbd5af7-0493-4a7d-99fa-e042a0f08671","resolution":{"observed_at":"2026-07-08T15:25:03.586539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.587669Z","title":"Membership inference attacks against fine-tuned diffusion language models","venue":null,"work_id":"17e78c3e-2859-4173-a113-6912413bc478","year":null},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:a7e493c03dc7706364a05af7e8adf40ef0262138b500b8138f45b4d66015dc48","observation_id":"b85c2f5e-e363-4004-bda9-484b2e929889","resolution":{"observed_at":"2026-07-08T15:25:03.589144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.605097Z","title":null,"venue":null,"work_id":"b7d6ce19-a687-4f73-a265-b43a7a6fe8a6","year":null},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:4b621a347d7ff42d67c02f8168297ca00adf77d01b41e8ac435a94a0e7924d6a","observation_id":"f6776c15-7f5d-4fcd-90e3-169ee9d6eb0c","resolution":{"observed_at":"2026-07-08T15:25:03.606452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.621699Z","title":"Partition generative modeling: Masked mod- eling without masks","venue":null,"work_id":"f8ced1d9-d644-469f-a3dc-44ac2df0bded","year":null},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:2c1f7cad9f89e955416423fde3a67f026c43fed7c9ab3448bc091143fb3e3b9c","observation_id":"adbe1d80-fb48-4cdf-8ef4-7087ccc8b36c","resolution":{"observed_at":"2026-07-08T15:25:03.624084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.548211Z","title":null,"venue":null,"work_id":"8f5f9cdc-cb03-4047-a1ca-6477fd958f25","year":null},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:e12797be60cd42c5cd49eb096b22ece30a6a1fef1dfc7a5eb2090826efd7b9b8","observation_id":"506e4e13-f354-41c8-b452-d6f00c24412a","resolution":{"observed_at":"2026-07-08T15:05:03.549445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.583885Z","title":"Do membership inference attacks work on large language models? InConference on Language Modeling (COLM), 2024","venue":null,"work_id":"71d3ecf3-d00a-47d7-9301-61ca1dbe72de","year":2024},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:69da491f1ab5187047d761b387a1635789f0360620dfef7a5f26cbb2ecbedb64","observation_id":"1d5bb6f0-1223-4b29-aa89-630b6546ea52","resolution":{"observed_at":"2026-07-08T15:25:03.585220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.609738Z","title":"General data protection regulation, 2016","venue":null,"work_id":"80b2e3ae-996c-41d9-b6b4-ec18b6a5957d","year":2016},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:70e7ea7e7c0bb6ed029cfc1101aac06be622fc24292064bf66260520c8ada892","observation_id":"a160892a-0c11-441d-9ad9-501dfa463eb3","resolution":{"observed_at":"2026-07-08T15:25:03.611210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03677","last_updated":"2026-04-04T10:26:36Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T10:26:36Z","title":"Unlocking Prompt Infilling Capability for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2604.03677","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03677","snapshot_observed_at":"2026-06-30T16:04:53.249072Z","title":"Unlocking Prompt Infilling Capability for Diffusion Language Models","venue":"cs.CL","work_id":"8b834423-482d-4269-8ab9-7fda16060e5a","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2604.03677","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:4e23efaf8543930c03eb4f900b2fa03681649f48275056f337ad83e4f34aff13","observation_id":"152ce0a3-9a59-4bb2-a931-45944f1c435f","resolution":{"observed_at":"2026-06-30T16:04:53.250466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.543493Z","title":"Scaling diffusion language models via adaptation from autoregressive models","venue":null,"work_id":"58e75a0a-14fc-40f0-a9dc-87314f84755b","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:96fcb7a087b10e23018928c8720e7c24a116e451f774d99fd3f4807ae29aadb9","observation_id":"b1e34da5-824c-4cbf-a40a-a34a1f2ce824","resolution":{"observed_at":"2026-07-08T15:05:03.545017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.577566Z","title":"Measuring memorization in language models via probabilistic extraction","venue":null,"work_id":"6eff01c6-11e9-4b8c-8cbe-6bd946a87caa","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:1c9f575cb2f96065cbd7318afcfc488101b67c972a46bd18905ec2205d925fa4","observation_id":"5cb4e973-a379-4a2b-9f76-960e0bcb17ef","resolution":{"observed_at":"2026-07-08T15:25:03.579455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.541418Z","title":"Diffusionbert: Improving generative masked language models with diffusion models","venue":null,"work_id":"b41f0035-06eb-451b-b1e1-868334a78296","year":2023},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:a7f1926b472a5cc3fd4a70fae4badcdba76b84340de2d564e9ff53240ab1e9ad","observation_id":"d34ea583-524e-4204-8b58-2021ac96569e","resolution":{"observed_at":"2026-07-08T15:05:03.542913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.36227/techrxiv.176521385.54906010/v1","metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.545774Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"94433dcd-0006-408d-a6b0-a20ced9e49eb","year":2022},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:0be2ad1d5c546b720bf398ab93cef1fb50ed3ec629347c8d6b6087a6ed7fed37","observation_id":"7693f677-18d9-47c2-a80e-1bbfa5ce1bb4","resolution":{"observed_at":"2026-07-08T15:05:03.547406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.602657Z","title":"Accelerating diffusion LLMs via adaptive parallel decoding","venue":null,"work_id":"8aa8acec-05aa-4699-b2fa-3f1e1b9a2ca0","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:ce6be9a7c8d9ca9a3cbeff39c1ef186ea3e132d766567a2e9459f5294ba30f08","observation_id":"1ac5e508-39fe-4f3f-9c18-af9fa669a898","resolution":{"observed_at":"2026-07-08T15:25:03.604411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.611840Z","title":"Copyright violations and large language models","venue":null,"work_id":"dfc44e11-2659-4988-b470-4761f0cc3c3d","year":2023},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:8cf39bd8fc0e5b9506a6431c7c6340e7b63f252de9c4d4939a94491063b990cc","observation_id":"59724f74-3b18-46f2-9c13-551033d1f287","resolution":{"observed_at":"2026-07-08T15:25:03.613490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:04.287575Z","title":"The enron corpus: A new dataset for email classification research","venue":null,"work_id":"fa8d9444-dc08-47af-9220-95e0fce74399","year":2004},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:67f658ff80c0883eadc916e6b42a4715f12fa35ecaab41b84ea3f39341ff0392","observation_id":"d9f80b3f-bc1a-47f7-90d3-0612892c6a7f","resolution":{"observed_at":"2026-07-08T15:05:04.288916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17298","last_updated":"2025-06-17T17:06:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T17:06:18Z","title":"Mercury: Ultra-Fast Language Models Based on Diffusion","version":1},"cited_work":{"arxiv_id":"2506.17298","doi":"10.48550/arxiv.2506.17298","metadata_source":"pith","pith_arxiv_id":"2506.17298","snapshot_observed_at":"2026-07-11T03:07:52.151759Z","title":"Mercury: Ultra-Fast Language Models Based on Diffusion","venue":"cs.CL","work_id":"09638e55-9958-4407-94da-0a6fbc082ebc","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2506.17298","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:55917fba70201fa494bfcd5c004d1a07104efb4cf908919fdfa66722e35f6ea4","observation_id":"02eb047e-26bf-4f14-9e8e-8e3f137ec510","resolution":{"observed_at":"2026-06-30T16:04:53.245646Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":"2411.15124","doi":"10.48550/arxiv.2411.15124","metadata_source":"pith","pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","venue":"cs.CL","work_id":"28c9dbea-056a-48c2-8000-85f809827e45","year":2024},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:2951ddfb98e93d591d0967cbc15b2146c7233f6ab8703ad57255cca34b481a23","observation_id":"bc0d10da-e6d9-44ac-9f80-58fda6831790","resolution":{"observed_at":"2026-06-30T16:04:53.248019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.592903Z","title":"Deduplicating training data makes language mod- els better","venue":null,"work_id":"b640bf6b-a098-4919-9b92-01b8dfb9c4cd","year":2022},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:71db988f50b789edb4b00d05bda302e3eddaa276723361d64c25fe818d063cd6","observation_id":"7ac6acb0-8872-4655-b9dc-8e98904a0437","resolution":{"observed_at":"2026-07-08T15:25:03.594507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.588970Z","title":"Breaking AR’s sampling bottleneck: Provable acceleration via diffusion language models","venue":null,"work_id":"69226c0e-b68c-4456-b4df-ee54bed4b303","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:62f11ef7c253b053ac60b9d16f3b469b88dbf68748f611e51d8bea9dfedbc8cf","observation_id":"0eb1effe-51b6-46ba-bc9b-98ed92cb0bc5","resolution":{"observed_at":"2026-07-08T15:25:03.590341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:04.284640Z","title":"Diffusion language model knows the answer before it decodes","venue":null,"work_id":"1cd7b4a0-6b39-4273-b608-ff7bf70ae05f","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:fcf8ed725b7d0d8b36fab49bd0a1e555f71ef5fcae0604c0b55c9f79bfe46497","observation_id":"fcb7cae4-9e8a-4781-a1c1-7b2265257b3e","resolution":{"observed_at":"2026-07-08T15:05:04.286186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10875","last_updated":"2026-06-04T15:16:30Z","snapshot_observed_at":"2026-07-06T22:13:04.624677Z","submitted_at":"2025-08-14T17:47:22Z","title":"A Survey on Diffusion Language Models","version":3},"cited_work":{"arxiv_id":"2508.10875","doi":"10.48550/arxiv.2508.10875","metadata_source":"pith","pith_arxiv_id":"2508.10875","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Lavida: A large diffusion model for vision-language understanding.Advances in neural information process- ing systems, 2025b","venue":"cs.CL","work_id":"e44cc99a-c47c-4c26-9848-e709df566178","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2508.10875","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:61a5e876baa57d98bbb31e151c9576d2107d3a0ee8c83c103aba8e8c69e2080a","observation_id":"60a2cf7c-5d67-4d3f-b08d-dc8d915566c0","resolution":{"observed_at":"2026-06-30T16:04:53.260059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.607233Z","title":"Diffusion-lm improves controllable text generation.Advances in neural information processing systems, 35:4328–4343, 2022","venue":null,"work_id":"b14cd7b5-9aaa-43d1-8d2c-49b48a639ad0","year":2022},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:2c1800e019922a6cea7cad86632cb55cb49a5f05c2a86256d8879d4f8a2e2d28","observation_id":"3820ece0-4f0c-4cc5-bedc-6abcba1fb37f","resolution":{"observed_at":"2026-07-08T15:25:03.608606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.568950Z","title":"Analyzing leakage of personally identifiable information in language models","venue":null,"work_id":"1f22bc18-773c-4222-8d58-16ad775e7e4b","year":2023},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:aafef9503a0df4eed247cbd6d5656d672a74a561812b371bb584f978bbf05d7a","observation_id":"bd9c8c6c-bdfc-4ef7-999a-ef248610e532","resolution":{"observed_at":"2026-07-08T15:25:03.570662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.02333","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T16:04:53.251819Z","title":"Characterizing memorization in diffusion language models: Generalized extraction and sampling effects.arXiv preprint arXiv:2603.02333, 2026","venue":null,"work_id":"84e4dfde-c46f-49a5-9698-7129626aff1e","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:8010b477a82100719209a3648e4ae8a5c4c4b4636019f160ec24d65aae8363fe","observation_id":"768e795d-6fee-4f2f-926a-8939a370bcc8","resolution":{"observed_at":"2026-06-30T16:04:53.253576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.597683Z","title":"Microsoft Presidio: Context aware, pluggable and customizable PII anonymization service for text and images.https://microsoft.github.io/presidio, 2018","venue":null,"work_id":"610de926-5478-4a47-9013-a8aadc73af0a","year":2018},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:4f5ba34a7c414877f2ad4d056064dba07a6afdf030dac82156ee0fdda8c6cf0b","observation_id":"400f40d7-2b5f-4044-bcbf-2c131d55862e","resolution":{"observed_at":"2026-07-08T15:25:03.599600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.591786Z","title":"Feder Cooper, Daphne Ippolito, Christopher A","venue":null,"work_id":"41961d7f-85ec-4535-adf3-d4e7bdcc3a94","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:2c4622be712434049c12302e3c46f54a2685ad3af14de56d37ceac71f90257f0","observation_id":"50aa581b-23f9-49f7-8cb2-b7cd5fff00f8","resolution":{"observed_at":"2026-07-08T15:25:03.593150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.624785Z","title":"Large language diffusion models","venue":null,"work_id":"07a00cb6-14b7-4fdd-afcb-1620d901ba5a","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:1a17126e463ccc162d401109a3085593afed70462633b793e43ecc518c9332a3","observation_id":"68fc55f6-5ff0-4f6f-a7fe-02e06b1aab05","resolution":{"observed_at":"2026-07-08T15:25:03.626340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.580018Z","title":"Guidance regarding methods for de-identification of protected health information in accordance with the health insurance portability and accountability act (hipaa) privacy rule","venue":null,"work_id":"440a2dd6-c591-4251-ac34-5fa0eb6b8ee0","year":2012},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:9e2bf4117e3df99f8370a576aec87f28d878825f68e516e731739f9f514e34d9","observation_id":"1eddbae4-7fc3-4273-a95e-270399a4878c","resolution":{"observed_at":"2026-07-08T15:25:03.582085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.16459","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:39:03.613411Z","title":"Dynhd: Hallucination detection for diffusion large language models via denoising dynam- ics deviation learning.arXiv preprint arXiv:2603.16459","venue":null,"work_id":"424e885c-3b44-46fd-a40f-5bbaab770593","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:5245607e3ab84c9622900b0f58632941e1c11e81ea4e4d2544d05cbcaf350135","observation_id":"fec5f748-08be-414f-8495-b637548c0c54","resolution":{"observed_at":"2026-06-30T16:04:53.268264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.16294","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T16:04:53.251524Z","title":"Balancing innovation and oversight: Ai in the us treasury and irs: A survey","venue":null,"work_id":"21887c37-17a3-4e78-9160-d20fb598f206","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:d5a38f9e0923af0829ea02ea9d1375aec226a5c37c873403572a409d495a6a61","observation_id":"84f8d8a4-8036-4094-8e58-b63f9970765f","resolution":{"observed_at":"2026-06-30T16:04:53.253292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02193","last_updated":"2025-08-04T08:43:01Z","snapshot_observed_at":"2026-07-06T22:07:21.387432Z","submitted_at":"2025-08-04T08:43:01Z","title":"Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference","version":1},"cited_work":{"arxiv_id":"2508.02193","doi":"10.48550/arxiv.2508.02193","metadata_source":"pith","pith_arxiv_id":"2508.02193","snapshot_observed_at":"2026-07-11T03:07:51.699550Z","title":"Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference","venue":"cs.CL","work_id":"7412f5f3-8e71-41c1-9c69-d4ca250b18fa","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2508.02193","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:9ae09ba31aa82879955d51e0e7aecc7259fa4038c07a95a6bac8257e18786da8","observation_id":"add69936-4d89-431f-9b11-6f88c4865e30","resolution":{"observed_at":"2026-06-30T16:04:53.230591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04236","last_updated":"2022-11-08T13:30:27Z","snapshot_observed_at":"2026-07-06T14:15:44.460161Z","submitted_at":"2022-11-08T13:30:27Z","title":"Self-conditioned Embedding Diffusion for Text Generation","version":1},"cited_work":{"arxiv_id":"2211.04236","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.04236","snapshot_observed_at":"2026-07-03T17:38:43.646621Z","title":"Self- conditioned embedding diffusion for text generation","venue":null,"work_id":"b8ff832e-f8bf-46b5-a76a-7491ac443852","year":2022},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2211.04236","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:996d43acc43c8bd3351343d96223a8e843147060fbf896aa0e8a0d76a54f819f","observation_id":"7804315e-264b-4138-a62a-6ac95119267d","resolution":{"observed_at":"2026-06-30T16:04:53.227653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:ed381f3cf1ea81f8623744bd74c3e38ad937b47d8c60425fdb20510a7ebfa028","observation_id":"af87db23-644a-4e46-b886-3f735387d976","resolution":{"observed_at":"2026-06-30T16:04:53.232860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08750","last_updated":"2026-05-07T09:32:16Z","snapshot_observed_at":"2026-08-02T07:30:06.554494Z","submitted_at":"2025-10-09T19:07:48Z","title":"Exploring Cross-Client Memorization of Training Data in Large Language Models for Federated Learning","version":2},"cited_work":{"arxiv_id":"2510.08750","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.08750","snapshot_observed_at":"2026-06-30T16:04:53.237820Z","title":"Exploring Cross-Client Memorization of Training Data in Large Language Models for Federated Learning","venue":"cs.LG","work_id":"f80b0d19-7f80-4008-b2a0-202f54009878","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2510.08750","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:d494a8543d4fae627fa793fc6e76b0df3566d4f2e176c4614db9c8a77661b5ac","observation_id":"9a1b4723-6c40-4a1a-8d1f-3d9dbfb3361b","resolution":{"observed_at":"2026-06-30T16:04:53.239559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.587251Z","title":"Department of the Treasury","venue":null,"work_id":"f5789d28-5958-4a88-a60e-b5c6530844d6","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:494a58ea8d4a48741de4a398ff1140c1bf23785b68d9ace5878a471f4c8677d1","observation_id":"4b533107-640a-47a0-8ddb-aca2231486ff","resolution":{"observed_at":"2026-07-08T15:25:03.588414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.618626Z","title":"The devil behind the mask: An emergent safety vulnerability of diffusion LLMs","venue":null,"work_id":"7eae892a-3ca8-4598-94c2-7b3140f08a45","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:e822811dee83331941889bad74d6cc431742ca4212f55f59571838287b76c8a9","observation_id":"87e750e1-f49f-4072-bbd4-c55d777accde","resolution":{"observed_at":"2026-07-08T15:25:03.620993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:04.291989Z","title":"Fast-dLLM: Training-free acceleration of diffusion LLM by enabling KV cache and parallel decoding","venue":null,"work_id":"75d6f748-bd14-47d0-b569-85e68beae73b","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:8b7e8f5a0db551c8b612187f971c42417df5cdda7216473f1e7edb64bb918021","observation_id":"960fe4ce-ec65-41e4-ac29-dabd8cda3afb","resolution":{"observed_at":"2026-07-08T15:05:04.293433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.05578","doi":"10.48550/arxiv.2507.05578","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"The landscape of memorization in","venue":null,"work_id":"0ddd97c6-91c7-4d74-a289-9a80b6231a63","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:84f44dc27e30ac1cb2a14e66a95ef75ed977f81909fb60d89a28d6087f526934","observation_id":"8b770911-4113-44ae-b2cb-7afffd07e975","resolution":{"observed_at":"2026-06-30T16:04:53.258238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.600443Z","title":"Energy-based diffusion language models for text generation","venue":null,"work_id":"d58f4244-fe5a-430f-b670-1f1da14a0e79","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:8cf8ae02053a945d2c2945e870fa96b34f0d87bf34a0ab2da40fd6c70c034459","observation_id":"9b01e499-ebd1-48bd-af65-10293ab3ad28","resolution":{"observed_at":"2026-07-08T15:25:03.602073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.15487","doi":"10.48550/arxiv.2508.15487","metadata_source":"pith","pith_arxiv_id":"2508.15487","snapshot_observed_at":"2026-07-11T03:07:51.591672Z","title":"Dream 7B: Diffusion Large Language Models","venue":"cs.CL","work_id":"a8a49dbd-ad10-4c79-b1aa-3ad5173887ad","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"cited_paper":"/paper/2508.15487","citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:5443b48a893dfd93844684303e5fc8eb9cd4607e6c3fa9dde5d0b0417c63d7a8","observation_id":"89c46674-8bb7-4867-8788-b61c648998bc","resolution":{"observed_at":"2026-06-30T16:04:53.260636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:04.294578Z","title":"Bag of tricks for training data extraction from language models","venue":null,"work_id":"511aadea-f8ba-491d-b562-e4052375ef30","year":2023},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:3f815368c58f5fc1a623ef9263bdc9af3b9512aeb3dcae80a7014d71587309b3","observation_id":"e9389dc7-8bb6-4b67-bac3-a2495b978c97","resolution":{"observed_at":"2026-07-08T15:05:04.296303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.595196Z","title":"Exploring memorization in fine-tuned language models","venue":null,"work_id":"06a1b719-b9b6-4b87-a5aa-36b2a620813f","year":2024},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:73b96b570c0c5d9a639f7f88e2a53861a7f8b1c72f9b1c858459b83345237825","observation_id":"39e2909f-1efb-4d33-a667-4c49b5432b75","resolution":{"observed_at":"2026-07-08T15:25:03.596968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.590875Z","title":"Jailbreaking large language diffusion models: Revealing hidden safety flaws in diffusion-based text generation","venue":null,"work_id":"1d600544-67f5-4b79-aa56-773f9fa83c21","year":2025},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:b0e374b4cef52d52f040f4059b6d972d3b45f344aa32ee17c60d6bada8c644f1","observation_id":"d1e7f9e0-7d38-451d-8ba5-7369e13e9180","resolution":{"observed_at":"2026-07-08T15:25:03.592258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:25:03.631381Z","title":null,"venue":null,"work_id":"712df299-78aa-422f-aac9-f24c2af40061","year":null},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:7f5ed9f9023138e1502d160953b302de2d3df1431517708fd6eaada6b725c0d4","observation_id":"b74c913e-e324-49e2-891b-9dac8ae6c4eb","resolution":{"observed_at":"2026-07-08T15:25:03.632787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:04.289717Z","title":"d1: Scaling reasoning in diffusion large language models via reinforcement learning","venue":null,"work_id":"c47aef25-7f20-4d2e-a9ce-5f3b4fe144c0","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:f3600af7f92acc862fa5fe59d97067688ccc6fb4fc15d34cf76e9d1063c03666","observation_id":"a156beb8-21b3-4810-88f6-66a5e2ab2ef2","resolution":{"observed_at":"2026-07-08T15:05:04.291200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.22661","doi":"10.48550/arxiv.2602.22661","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"dllm: Simple diffusion language modeling.arXiv preprint arXiv:2602.22661","venue":null,"work_id":"79bb3c31-3372-49bf-a075-d9da0118f456","year":2026},"citing_paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T15:56:55.547579Z"},"links":{"citing_paper":"/paper/2605.24173"},"observation_digest":"sha256:6ab615e65239c81dbd7f353d8094c5bcfaa92c4125540954dd9a75e80e6b94dd","observation_id":"2aeb7e55-529c-4118-84bc-27d5ff5c6004","resolution":{"observed_at":"2026-06-30T16:04:53.265351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24173","last_updated":"2026-05-22T19:46:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:34:18.555542Z","submitted_at":"2026-05-22T19:46:08Z","title":"Extracting Training Data from Diffusion Language Models via Infilling"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":16,"verified_fuzzy":34},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2605.24173."}