{"as_of":"2026-08-06T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39fdf0a355d351645bb86852cdc1e4755a20178855f3367a45729bc36a51be33","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T05:08:07.318040Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.20179/citation-record","integrity":"/paper/2605.20179/integrity","json":"/paper/2605.20179/citation-record.json","paper":"/paper/2605.20179"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":"2205.01068","doi":"10.48550/arxiv.2205.01068","metadata_source":"pith","pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-07-11T03:37:45.880117Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":"cs.CL","work_id":"d7ff3b21-1fff-4cf4-952a-4714e3ef2307","year":2022},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:305bbf4c633dc49c25f951cb600d77b099c45b22bf00a9b8a97f67239ad88adc","observation_id":"0f9b5235-1bde-4ee7-b7ec-2389628b6e1f","resolution":{"observed_at":"2026-05-20T05:13:03.731050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:89644f81532e978beac6e5cce42ac0780e704b74edb6cad95e2f875feb26c5e1","observation_id":"113e6e4b-1039-4dd0-aa8a-15d076ecfb09","resolution":{"observed_at":"2026-05-20T05:13:03.752058Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:37f4189936e14b1c7dba94ed4ee63cf6e084c01cafbfae496d19cb7db591738b","observation_id":"d4d7dabb-125b-4680-95e9-b135c9382e38","resolution":{"observed_at":"2026-05-20T05:13:03.757977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":"2502.09992","doi":"10.48550/arxiv.2502.09992","metadata_source":"pith","pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Diffusion Models","venue":"cs.CL","work_id":"cce0f4b3-ed4d-4375-b84d-3f01316016c1","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:9bd813a31c19365ee895e33b740ff5e426da97074676b6057bf408fccda24916","observation_id":"7bb4c9cd-a4e7-4a86-93dc-a577b0d4497a","resolution":{"observed_at":"2026-05-20T05:13:03.733901Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.15487","doi":"10.48550/arxiv.2508.15487","metadata_source":"pith","pith_arxiv_id":"2508.15487","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dream 7B: Diffusion Large Language Models","venue":"cs.CL","work_id":"a8a49dbd-ad10-4c79-b1aa-3ad5173887ad","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2508.15487","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:4444e7abebe0ad840363abafd66c59f020ae1f932609db94ec75835b80243d3e","observation_id":"caffc47f-c238-4bb0-a6e1-db6383da6e8b","resolution":{"observed_at":"2026-05-20T05:13:03.719093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15745","last_updated":"2025-12-24T03:46:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-10T09:26:18Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","version":2},"cited_work":{"arxiv_id":"2512.15745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.15745","snapshot_observed_at":"2026-07-11T03:07:51.909523Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","venue":"cs.LG","work_id":"a1b1080d-0a91-44a4-8f70-2bf3e7a27e0b","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2512.15745","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:85cdb05e1e1df12b0beb969a1721b99d0f5f3ec6ed42a1160923f448208c7e4c","observation_id":"00bcf1f7-fbe1-44f3-adc6-934c17a35432","resolution":{"observed_at":"2026-05-20T05:13:03.722203Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17891","last_updated":"2025-05-31T07:01:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-23T14:04:22Z","title":"Scaling Diffusion Language Models via Adaptation from Autoregressive Models","version":3},"cited_work":{"arxiv_id":"2410.17891","doi":"10.48550/arxiv.2410.17891","metadata_source":"pith","pith_arxiv_id":"2410.17891","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Diffusion Language Models via Adaptation from Autoregressive Models","venue":"cs.CL","work_id":"48644013-438b-4fbc-a954-11e2c6f91808","year":2024},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2410.17891","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:b1f5c71d1a577c2842d6ac1c181af9926e007d3e2c59a22fce1855ab4056c71f","observation_id":"55e81f24-ade2-442f-918f-5f08c67fda51","resolution":{"observed_at":"2026-05-20T19:59:37.219442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"cited_work":{"arxiv_id":"2101.03961","doi":"10.1214/18-ejs1395","metadata_source":"pith","pith_arxiv_id":"2101.03961","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","venue":"cs.LG","work_id":"f43c4955-a965-4897-a11b-c4b25d2aeaa8","year":2021},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2101.03961","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:dbc124c0b609cdaa1b8321d89747c654ef1d97e75f0563af55fe2d7b3c7fceea","observation_id":"0f0044f2-cd4c-4b3c-96b8-aab802e1b118","resolution":{"observed_at":"2026-05-20T05:13:03.713281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.17077","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jiakun Fan, Yanglin Zhang, Xiangchen Li, and Dimitrios S","venue":null,"work_id":"480b455c-924b-4492-8936-1661e5c4b882","year":null},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:d32d3e7331939b9fd0f01367e1b5d8325f4c1f475739958adc6ff88a64a1d206","observation_id":"45ff2155-b4bf-45d5-93ea-97901e71d8b9","resolution":{"observed_at":"2026-05-20T05:13:03.716225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06865","last_updated":"2023-06-12T07:48:53Z","snapshot_observed_at":"2026-08-06T08:43:40.051791Z","submitted_at":"2023-03-13T05:19:28Z","title":"FlexGen: High-Throughput Generative Inference of Large Language Models with a Single GPU","version":2},"cited_work":{"arxiv_id":"2303.06865","doi":"10.48550/arxiv.2303.06865","metadata_source":"pith","pith_arxiv_id":"2303.06865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Y ., Xie, Z., Chen, B., Barrett, C., Gonzalez, J","venue":"cs.LG","work_id":"c99785d7-2d72-4d2f-8363-f4db53cf669f","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2303.06865","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:7984f211c79454677a66bdda4f8266c386e9f538a2d02b5bd92f29968c255f5c","observation_id":"9338576d-07b3-400e-a5f0-267a21c1bbab","resolution":{"observed_at":"2026-05-20T05:13:03.728349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17312","last_updated":"2024-03-26T01:46:34Z","snapshot_observed_at":"2026-07-31T15:33:16.160466Z","submitted_at":"2024-03-26T01:46:34Z","title":"ALISA: Accelerating Large Language Model Inference via Sparsity-Aware KV Caching","version":1},"cited_work":{"arxiv_id":"2403.17312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17312","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Merino: Entropy-driven design for generative language models on iot devices","venue":null,"work_id":"050a9645-22c8-4e90-9bb0-8c7a3689caed","year":null},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2403.17312","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:2dcff72dd4847207a769ddccfb639be8d51e1b13ea424066fa717ed9736d5130","observation_id":"d6e6d716-bb7c-44dc-9b1b-860c560dc3a5","resolution":{"observed_at":"2026-05-20T05:13:03.755282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.03274","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quant- dllm: Post-training extreme low-bit quantization for diffusion large language models","venue":null,"work_id":"6fe563a9-0ec4-4cb6-bd15-ae976dc74ef3","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:293e99e54e5208abd1a0c3d8aaae1fbf897bddbfd5ca50ba5e1283918bcc2758","observation_id":"bf5801a3-2f0a-49de-8c30-6ff1c7e08711","resolution":{"observed_at":"2026-05-20T05:13:03.760772Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:9a772463d02daaa2cf28d3e718753024c35c320d5c5986d19ff33af2342637e8","observation_id":"6bb5c8fc-a2bc-4180-8bb0-5ba106576c76","resolution":{"observed_at":"2026-05-20T05:13:03.704690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19982","last_updated":"2026-04-09T08:29:43Z","snapshot_observed_at":"2026-08-02T21:00:22.153828Z","submitted_at":"2025-08-27T15:40:25Z","title":"Diffusion Language Models Know the Answer Before Decoding","version":5},"cited_work":{"arxiv_id":"2508.19982","doi":"10.48550/arxiv.2508.19982","metadata_source":"pith","pith_arxiv_id":"2508.19982","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Diffusion Language Models Know the Answer Before Decoding","venue":"cs.CL","work_id":"9c0f971d-3b32-4d40-8abd-9b1ac03e18b4","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2508.19982","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:20978001c9089ecd4217ae50eacdae92b29d421781a7ab63f2ae1572fc9ca3c1","observation_id":"83b15ddb-21a6-43cf-a67d-2c5854c9bf0d","resolution":{"observed_at":"2026-05-20T05:13:03.698590Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Post-training quantization on diffusion models.2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 1972–1981","venue":null,"work_id":"d091a01e-ca5b-4762-a478-ad9fd70600c1","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:8a61ab03560ef1d0c9354e13149cb30926da349c1550520dbea35098e0f754a1","observation_id":"4322819a-bd0e-4967-a810-1c4b771e50c1","resolution":{"observed_at":"2026-05-20T05:13:21.926676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10657","last_updated":"2023-11-01T08:40:41Z","snapshot_observed_at":"2026-07-06T15:29:01.076710Z","submitted_at":"2023-05-18T02:28:42Z","title":"PTQD: Accurate Post-Training Quantization for Diffusion Models","version":4},"cited_work":{"arxiv_id":"2305.10657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10657","snapshot_observed_at":"2026-07-03T10:17:58.028502Z","title":"Ptqd: Accurate post-training quantiza- tion for diffusion models.arXiv preprint arXiv:2305.10657","venue":null,"work_id":"27a6738c-79dd-455a-912a-c66b3a16b35d","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2305.10657","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:6f50055a842c293c506789b9aaee33faede6274af6b8cb234c2fec6cafae67ea","observation_id":"3ba97499-6cd2-48b3-922a-bb25b555c152","resolution":{"observed_at":"2026-05-20T05:13:03.701766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:b34c5cde24d64590f2dbe6174e9976b9675f5ca0d3ca356ca2f5144335c0533d","observation_id":"27eaf72f-a32c-4b38-86b6-2340c878028f","resolution":{"observed_at":"2026-05-20T05:13:03.710574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14361","last_updated":"2025-03-12T18:14:21Z","snapshot_observed_at":"2026-08-03T09:09:47.667294Z","submitted_at":"2024-01-25T18:07:50Z","title":"MoE-Infinity: Efficient MoE Inference on Personal Machines with Sparsity-Aware Expert Cache","version":3},"cited_work":{"arxiv_id":"2401.14361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.14361","snapshot_observed_at":"2026-07-04T07:59:39.550340Z","title":"Xue, L., Fu, Y ., Lu, Z., Mai, L., and Marina, M","venue":null,"work_id":"2fcfe188-dd65-40ca-b9f1-f10a58f699ae","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2401.14361","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:558b16b7ea6c02cd5d1c7a6b9e11a6cef6b6045382a561320eb2f7fb6827910c","observation_id":"b4175d1d-845f-4f1c-b391-4bfa1a17e30f","resolution":{"observed_at":"2026-05-20T05:13:03.693206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07033","last_updated":"2025-05-01T09:58:34Z","snapshot_observed_at":"2026-08-03T15:49:12.253237Z","submitted_at":"2024-02-10T19:54:08Z","title":"Fiddler: CPU-GPU Orchestration for Fast Inference of Mixture-of-Experts Models","version":3},"cited_work":{"arxiv_id":"2402.07033","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.07033","snapshot_observed_at":"2026-07-04T07:59:39.592306Z","title":"Fid- dler: Cpu-gpu orchestration for fast inference of mixture- of-experts models.arXiv preprint arXiv:2402.07033","venue":null,"work_id":"dc4f825f-88ae-4063-a092-8dddc39466f6","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2402.07033","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:0d3d86c8902d178e86f78394a2ac50d97560ad89fc6313248e4679a9faf486f7","observation_id":"1087921c-6810-437f-8404-1439cc18a27b","resolution":{"observed_at":"2026-05-20T05:13:03.696021Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":"2006.11239","doi":"10.48550/arxiv.2006.11239","metadata_source":"pith","pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Denoising Diffusion Probabilistic Models","venue":"cs.LG","work_id":"dc023f4e-7c79-471c-b713-deeb559ba010","year":2020},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:768612798d08b08c59ea8116c23722a9bf3a4fbea43a9d27ceb9a440f2b5e83d","observation_id":"32ea3cec-a299-4346-adaa-988a4b61ef13","resolution":{"observed_at":"2026-05-20T05:13:03.686922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:06.511104+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:06.511104+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blattmann, Dominik Lorenz, Patrick Esser, and Björn Ommer","venue":null,"work_id":"3cbc597a-65b2-4556-b496-b8c943a78104","year":2022},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:b08d1a9b41df75bac438e95dcedc24d68f7766bb989575c27b12a5437b95fc37","observation_id":"c8430cca-59cd-4e44-b0b3-004cb7a03812","resolution":{"observed_at":"2026-05-20T05:13:21.924691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peebles and Saining Xie","venue":null,"work_id":"ca742f4d-4d8f-419a-adaf-156bb0c73c30","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:c09681462904657354dee8482b6a7e406aef3a5008076a5fb15cbb01cfa1a17e","observation_id":"65361a2d-8d96-4de8-b9c6-17d23ec44c8a","resolution":{"observed_at":"2026-05-20T05:13:21.922737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":"2310.00426","doi":"10.48550/arxiv.2310.00426","metadata_source":"pith","pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","venue":"cs.CV","work_id":"77157568-e4be-4041-bb20-388177fc59d0","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:e9e11cf1db0742ab7c53eff285efaec883a47082f682938aa8187c4d6fdcfcaf","observation_id":"ea46ffab-6b91-458b-afc5-6c615999db4d","resolution":{"observed_at":"2026-05-20T05:13:03.684257Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":"2412.20404","doi":"10.48550/arxiv.2412.20404","metadata_source":"pith","pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora: Democratizing Efficient Video Production for All","venue":"cs.CV","work_id":"8b29ba7b-3d84-4281-85b7-9eaf905afd7f","year":2024},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:0d15b4e2ecd40f6cdc03548df854e599c3446b44973153bf3971380ecd54c09c","observation_id":"9a57b365-99be-4e39-92bd-606b847d5be0","resolution":{"observed_at":"2026-05-20T05:13:03.690121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05596","last_updated":"2022-07-21T18:21:36Z","snapshot_observed_at":"2026-07-06T12:27:29.223870Z","submitted_at":"2022-01-14T18:36:04Z","title":"DeepSpeed-MoE: Advancing Mixture-of-Experts Inference and Training to Power Next-Generation AI Scale","version":2},"cited_work":{"arxiv_id":"2201.05596","doi":"10.48550/arxiv.2201.05596","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.05596","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Keisuke Sakaguchi, Ronan Le Bras, Chandra Bhagavatula, and Yejin Choi","venue":"arXiv (Cornell University)","work_id":"5af8bbea-08f6-4519-8d7e-b7ce9c838e57","year":2022},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2201.05596","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:21736f5c4caab95941391e7a145e39137237ec1df11a02a23fd346f1e6a40a63","observation_id":"9e642b10-4d14-4661-9f30-87781363a849","resolution":{"observed_at":"2026-05-20T05:13:03.707662Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1839410","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code available athttps://github.com/EleutherAI/lm-evaluation-harness","venue":null,"work_id":"b071570b-afcf-4a26-b2ef-3d3af466bc7b","year":1910},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:a05ab92e45a5937baca490e3125f84576b9e5d551556108bf26b4f775b71a2a4","observation_id":"a5390296-79ae-412d-9ec3-3f59d777ff3b","resolution":{"observed_at":"2026-05-20T05:13:03.677996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.08666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:52:44.928734Z","title":"dinfer: An efficient inference framework for diffusion language models","venue":null,"work_id":"620d2165-4a9e-40a3-af33-3c1f4803609b","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:75c1025a5eeda8477bad6c7c0ef1da17b50216ae572333cc46162d568e43e1dc","observation_id":"b6041338-c31f-4bd1-a05b-bb137fe18b2e","resolution":{"observed_at":"2026-05-20T05:13:03.681182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":0,"verified_exact":17,"verified_fuzzy":3},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2605.20179."}