{"as_of":"2026-08-13T23:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:009ce12e5e839a988579084fa286a74cb9ec92d7ec02a729da5a1716615129d0","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T00:15:58.082725Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:10:37.938422Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24832","snapshot_observed_at":"2026-08-01T15:10:37.938422Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18541","last_updated":"2026-07-20T22:16:36Z","snapshot_observed_at":"2026-08-06T13:50:53.888904Z","submitted_at":"2026-07-20T22:16:36Z","title":"What Governs Decode Throughput in Absolute-Offset GPU LZ77? A Work-Granularity Mechanism and an Encode-Time Min-Match-Length Lever","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T15:10:37.938422Z"},"links":{"cited_paper":"/paper/2605.24832","citing_paper":"/paper/2607.18541"},"observation_digest":"sha256:4cf45d3b3459bdcedcfd389262784a601e3ed907d007ae41645c278934eb8f68","observation_id":"07953599-3c75-4085-880b-5d0b8d7cb856","resolution":{"observed_at":"2026-08-01T15:10:37.938422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.24832/citation-record","integrity":"/paper/2605.24832/integrity","json":"/paper/2605.24832/citation-record.json","paper":"/paper/2605.24832"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:c5d45a0870482a620a9c204d72f493b148ef605905ea6f110dc6e59fb8377eff","observation_id":"fd7f41d7-f4ce-4ae7-a2f8-5e43fc263a1a","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9441.375944","doi":"10.1145/3759441.3759443","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , publisher =","venue":"ACM SIGOPS Operating Systems Review","work_id":"8549de24-2eea-4162-8ad3-bc9db51a5651","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:f24d6c14eeafe53552c9ff4d1cafc8e0d5e69f7167998e6f2f7293727a808376","observation_id":"fd8acf29-d88a-4d86-b57a-2bbf4bf80a03","resolution":{"observed_at":"2026-06-30T00:24:04.107672Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:2617e52efeeb619d6a34d9e8fbb99815328034b8e9aa658f28f31ff2a523eb11","observation_id":"fff2e7ab-73bb-4c35-a0cc-9c6b3417dd9c","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":"Chiu, Zhihan Yang, Zhix- uan Qi, Jiaqi Han, Subham Sekhar Sahoo, and Volodymyr Kuleshov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:b065cdb5f3474367b8237ff962b5602db9cdf3d11a0779d8628c883a5d06fce9","observation_id":"6b1c03b8-e9a4-4f27-8de4-a72189258b66","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09573","last_updated":"2025-05-17T21:15:02Z","snapshot_observed_at":"2026-08-03T23:49:05.512328Z","submitted_at":"2025-03-12T17:43:40Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","version":3},"cited_work":{"arxiv_id":"2503.09573","doi":"10.48550/arxiv.2503.09573","metadata_source":"pith","pith_arxiv_id":"2503.09573","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","venue":"cs.LG","work_id":"b34ab928-6ffb-4028-b13c-395a8924d76b","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2503.09573","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:497fd24fef888ca9068f171441da23b26264ca31173eaba7bac6be9aa3e4bb5b","observation_id":"1098aa02-d73c-48f5-a71b-d95f3c065515","resolution":{"observed_at":"2026-06-30T00:24:04.278742Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:9d22d134549a978cc49fbad1b99d4d8427762c7c56c7cd3d07f91ab727e3ff40","observation_id":"7cdebb3d-0965-4ea6-ac06-b19948b79794","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:3f5b680ce5371208e07eb17a9fcf4b8112b1f22f4e3968d9f3bd55efe28fd7ce","observation_id":"ea56a9d2-ea58-4414-8e6d-c888352e7944","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15745","last_updated":"2025-12-24T03:46:46Z","snapshot_observed_at":"2026-08-10T07:50:38.265616Z","submitted_at":"2025-12-10T09:26:18Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","version":2},"cited_work":{"arxiv_id":"2512.15745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.15745","snapshot_observed_at":"2026-07-11T03:07:51.909523Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","venue":"cs.LG","work_id":"a1b1080d-0a91-44a4-8f70-2bf3e7a27e0b","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2512.15745","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:e74f2695ac87bf65d3b9f83759dd2c408b17e5965c3b00c574060e8657b5d409","observation_id":"da0b99bf-7616-418a-b951-dd3f6cd15c06","resolution":{"observed_at":"2026-06-30T00:24:04.313139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":"2018.The psychology of human-computer interaction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:d5ef0b7258b939681f24c28e0b847ec00ec2ce03dced1c0a2f25dabb63f9b1a8","observation_id":"6482fb5e-6480-4179-934b-40aef1cdfc89","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:9c91650178465255ff20da147ac26481feb5bf482314a065948e8d2f0872cc04","observation_id":"d673e09c-b7e7-4886-ba25-f4b202a0d60f","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:b5aba91e78f81e0199a4a28e911af62083f3f2826d1d022b66a3cb258e85898b","observation_id":"67cd20fd-fb24-46ed-a00f-c5df76c57151","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06303","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:07:51.378138Z","title":"Sdar: A syn- ergistic diffusion-autoregression paradigm for scalable sequence generation.arXiv preprint arXiv:2510.06303","venue":null,"work_id":"78561109-9df2-4b95-b2c6-4136d3384b98","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:61e7ff6307c18c3c6b7d75ea4880a3ea76dc7c089ccca35486f2de8334328603","observation_id":"f8da4f01-fc28-4f20-83c0-7f2c5620230b","resolution":{"observed_at":"2026-06-30T00:24:04.292586Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:a0315bf15694df9b43ebe45fe90afbe0b79edfd1cac808f3817d93fd0961e75d","observation_id":"7d6f4ba1-734c-4bfc-a4e8-a33a99d6529a","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:c8794d97fcd24937516a4bcade1c59715d67af7f1660c3615ee4db5f9bb73360","observation_id":"c2ded437-8cdc-496e-88f0-52f255f2a200","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:a8b24e29d8fac50052b742948a1043c350a7f3dd19beae4bec89a460d3c6175d","observation_id":"a222e8af-f823-41e2-9385-b96e2b2cc1dc","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:97d52ad5d3257c59aa2da6eb2618052b86e6fe282857fc5b8cc2afeab7460c9e","observation_id":"02eb0c29-3b2e-448f-a0a1-88bb73a13d62","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":"int8 (): 8-bit matrix multiplication for transformers at scale.Advances in neural information processing systems35 (2022), 30318–30332","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:d6c44f2cb39bb341fff8c21cfc8343a3673edaa21be4eddea3b2985c6eb6ba3f","observation_id":"719fa91c-d2a8-4321-9f0b-94f08c806ada","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:6bef55ea05861e4110195ebdc9564685af6218174791ff9654dcd7a0a6f942f0","observation_id":"9ebf11c5-a6ec-410e-beb3-a28f84522bc2","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":"InProceedings of the 2019 conference of the North American chapter of the association for computational linguistics: human language technologies, volume 1 (long and short papers)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:432d42f889684f57118e74e1395fdecad380c7eec35877a2e28370276e7e1541","observation_id":"e72948ca-01d3-4529-bcc2-6e2ab6d3ee31","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3793671just","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:24:04.110659Z","title":null,"venue":null,"work_id":"473ba778-5bb4-4947-a274-e76e5a9b4a4e","year":2026},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:2277fb88fe6b8dc6b6379db979619890fd1b0527f3d034872daec35416a570f7","observation_id":"5b763038-2346-479c-bcf5-7f56127b8027","resolution":{"observed_at":"2026-06-30T00:24:04.112219Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:48b179df76531f5f6cca39f9d75f867f93fda3195ef5330d305a07a339ff4e97","observation_id":"3c00376d-836e-43e0-a89a-2da81d0738e0","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.19779","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:24:04.299729Z","title":null,"venue":null,"work_id":"6ba4f547-8b45-460f-90fc-15ef3fd7092b","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:901cd61393d081f46d8313898f91b6e96ec4a7fcc95faf6e9753f8e89fe41fdc","observation_id":"8f2ddbe3-0015-494d-bf16-0364f96043f7","resolution":{"observed_at":"2026-06-30T00:24:04.301844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:eb96f11eb6adec08fe73ef788552e02fc88a56c791aad915cc6c87a0bac7e011","observation_id":"1bd14c69-963c-4323-b2c3-c9f896c2467d","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:181525208847c45ad23eb6b50567aa0a3b9c97134908111a5ca1d342ed62f3f9","observation_id":"b4dff80a-5045-4695-9803-330589c65a3c","resolution":{"observed_at":"2026-06-30T00:24:04.304505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-10T22:08:12.954417+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T22:08:12.954417+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":"Gonzalez, Hao Zhang, and Ion Sto- ica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:884cb2eaba6c2bd0daed13408af713e477647b8a65b95e09056db778f39569a2","observation_id":"eb2995de-325f-45f3-b18a-07a2515422ab","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:3b74f319a033f592883dcc68f034e039deecddb9a4001db6945b2d4955345458","observation_id":"b95ff778-bf2e-4d07-b832-be3acc553032","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:67abb156716a85b5b81dc620c3551dadb68c2678bd10b11c9b220b1ba3909cc5","observation_id":"631d82ee-4615-421b-be0a-f4d540f4aafd","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:1736b2ab7086c426242b973ed814a6fa6465442d650dc4ae5c00a5ec03c31016","observation_id":"b0d3801e-c114-4a72-bb07-dd16e8bf03ec","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:ecb2c49c6545eaf5088a891057ec9d8425f989fefb610fd71489d83f5dccae80","observation_id":"f3f5cdd4-194e-4a34-82a9-d7af81145b1d","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:162aeb03669d83351e2a793ecc7e83bca660bacc6cc3245958d0eb9263162223","observation_id":"1d876ecf-cbf5-465c-bea1-bee2ad3d0bdd","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12162","last_updated":"2025-05-17T07:09:10Z","snapshot_observed_at":"2026-08-10T17:24:35.572072Z","submitted_at":"2025-01-21T14:15:01Z","title":"AdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding","version":2},"cited_work":{"arxiv_id":"2501.12162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.12162","snapshot_observed_at":"2026-06-30T00:24:04.305830Z","title":"Adaserve: Accelerating multi-slo llm serving with slo-customized speculative decoding.arXiv preprint arXiv:2501.12162","venue":null,"work_id":"29bbd187-e529-40c4-bb30-608f5bee82b7","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2501.12162","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:856340b460a10b1f0d5754ec0e6702332ddc51fa883438089b2930b63e6cf61b","observation_id":"c93f4313-07d0-48b5-b1c2-56bc619e7ef3","resolution":{"observed_at":"2026-06-30T00:24:04.307474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:0cd49cf88e0cecce10feb488457403845adc58604106dfa647304fff7436d0c7","observation_id":"5598cc26-30e1-4676-871b-d674b5aa626d","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14066","last_updated":"2025-07-27T03:20:41Z","snapshot_observed_at":"2026-08-12T23:38:38.849903Z","submitted_at":"2024-06-20T07:43:33Z","title":"TurboSpec: Closed-loop Speculation Control System for Optimizing LLM Serving Goodput","version":3},"cited_work":{"arxiv_id":"2406.14066","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14066","snapshot_observed_at":"2026-07-04T18:50:04.405209Z","title":"Optimizing speculative decoding for serving large language models using goodput","venue":null,"work_id":"e771b74a-291f-485f-99a3-d0dd3867b0a3","year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2406.14066","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:73c0703ad2c14ca3b1dd54d258a606aced8cab149dd6b80676cd9c6df2928931","observation_id":"13cc6f7e-10ae-40a6-acfd-373658f642e4","resolution":{"observed_at":"2026-06-30T00:24:04.295698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:1bfd8083299a438d250c227281db12f6e240471dba8612c8ea4a724084a274ae","observation_id":"135573d2-0ef2-4e30-9e9a-44161a4574a5","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:94fba82ccd227b602012c0c982df8289456be57343b8b0f2cf4bf231c5491043","observation_id":"4e3838a2-383e-4eea-8ec4-8a47256b10e9","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:e84be0bd32c5cc3a55ed80a770da528fdeef37c9dc3ac198c03dd461302e3e34","observation_id":"af9c3d92-ea45-4d5b-9d8c-3e103c60a9dd","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":"2502.09992","doi":"10.48550/arxiv.2502.09992","metadata_source":"pith","pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Diffusion Models","venue":"cs.CL","work_id":"cce0f4b3-ed4d-4375-b84d-3f01316016c1","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:a27b76b809a625c7c29b3fa134fb110e6a13359d3b19062552d7ac81ed332bba","observation_id":"a7dfde7e-050c-43fd-8ae9-acb6d024c63d","resolution":{"observed_at":"2026-06-30T00:24:04.316288Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:780dad769260b80829adbc6a736fdebde8afbe599c16fc54f3664aa940cd8fa9","observation_id":"a621efd6-f6cb-4cd4-8b47-e47b7cb4c4fc","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":"1911.02150","doi":"10.48550/arxiv.1911.02150","metadata_source":"pith","pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","venue":"cs.NE","work_id":"160ea164-b1d4-4adb-8ccb-a4655d8a0bb4","year":2019},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:2a75170c6fa3f79273540132a7a0c9e48df2a231ed7a4c062928fd859d247740","observation_id":"e4cce775-e868-4c62-b6a9-4ba05f1421d9","resolution":{"observed_at":"2026-06-30T00:24:04.281813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:e5fb4bf3f32deca867ace31b9d294ad07e5c284ca043d7b122ad05f3dc2516a9","observation_id":"31ad72ee-06e9-4e1d-8794-796e93170dfe","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:8d3afa4eb9a2d69dc9b969694709b3b3d946cc53422091ffbd68ab755597df03","observation_id":"d0091a6d-1ba5-40f2-896f-769814b87017","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.17702","doi":"10.48550/arxiv.2507.17702","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2507.17702 , year=","venue":"ArXiv.org","work_id":"04d9997a-9305-4679-952c-33b52ad1e472","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:1952c8ad8aa12c180ba63a35619ebb98795c947c1756a96428f3feabca762f63","observation_id":"57042c41-43f9-4d28-995f-3070798f19b5","resolution":{"observed_at":"2026-06-30T00:24:04.284602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:6edcaf6ed27aead064da2e23062bad93aaf9e7c5bac540e9bd679623d9f363b7","observation_id":"88c4045a-0ba9-4b34-90ae-f31bd00b672f","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:a4779b9b480b76b0077d21c6a0ed85fe54d82b3986130dd814f0abfcd9a254c2","observation_id":"1cd2f24d-0969-4f2d-98ce-0fac41043812","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8765.14987","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:24:04.285693Z","title":"Roofline: an insightful visual performance model for multicore architectures.Commun","venue":null,"work_id":"a2eb074f-a1e0-4e3b-a64a-957a98213602","year":2009},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:76fb2e423f3dcf4301ace304659115affe9ade49e06bd868bb6a04c7851f78f0","observation_id":"be49a82d-9356-437a-b8c0-20f9b7e5245a","resolution":{"observed_at":"2026-06-30T00:24:04.288077Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:953a018fd95daf56fbd25b5730ad908a6229ecbd1c82d2d6ce3a51a4c73dd870","observation_id":"a9183bd1-5f6d-459d-a5b3-7b4a5ce1ffa0","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:67c755e2d267cbc30c7c97f318e4d8694c7b09fbb0024dc4c7523429f1b86c79","observation_id":"8e81e552-b6d9-436e-99d8-180855165a7d","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:c55df23c5c7c79c8018e0632799585455c8f9e7f4bbf1aaa80b5c6ed94ca847d","observation_id":"4e7a25a6-d957-4a7a-be33-daa5011c9fc4","resolution":{"observed_at":"2026-06-30T00:24:04.319396Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:7df4185a821581bca1a1ba5c779f2d3a2e483a413a099c410c446fa58a8752dc","observation_id":"e8f04527-5bcb-4656-b5f9-e1267164ac4f","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i9.26317","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Are Transformers Effective for Time Series Forecasting?","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"a543feff-80bc-42c9-91c4-7a95410ba01e","year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:0d4312dcad54172c9c20b490594852a170d8b33c757fe79b19f1f7374d28ee01","observation_id":"2a80afdc-97b8-43ac-bbe1-f6483141adc4","resolution":{"observed_at":"2026-06-30T00:24:04.110065Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T09:20:19.808265+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T09:20:19.808265+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:9a9eb172931e64be8a8cb6413acb97ccea76fca768c99fdfc43224c163f8591c","observation_id":"47a01f8b-29b0-4ae0-a5de-11363caf57d2","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:5400ec05860e8b5e030383d1976bbcac0bc5b208e832c2412e605229e8297335","observation_id":"e72f67bd-a913-4bc0-80a4-00ccfd0ef629","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:056d0bb0114b78495fd486b47813d324b1a627840e0b8548988ddf4ec144144e","observation_id":"7b096f40-6aae-4c5f-9bf9-7fb38787e5d4","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:9471bd45bbd222f547c8fe17c379aab2ef45688bdcf6bbd6c1f2f6a125d6a290","observation_id":"788ed5d4-aa67-4552-af63-844536b43ee9","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:8f7a46efe0c812fbaa853d752ba0e4014fcb0da97f0d5815aa766e061ea238be","observation_id":"108244b8-522e-4f95-b4f5-0f0edfffede3","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19223","last_updated":"2025-10-12T15:42:47Z","snapshot_observed_at":"2026-08-09T15:57:47.133628Z","submitted_at":"2025-05-25T16:36:20Z","title":"LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.19223","doi":"10.48550/arxiv.2505.19223","metadata_source":"pith","pith_arxiv_id":"2505.19223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models","venue":"cs.LG","work_id":"ebe72b3e-b18c-4784-8c3d-d7bfda67e098","year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"cited_paper":"/paper/2505.19223","citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:94400399839667c6c99a1f78da11a6b2a98c353a1c1550289cfecfe3f56ee15d","observation_id":"88cd79ac-18d0-472a-8510-5457e8bed580","resolution":{"observed_at":"2026-06-30T00:24:04.298449Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:15:58.082725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-30T00:15:58.082725Z"},"links":{"citing_paper":"/paper/2605.24832"},"observation_digest":"sha256:c260e61216d32adae01917dc258691fe65bc56710b02f369d9eb3266565c7d79","observation_id":"188aff1a-d816-421e-aa33-e51286416fe3","resolution":{"observed_at":"2026-06-30T00:15:58.082725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.24832","last_updated":"2026-05-24T02:56:46Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-12T16:38:54.192937Z","submitted_at":"2026-05-24T02:56:46Z","title":"Optimus: Elastic Decoding for Efficient Diffusion LLM Serving"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":41,"verified_exact":13,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 1 inbound Pith citation observation for arXiv:2605.24832."}