{"as_of":"2026-08-08T08:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7134ac087295a8af67d8eec4c8ec54833a41d10633a19e0f126b47b3dec2fba6","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T15:02:37.625143Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.24434/citation-record","integrity":"/paper/2607.24434/integrity","json":"/paper/2607.24434/citation-record.json","paper":"/paper/2607.24434"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.484533Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.484533Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:dcb3ff041f8acd8fe285e157564b497f2c78be992c9b5b153e274766b4ae5e3d","observation_id":"64e02062-c017-4278-a803-7774256413d2","resolution":{"observed_at":"2026-07-31T15:02:37.484533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.488153Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.488153Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:42cd5237c5037f6079e8df33a10cdbd8e7b1faddff289bb16bd5217f450577a2","observation_id":"5af82585-14cc-4b83-8cc1-5a886b090844","resolution":{"observed_at":"2026-07-31T15:02:37.488153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.492875Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.492875Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:c84aee56b423d00693a330d8dc0aca5b1b85f2c0a432b98edeaf76c955c8c3d0","observation_id":"1ef27a9f-53db-42ea-9015-c0ecc8b7d72b","resolution":{"observed_at":"2026-07-31T15:02:37.492875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.496151Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.496151Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:b9cc6b35002fd0d37c547b3002e986309f4506d6fa10b4faebbf493a2c2b2482","observation_id":"55bb3ab5-1842-4fc7-91b1-bc98c3adb3f7","resolution":{"observed_at":"2026-07-31T15:02:37.496151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.499668Z","title":"2602.16052 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.499668Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:d62a1eb88da5d65ec146286b68b05b1e2a6149f9427ead6a3b637fbdea8c2667","observation_id":"4713f8ed-ba82-4d11-9165-fa1064939df5","resolution":{"observed_at":"2026-07-31T15:02:37.499668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.502804Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.502804Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:1a4b67c9a6b530278596569ced829a25ec6dd392836195722ecc09dae0cc844a","observation_id":"9418cc9c-14ae-4f62-8abf-2f048f45237c","resolution":{"observed_at":"2026-07-31T15:02:37.502804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.505734Z","title":"Self-Speculative Decoding for On-device","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.505734Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:9a8e653a55de66df95def80ac1f1aa4a64cce872a8232cc80a7818a048b336b9","observation_id":"495f944d-0d64-44c2-8e02-241e8dddc110","resolution":{"observed_at":"2026-07-31T15:02:37.505734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10152","last_updated":"2026-04-11T10:52:17Z","snapshot_observed_at":"2026-08-06T10:02:07.653631Z","submitted_at":"2026-04-11T10:52:17Z","title":"SpecMoE: A Fast and Efficient Mixture-of-Experts Inference via Self-Assisted Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.10152","snapshot_observed_at":"2026-07-31T15:02:37.509164Z","title":"2604.10152 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.509164Z"},"links":{"cited_paper":"/paper/2604.10152","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:5777ec57011a3b4047cc7ac7b6e5eac64a11c7cd153393a4c000f85545e983ed","observation_id":"49d73e67-0429-40a3-8a4e-9807b34d1f08","resolution":{"observed_at":"2026-07-31T15:02:37.509164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.512797Z","title":"2505.19645 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.512797Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:75856023b0b0336e632115abd04e49bc65944797ce67c9dc37b25a10ca66cd97","observation_id":"b6607f2c-a043-46f2-b4de-129e246b4b71","resolution":{"observed_at":"2026-07-31T15:02:37.512797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.515708Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.515708Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:dd5f642e10514f6906050b2797c052795a6b35f447d3283246f856b8cbb432b2","observation_id":"d43b341f-619b-4357-9565-ffdfce6a3f37","resolution":{"observed_at":"2026-07-31T15:02:37.515708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.518889Z","title":"2510.10302 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.518889Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:bf51bbea6f78035586fa5b1f027dab3d9c6b0dca236ffcbcaeb29bc243881796","observation_id":"0b69a6c9-ad89-49e3-aea5-450f226771a6","resolution":{"observed_at":"2026-07-31T15:02:37.518889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.521920Z","title":"2511.14102 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.521920Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:0f0f78b885fc99460be22b09a29ba7c4c9b9b52885cd1c9001e162dcdabc225d","observation_id":"c6194f41-cda9-4710-b57a-26f9a69f47a4","resolution":{"observed_at":"2026-07-31T15:02:37.521920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.525169Z","title":"2603.09983 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.525169Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:66afb95d6450ea81dafb5f6312c81a4c452e721d4189ff61fea14cd9094e1f19","observation_id":"e207c930-7770-42e3-8c81-40082e424f79","resolution":{"observed_at":"2026-07-31T15:02:37.525169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-06T16:46:01.183837Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06282","snapshot_observed_at":"2026-07-31T15:02:37.528129Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.528129Z"},"links":{"cited_paper":"/paper/2502.06282","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:577c9a10e0e60f365964e27a579158ae96564db5c76d2f0225dd2d331487ddd0","observation_id":"68fa8e58-4876-40ce-9b54-5dfa87a0838b","resolution":{"observed_at":"2026-07-31T15:02:37.528129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.532084Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.532084Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:ee20a9b4f348b916a4bf154ec948018478f6d7fcc4fe0ac60fbc4add17fda249","observation_id":"c156d3c7-517f-42d6-8728-dca1395035dc","resolution":{"observed_at":"2026-07-31T15:02:37.532084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.535805Z","title":"Semantic Parallelism: Redefining Efficient","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.535805Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:514f2e2834c52768689eb5b10edf74c05532940cb82e543762493a687adcdbed","observation_id":"11e73928-fa4b-49cc-a81c-08ffc7842855","resolution":{"observed_at":"2026-07-31T15:02:37.535805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.538944Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.538944Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:e122dd7dfd5a6a70e287c3482ba2834cadf5eb11758e7f9c3ec68fa4286873d0","observation_id":"960c2825-75ae-4754-bbf1-c57e11b65784","resolution":{"observed_at":"2026-07-31T15:02:37.538944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.541731Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.541731Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:8e75b4d92be9cf959f91be164630b3a99236931022c5999489a282ecb0219516","observation_id":"7e603a26-070c-462a-892b-4522a2cb8d01","resolution":{"observed_at":"2026-07-31T15:02:37.541731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.544751Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.544751Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:53ef2108e9b475cf0799b800a8b367a24d747ad0bf0ff0369c10813a95d06474","observation_id":"bc16800e-1ccb-4fde-a0b1-f57cd4e4a4ba","resolution":{"observed_at":"2026-07-31T15:02:37.544751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.547776Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.547776Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:9ca22bca6ff4a442816a1cd614497301f6b76d41cf11cc408b20e2210a4e6ebe","observation_id":"9193836f-2bf7-4d6d-8319-8913b5d405e9","resolution":{"observed_at":"2026-07-31T15:02:37.547776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-07-31T15:02:37.550752Z","title":"Muon is Scalable for","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.550752Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:133d84ba341ab5a289104c9f73b693a984d3af8c2f755f953d3860b92e876a0f","observation_id":"06ab9746-9193-4bb6-8cf0-570b03a62a8a","resolution":{"observed_at":"2026-07-31T15:02:37.550752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.554220Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.554220Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:2aa8ccc532df51af210fe5cd7ab4e69555fa8967699f4d11c226cdd1f42b0f2e","observation_id":"c44fb7af-a7e3-41d4-8610-8c1ffe425808","resolution":{"observed_at":"2026-07-31T15:02:37.554220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.557210Z","title":"Lee and Deming Chen and Tri Dao , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.557210Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:5640b3c5cb8726bc34a2af8391bc2650823acd508ff4b9dfb2146c70e40e251a","observation_id":"1e896fde-2a38-41d0-bd5c-095c8fc72161","resolution":{"observed_at":"2026-07-31T15:02:37.557210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-07-31T15:02:37.560701Z","title":"2401.15077 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.560701Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:278076477dbfdb5b30f1d11302156d8e6303935a29b266ea588ef3266a36421b","observation_id":"996de623-8121-40b9-bb3c-fafec6129085","resolution":{"observed_at":"2026-07-31T15:02:37.560701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.563989Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.563989Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:1b415077d9edefffff57023c9f9ee9ccbd6c734f981c14f2d969c506f7d7dea6","observation_id":"e0fb9917-41d5-480a-a52c-66cb2ddf4153","resolution":{"observed_at":"2026-07-31T15:02:37.563989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.566907Z","title":"Aly and Beidi Chen and Carole-Jean Wu , booktitle=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.566907Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:d6e5cae31af1baa39ce506f00e9eea1a831dda0cbe8e3cf5c379cc4cea34824e","observation_id":"0e2084cf-3293-45a7-97ca-fc92a5e07c23","resolution":{"observed_at":"2026-07-31T15:02:37.566907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14361","last_updated":"2025-03-12T18:14:21Z","snapshot_observed_at":"2026-08-03T09:09:47.667294Z","submitted_at":"2024-01-25T18:07:50Z","title":"MoE-Infinity: Efficient MoE Inference on Personal Machines with Sparsity-Aware Expert Cache","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14361","snapshot_observed_at":"2026-07-31T15:02:37.574777Z","title":"2401.14361 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.574777Z"},"links":{"cited_paper":"/paper/2401.14361","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:2a3846a2864b9b115b2e0c3601b43c3208fa16feb4ca581dc325cb2566503d95","observation_id":"43ad2203-067a-49c0-a69e-efe1f2f3fcfc","resolution":{"observed_at":"2026-07-31T15:02:37.574777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14352","last_updated":"2025-03-07T11:16:40Z","snapshot_observed_at":"2026-07-06T16:11:06.578398Z","submitted_at":"2023-08-28T06:56:08Z","title":"EdgeMoE: Empowering Sparse Large Language Models on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14352","snapshot_observed_at":"2026-07-31T15:02:37.590572Z","title":"2308.14352 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.590572Z"},"links":{"cited_paper":"/paper/2308.14352","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:66f3dfcc73fde3519084a4dd0c867f4da1ceee9ae24ded6d8e0272743b6c6d7d","observation_id":"e2b4e76c-62a7-4897-8fb0-bee4e0ae9eed","resolution":{"observed_at":"2026-07-31T15:02:37.590572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.603714Z","title":"Fiddler:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.603714Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:871fa521d622408b57f81a34b1503efe41c8976283a579211b72ad5f30ca564d","observation_id":"820962ca-f13a-4935-82dd-fd0c15f860c5","resolution":{"observed_at":"2026-07-31T15:02:37.603714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.614730Z","title":"llama.cpp:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.614730Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:7cadac3a07d80663bb1abf44ad3f1d62d752d9358addd25820293be77cfb128c","observation_id":"0bdd0961-faee-4a84-8de9-560c047f893d","resolution":{"observed_at":"2026-07-31T15:02:37.614730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:02:37.625143Z","title":"NIPS Deep Learning and Representation Learning Workshop , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.625143Z"},"links":{"citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:d0b5da1ba7795e9ecee246d1d734e998ddecf33ee49fcf52cf02cf1dac58c383","observation_id":"d9a80390-b09d-411a-80bc-436ca061c25e","resolution":{"observed_at":"2026-07-31T15:02:37.625143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2607.24434."}