{"as_of":"2026-08-07T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:66915b9e0e013f635bb78aa134745ddddd529dd5cebe4ea1d25f36df147c63d6","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:36:19.912415Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04974/citation-record","integrity":"/paper/2608.04974/integrity","json":"/paper/2608.04974/citation-record.json","paper":"/paper/2608.04974"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-06T12:36:18.022804Z","title":"LaMDA: Language models for dialog applications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.022804Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:1f875066815735496f12712e0d236f631b30f42cdfa6e44b71c09549f3e449e1","observation_id":"4abca992-c557-4037-94e4-b5ecdc3210d0","resolution":{"observed_at":"2026-08-06T12:36:18.022804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T12:36:18.075148Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.075148Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:65d94dda9840239856417782611bb5836676d1c4385253461a5058e3b789cc5d","observation_id":"76ac4c14-d05a-4d7f-bb88-ce28039d7af2","resolution":{"observed_at":"2026-08-06T12:36:18.075148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.287084Z","title":"Language models are few-shot learners,","venue":null,"work_id":"453d88ea-09bc-4486-9c28-eee45a461b06","year":2020},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.164701Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:2b9defde184eee7c338b9ac6faf7d1092877bc4568ceaf797a14b9414d543656","observation_id":"094b3ea1-7b1b-4432-a548-3d7ea802b001","resolution":{"observed_at":"2026-08-06T12:36:21.294524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.228799Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.228799Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:448ae64fab124137cdffb38e2a16e82f7d414c7bee6b7980fc9667257de8f4d6","observation_id":"d7f61f67-4ba0-498d-8a37-7b91d43461cf","resolution":{"observed_at":"2026-08-06T12:36:18.228799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.256634Z","title":"ReAct: Synergizing reasoning and acting in language models,","venue":null,"work_id":"f6d4cc7f-9a66-426e-9923-26a9efaab9ff","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.287856Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:a3a2eada4aa57336c73b8d333b0a4e9b06c5b9acdccd0d31347bbd344b774145","observation_id":"b2868cd6-26e6-4e27-a8a1-c19c908c59c3","resolution":{"observed_at":"2026-08-06T12:36:21.261964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.238239Z","title":"Fast inference from transform- ers via speculative decoding,","venue":null,"work_id":"e722f020-3cce-4dea-b4a1-2740cc019a90","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.431450Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:329c381148f567cd57f9784518e1b1c6941027ffa304c27a5e4ac54f457fdfd4","observation_id":"c5bd3f09-50e3-46a1-a499-9cdb7cbdb9c8","resolution":{"observed_at":"2026-08-06T12:36:21.243578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-06T12:36:18.473974Z","title":"Accelerating large language model decoding with speculative sampling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.473974Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:cbf9786c0e55dc54f86180048a13cfb4839a4c0d290df73cfa17a297d35d26f0","observation_id":"0bed100a-8ffb-4e10-af62-61455f33b500","resolution":{"observed_at":"2026-08-06T12:36:18.473974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12000","last_updated":"2025-07-17T02:34:42Z","snapshot_observed_at":"2026-08-06T16:53:52.190719Z","submitted_at":"2025-07-16T07:55:06Z","title":"DSSD: Efficient Edge-Device LLM Deployment and Collaborative Inference via Distributed Split Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12000","snapshot_observed_at":"2026-08-06T12:36:18.592235Z","title":"DSSD: Efficient edge-device LLM deployment and collaborative inference via distributed split speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.592235Z"},"links":{"cited_paper":"/paper/2507.12000","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:4b74de92b4e7ef5ab47bacee2247079f85ccd9d3e5a00100f9ba44b9cf89ebeb","observation_id":"3882188b-0fda-4c61-a2bf-692a96cbc249","resolution":{"observed_at":"2026-08-06T12:36:18.592235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.613009Z","title":"SpecEdge: Scalable edge-assisted serving framework for interactive LLMs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.613009Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:91a4cc80ff791442dc0889cabcdeb7daf1075ee03a9a338c415ec2674de16732","observation_id":"e3dc7e1e-40e9-428c-adff-7f5eae568e78","resolution":{"observed_at":"2026-08-06T12:36:18.613009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13319","last_updated":"2026-05-25T08:06:41Z","snapshot_observed_at":"2026-08-01T18:09:53.303276Z","submitted_at":"2026-05-13T10:34:04Z","title":"PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.13319","snapshot_observed_at":"2026-08-06T12:36:18.698765Z","title":"PipeSD: An efficient cloud-edge collaborative pipeline inference frame- work with speculative decoding,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.698765Z"},"links":{"cited_paper":"/paper/2605.13319","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:b213d8f0b5565f36866abeaed7e27a1e63c43af3feb75ac6d49d6b21d3f6b3fe","observation_id":"29417c33-f66f-4647-b731-c3b27e2231dd","resolution":{"observed_at":"2026-08-06T12:36:18.698765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.764588Z","title":"Communication-efficient collaborative LLM inference via distributed speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.764588Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:949a3a2006f7df6a7dded4f2c3ae7b210d4c3724f160245bf78e2443b0496dc8","observation_id":"70c9434f-3656-4483-9444-3e717a135414","resolution":{"observed_at":"2026-08-06T12:36:18.764588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.820864Z","title":"Fast collaborative inference via distributed speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.820864Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:37efb017a729ff7d1809009e6b25226b45ce4ade3e3adda6530611c0dd958ac1","observation_id":"e6f0231c-6d03-4eae-af2c-576218c9eb37","resolution":{"observed_at":"2026-08-06T12:36:18.820864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.25091","last_updated":"2026-06-23T18:55:18Z","snapshot_observed_at":"2026-08-06T04:30:21.060187Z","submitted_at":"2026-06-23T18:55:18Z","title":"Speculation at a Distance: Where Edge-Cloud Speculative Decoding Actually Pays Off","version":1},"cited_work":{"arxiv_id":"2606.25091","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.25091","snapshot_observed_at":"2026-08-06T12:36:20.689783Z","title":"Speculation at a Distance: Where Edge-Cloud Speculative Decoding Actually Pays Off","venue":"cs.DC","work_id":"c6b7469a-9909-4b5e-b3f6-0d54f0a244f2","year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.928319Z"},"links":{"cited_paper":"/paper/2606.25091","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:7fea186e0fdcb19fce6c2fb6c282844b63b18c696103c795ecd37c4d4d3e1111","observation_id":"7d36d676-f2bc-4dd7-83b7-49ab960c675c","resolution":{"observed_at":"2026-08-06T12:36:20.698329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04255","last_updated":"2023-09-08T10:44:19Z","snapshot_observed_at":"2026-07-06T16:16:07.182657Z","submitted_at":"2023-09-08T10:44:19Z","title":"LLMCad: Fast and Scalable On-device Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04255","snapshot_observed_at":"2026-08-06T12:36:18.965771Z","title":"LLMCad: Fast and scalable on-device large language model inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.965771Z"},"links":{"cited_paper":"/paper/2309.04255","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:00bba6a7fd72a1c2e045196d312024aa5a375e5a463078beab84ac52276bb380","observation_id":"7803a98a-0f7d-4895-b61c-0ebdf468abeb","resolution":{"observed_at":"2026-08-06T12:36:18.965771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.220542Z","title":"PipeInfer: Accelerating LLM inference using asynchronous pipelined speculation,","venue":null,"work_id":"b2c8c625-f310-48b4-bcc0-0c9c2aaf4ac6","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.041819Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:0b8d5b78553b2ba5804c21d665a054a3cd0085caf66a5bc1ecaa61462b7cae4d","observation_id":"4756b5c1-76b0-41f7-9c6b-5df33728aad3","resolution":{"observed_at":"2026-08-06T12:36:21.225678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17375","last_updated":"2024-10-22T19:15:35Z","snapshot_observed_at":"2026-07-06T19:38:04.948333Z","submitted_at":"2024-10-22T19:15:35Z","title":"AMUSD: Asynchronous Multi-Device Speculative Decoding for LLM Acceleration","version":1},"cited_work":{"arxiv_id":"2410.17375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17375","snapshot_observed_at":"2026-08-06T12:36:20.649879Z","title":"AMUSD: Asynchronous Multi-Device Speculative Decoding for LLM Acceleration","venue":"cs.CL","work_id":"7e6cbce8-9e34-4f93-a35d-a313b4cdb975","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.122331Z"},"links":{"cited_paper":"/paper/2410.17375","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:4f74c7224e3942800e19075292a00ea7aedeeac9d55d859d065604dc1fc73675","observation_id":"5317e4c7-af90-4f9f-9723-cb26b2763491","resolution":{"observed_at":"2026-08-06T12:36:20.655192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11850","last_updated":"2025-02-17T03:33:50Z","snapshot_observed_at":"2026-07-06T19:04:13.760549Z","submitted_at":"2024-08-13T08:32:06Z","title":"PEARL: Parallel Speculative Decoding with Adaptive Draft Length","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11850","snapshot_observed_at":"2026-08-06T12:36:19.142900Z","title":"PEARL: Parallel speculative decoding with adaptive draft length,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.142900Z"},"links":{"cited_paper":"/paper/2408.11850","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:053b99416d438826a9cb60574d3c42c4b4b48f8c9c22d377cbec0777b8de6526","observation_id":"0f91947f-9f3b-4704-a4f2-5c78a3cfc602","resolution":{"observed_at":"2026-08-06T12:36:19.142900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.204877Z","title":"CoSine: Enhancing LLM serving via collaborative and decoupled speculative inference,","venue":null,"work_id":"f21beb7d-d7ed-469b-bb9d-d199d811ed33","year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.213196Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:f0afa2e8b0100c4efa375d43a765c904d3a6617b5fae0ab27ffa9d004fb4f2d4","observation_id":"97ffcbad-81ac-4327-afd6-dfd0eaf6e471","resolution":{"observed_at":"2026-08-06T12:36:21.209820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11652","last_updated":"2026-04-07T01:02:52Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-15T16:46:01Z","title":"WISP: Waste- and Interference-Suppressed Distributed Speculative LLM Serving at the Edge via Dynamic Drafting and SLO-Aware Batching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11652","snapshot_observed_at":"2026-08-06T12:36:19.307246Z","title":"WISP: Waste- and interference-suppressed distributed speculative LLM serving at the edge via dynamic drafting and SLO-aware batching,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.307246Z"},"links":{"cited_paper":"/paper/2601.11652","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:42fdfdc59f6af6f6f1c3d2ba0540e10b452724f0bedcef99589c804ea93feb67","observation_id":"2e4dcc7b-a326-494b-b78b-a271e1f1eb7d","resolution":{"observed_at":"2026-08-06T12:36:19.307246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.190485Z","title":"Efficient memory management for large language model serving with PagedAttention,","venue":null,"work_id":"35f0616e-6f06-4ffe-8f81-49d075d6a04f","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.367716Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:ea101a5bf85107da96046b42f0fbb0231461466061d21505e994cef2ac947c07","observation_id":"02334612-7cf9-4ad2-8318-e08e5c5458c2","resolution":{"observed_at":"2026-08-06T12:36:21.195343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.173212Z","title":"DistServe: Disaggregating prefill and decoding for goodput-optimized large language model serving,","venue":null,"work_id":"09ad9b73-71f1-475c-acaf-110f8f6ff9d2","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.486929Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:9d0fea52f89b634f19ccd35236d11b213304b06b91c157bc15b31eb8d89f2b5e","observation_id":"ec503571-a30b-443f-90ca-cea55c7dfc5b","resolution":{"observed_at":"2026-08-06T12:36:21.177676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.155491Z","title":"Hintjens,ZeroMQ: Messaging for Many Applications","venue":null,"work_id":"ac6a3923-58a6-4554-b139-2bbdf27ec9b3","year":2013},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.583413Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:41a9e8c1b1bfe1ac99b054e8117d6f83f490ce02c4d559c232dfc7ea016555aa","observation_id":"d69efdaf-1f98-4cea-9110-35ed0e022303","resolution":{"observed_at":"2026-08-06T12:36:21.160747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T12:36:19.653286Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.653286Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:1612e161b2a56617846ae650a36a424ec2b495f3f6967fa00d323b4375a3bf3a","observation_id":"5283f376-d789-4feb-9e0d-1503c5616673","resolution":{"observed_at":"2026-08-06T12:36:19.653286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-06T12:36:19.780905Z","title":"ChatGLM: A family of large language models from GLM- 130B to GLM-4 All Tools,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.780905Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:235723c0da01aed575bdbeec172afa6df096eb286b8966a7feb0cf58567106a9","observation_id":"cf1d515f-886d-4201-9050-fa36e1c54c1f","resolution":{"observed_at":"2026-08-06T12:36:19.780905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.137638Z","title":"GLM-4-0414 model series,","venue":null,"work_id":"185f52a3-bb56-4589-853d-2b0f5c4c19ee","year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.835335Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:5e0b752858ebe0a245192b737239ab0168ccebe6a25d2f4bf916f3d651f1bf84","observation_id":"ae5f4fff-3cf4-4b06-a654-810235f69f6a","resolution":{"observed_at":"2026-08-06T12:36:21.143920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T12:36:19.863122Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.863122Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:05943132672a941727e48011800536ca6132f180d03e9894e2503e86652cb98e","observation_id":"24e9ffe7-09bb-4376-b798-19fa828f2a4a","resolution":{"observed_at":"2026-08-06T12:36:19.863122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T12:36:19.867867Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.867867Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:204ed10549c6cbe2341bdee343219d2ccb88308e12b7cc6cfb2cd6f8a6ee6a57","observation_id":"024c70b3-fe2b-4f9c-b370-93dd627a7ef3","resolution":{"observed_at":"2026-08-06T12:36:19.867867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.120820Z","title":"Network emulation with NetEm,","venue":null,"work_id":"93051d7a-0026-46f1-8470-be642ba0b8ed","year":2005},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.873469Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:0ced69a9e177cc3e62066c337130e4c9a5e0836c7d986cad0a2ba4377cb07857","observation_id":"23ba4cc5-d4bb-4acd-853a-fdcae6da06db","resolution":{"observed_at":"2026-08-06T12:36:21.125916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7514.34058","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:20.506507Z","title":"Understanding operational 5G: A first measurement study on its coverage, performance and energy consumption,","venue":null,"work_id":"5ac81640-d85b-453d-843e-99f613592021","year":2020},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.877613Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:3289c4c61aaaba7ab0b0ac6a315084542d49ee51abf54d72a463ac136ed2636d","observation_id":"79db0f21-fc59-4108-a3c3-a494a5fc772f","resolution":{"observed_at":"2026-08-06T12:36:20.517187Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.103214Z","title":"AccuMO: Accuracy- centric multitask offloading in edge-assisted mobile augmented reality,","venue":null,"work_id":"a1bfd080-e69f-4c72-b989-34d1d961bf9d","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.881894Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:aa1433b91ba86eb8b06a2e26d78f9410825454c94c9e7a195a9d751485dce4e8","observation_id":"0eaae0b7-6455-49db-ab51-ad99b27070dc","resolution":{"observed_at":"2026-08-06T12:36:21.108775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:19.886247Z","title":"A variegated look at 5G in the wild: Performance, power, and QoE implications,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.886247Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:44526af50835df5c6b9b5b0f43ce05d02069b74ca7818cb7b3df46c7019d2eb3","observation_id":"56922e96-a8a1-42f6-8f67-5b41aa1e31c4","resolution":{"observed_at":"2026-08-06T12:36:19.886247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.081706Z","title":"SpecInfer: Accelerating large language model serving with tree-based speculative inference and verification,","venue":null,"work_id":"e49db424-d1c5-4875-9b51-8b5291663a86","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.890404Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:0e19e025cae60abe5e32c5fd375bef3f86df83013cd1be030e3524807fb1e23f","observation_id":"43331e2d-b63c-4062-8ec1-3e4dadd27321","resolution":{"observed_at":"2026-08-06T12:36:21.087597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.055719Z","title":"Medusa: Simple LLM inference acceleration framework with multiple decoding heads,","venue":null,"work_id":"ec012342-3eef-4ec9-b28a-494d3144846e","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.894655Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:3b0ed50d1ed65399086e93a484ac8f9e7ebc68d3b34a8e99f90e3f92f47f51be","observation_id":"ed46086d-f049-4d37-bdd6-73f221525c1c","resolution":{"observed_at":"2026-08-06T12:36:21.064875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-05T17:05:32.124567Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T12:36:19.898830Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.898830Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:1f2efed8bd04ab28b35c13882003afe620b822e526b281e98f8e609ccfed687d","observation_id":"efa1ef77-0fb2-48ac-89d2-8614997cad04","resolution":{"observed_at":"2026-08-06T12:36:19.898830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:19.903391Z","title":"Conformal sparsification for bandwidth-efficient edge-cloud speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.903391Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:c223d736b01cf6c9741b96ccfddc1baaf668c90e1fd60e61eeff8b724e7727f1","observation_id":"7c7deeb8-c10c-492d-a554-e08f6192cd1e","resolution":{"observed_at":"2026-08-06T12:36:19.903391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:19.907751Z","title":"Quantize- sample-and-verify: LLM acceleration via adaptive edge-cloud speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.907751Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:dbea5e58571f63d0c2b608adafcd8d729ba2d5db64365068ccad07b26df566bd","observation_id":"a6e9a913-8c70-49fa-bc55-83f5984496bf","resolution":{"observed_at":"2026-08-06T12:36:19.907751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.039472Z","title":"Taming throughput-latency tradeoff in LLM inference with Sarathi-Serve,","venue":null,"work_id":"80536e16-1418-4b97-8671-f6857f21c8d1","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.912415Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:9cea68a242da814969874d6bfffb31509aa7df4a8046dc7570e747f7c1662216","observation_id":"4253d224-9c9d-4097-b566-1200d8643893","resolution":{"observed_at":"2026-08-06T12:36:21.044466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T21:19:21.432415Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2608.04974."}