{"as_of":"2026-08-06T20:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0cc571e49a483d45de1d5b427b50a73947f2a3f8dbf27a1c91c4d2a6421e5622","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T02:28:04.851282Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27735/citation-record","integrity":"/paper/2607.27735/integrity","json":"/paper/2607.27735/citation-record.json","paper":"/paper/2607.27735"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.685796Z","title":"Communication, Simulation, and Intelligent Agents: Implications of Personal Intelligent Machines for Medical Education","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.685796Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:0912162b00f584945345b1d3a3f7f0c14039795ddadda8c33d78df5c5f317fa6","observation_id":"b78001bd-079e-4453-a279-eb51dabebb7d","resolution":{"observed_at":"2026-08-01T02:28:04.685796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.690685Z","title":"Classification Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.690685Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:4f8f50bd006e745a3270f8777990649e2f23cef3f9eccb14b9f4556fd2a3413f","observation_id":"a5249efb-0a1d-438c-a971-5e9d4f56aa5c","resolution":{"observed_at":"2026-08-01T02:28:04.690685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.693874Z","title":", title =","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.693874Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:d74ca9b60f14fb4db8210faef212c7252a2a0ad7e05823f25f0788b3e5e4b3c7","observation_id":"3950e816-c7f8-4fed-99ee-dc506280ef8a","resolution":{"observed_at":"2026-08-01T02:28:04.693874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.696750Z","title":"New Ways to Make Microcircuits Smaller---Duplicate Entry","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.696750Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:47b823ec316e3da4725406c03f8b27ec7281689e848d1204b756dd18c08156bc","observation_id":"8ee90744-8d65-4dbd-9560-ccc9954c74df","resolution":{"observed_at":"2026-08-01T02:28:04.696750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.699800Z","title":"Clancey and Glenn Rennels , abstract =","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.699800Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:fb0f0525c80289426af6ff8eea80e99f56599909927e863034211754180d4161","observation_id":"9b6cee3e-e2d5-4467-b253-beded9e48d1d","resolution":{"observed_at":"2026-08-01T02:28:04.699800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.703165Z","title":"and Rennels, Glenn R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.703165Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:ebf87f3121a0a3b478d449c17a6f91d37bed60f1bcc14fdbb50e9441ebcc531e","observation_id":"5fdb6238-b6d3-42b6-ac6e-65afab9fe0ba","resolution":{"observed_at":"2026-08-01T02:28:04.703165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.706316Z","title":"Poligon: A System for Parallel Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.706316Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:5e6504a50a00ed4d7ab9aeff71442b164286b5803b53cbbf9a26bef24de31b2e","observation_id":"ee80a098-5fdc-454e-b18c-1b55c9cdf08f","resolution":{"observed_at":"2026-08-01T02:28:04.706316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.709251Z","title":"Transfer of Rule-Based Expertise through a Tutorial Dialogue","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.709251Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:a1e67aea5b2e7a39b83d79d17048a6b3e40a5ecf3b49808223aed6914f2cabbe","observation_id":"5ace8db4-d389-48de-96ca-11f93128e46d","resolution":{"observed_at":"2026-08-01T02:28:04.709251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.712600Z","title":"The Engineering of Qualitative Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.712600Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:74afd12705098a736a77ae4c790e18a687c6a6b6f3234520a80dd450b8991be2","observation_id":"d962f515-521a-4d50-8ee9-ccabadf057fd","resolution":{"observed_at":"2026-08-01T02:28:04.712600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.715367Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.715367Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:a83a18e5eb3361878f039dbbd5f082dd5bab8c84ef03df26a8096aef4217d264","observation_id":"e8927db2-45a2-46ca-acf2-ec7208ed61e3","resolution":{"observed_at":"2026-08-01T02:28:04.715367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.718224Z","title":"Pluto: The 'Other' Red Planet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.718224Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:fc42a6a5909bc12c10f899b95163e5af9aeaae761c5d842beb98039a7a328184","observation_id":"857768a7-5095-4343-90a6-febcfd26f0cd","resolution":{"observed_at":"2026-08-01T02:28:04.718224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-01T02:28:04.720989Z","title":"arXiv preprint arXiv:2601.03267 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.720989Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:f1484e9d2ef7cde925f17d6fad29e9986929da9a31089f9184c37dc64cf22ddc","observation_id":"34dcf76b-da2c-4530-8be9-4a7a4f09813b","resolution":{"observed_at":"2026-08-01T02:28:04.720989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.724133Z","title":"arXiv preprint arXiv:2601.11659 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.724133Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:726cdad6ad2b3b81388af2365eaa61b4d0e03ff39e2a7395ef82cdd64c244b6c","observation_id":"4b3548c2-06b9-46ea-9d58-99149f477545","resolution":{"observed_at":"2026-08-01T02:28:04.724133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.726858Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.726858Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:45dd3463e2afa87a075ee7ff164922a0af8c2417eea26518e00f9227fd2b68ef","observation_id":"2fdef4bb-ad22-44df-abfe-383407aafd8a","resolution":{"observed_at":"2026-08-01T02:28:04.726858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.729841Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.729841Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:7771a80879088e289506f78dd0db108484cc9430b65ea80bdea1b704b912cf7e","observation_id":"f095b3c9-a935-4a28-8283-51f049bc1536","resolution":{"observed_at":"2026-08-01T02:28:04.729841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-01T02:28:04.732407Z","title":"arXiv preprint arXiv:1911.02150 , year=","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.732407Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:3ede8f1fd8f584f34f10438d2c39209f53c53c67f84ebb7ad5c57c309707e7e2","observation_id":"d29ef71c-a039-4495-97ed-11aa9025a937","resolution":{"observed_at":"2026-08-01T02:28:04.732407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.735907Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.735907Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:f7a3b83bcb884c56c24f626dfb8117ab27c63d11fded8171a57715e3913be611","observation_id":"5df6728f-23cf-4202-af4e-6ab08bfc3134","resolution":{"observed_at":"2026-08-01T02:28:04.735907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-01T02:28:04.738593Z","title":"arXiv preprint arXiv:2302.01318 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.738593Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:b46b5d0bab1c53c23da9296a94bc1032b4a75c4a8516057f289844096490f626","observation_id":"01beb76c-3809-4cff-9bf5-43da98132362","resolution":{"observed_at":"2026-08-01T02:28:04.738593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.741803Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.741803Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:52af72fce7a097359179202199d6298fd7e9fe9a857c5dc328c7d07f86d43ba4","observation_id":"847a6e12-d6e8-4c29-acbe-1a5ac423ab69","resolution":{"observed_at":"2026-08-01T02:28:04.741803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.744653Z","title":"Proceedings of the 29th ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Volume 3 , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.744653Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:219ec28b366c23531499cb1b3efab4cfaf663a4b1ab53f50f17d339f5f3e9004","observation_id":"9221c421-821a-4065-91aa-4c81f4ae347a","resolution":{"observed_at":"2026-08-01T02:28:04.744653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.747331Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.747331Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:069792500fe8c80d71be7d1f75f222202bcfb50b0d8acc96d1d22ab72601233a","observation_id":"e71874ae-f797-46f6-b80d-4b82e329605a","resolution":{"observed_at":"2026-08-01T02:28:04.747331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-01T02:28:04.750071Z","title":"arXiv preprint arXiv:2406.10774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.750071Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:5ff1a5f513d46420da1ce86b316f0e75d670f333eaa0b788fdd2937465c23a0e","observation_id":"4231b8d1-eb2a-42bc-a6bf-0e6abc901ac4","resolution":{"observed_at":"2026-08-01T02:28:04.750071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.753012Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.753012Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:19749609e2221db0326f901f541de70d3943d212d56d1709e12ee6eaacd9f6f4","observation_id":"ff023fc6-d25c-48e4-906e-b4c6542fc948","resolution":{"observed_at":"2026-08-01T02:28:04.753012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-01T02:28:04.755862Z","title":"arXiv preprint arXiv:2309.17453 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.755862Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:add97db5397960fa89f7df796877ba28d0d81c937ddde27b3fbc2dcc6a8e1f36","observation_id":"9adf66fa-fa70-452a-9719-71bc02c33e52","resolution":{"observed_at":"2026-08-01T02:28:04.755862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.759285Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.759285Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:78d256199e22a6417b4431295f3c235037ffd127ff2e8aa2e6f1b8f02011c6af","observation_id":"01181eb5-b951-4be9-bcaa-2264d4d27346","resolution":{"observed_at":"2026-08-01T02:28:04.759285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.761927Z","title":"18th USENIX Symposium on Operating Systems Design and Implementation (OSDI 24) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.761927Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:5418cc856da71698e64d85115a2381ede34e798c51f1ef4972164d66b21a4a0f","observation_id":"f7bebff3-3a4f-4bd9-bf5e-50bb492d3501","resolution":{"observed_at":"2026-08-01T02:28:04.761927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.764546Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.764546Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:33c25652b0680b11a9c9253ea641f7118a5039c8a20666d0e56fbf45eb620cde","observation_id":"b1cf1ce2-a857-4359-bc30-740dec244d6c","resolution":{"observed_at":"2026-08-01T02:28:04.764546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-01T02:28:04.767168Z","title":"arXiv preprint arXiv:2401.15077 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.767168Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:d66659b92b8df530bbdd62398a3a873734d1933de2702fc6234b68f94fdfcc59","observation_id":"09376490-6931-4b09-b849-a35fe24c8cc9","resolution":{"observed_at":"2026-08-01T02:28:04.767168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01840","last_updated":"2025-04-23T07:08:17Z","snapshot_observed_at":"2026-07-06T20:45:55.263034Z","submitted_at":"2025-03-03T18:59:04Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01840","snapshot_observed_at":"2026-08-01T02:28:04.770082Z","title":"arXiv preprint arXiv:2503.01840 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.770082Z"},"links":{"cited_paper":"/paper/2503.01840","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:e4bfd29e923b758bfcd3b5ba76733e2c6fe95b4af3242b98661256adc74a3d05","observation_id":"717c86fc-242b-4dea-8406-f5364976aade","resolution":{"observed_at":"2026-08-01T02:28:04.770082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-01T02:28:04.772880Z","title":"arXiv preprint arXiv:2404.19737 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.772880Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:bc61f33e1d8112da99f4f9df2349ccbec751cba5960e3683deabd9f63dd61793","observation_id":"a46b54ec-6ab4-4f90-8565-bbb28108d61c","resolution":{"observed_at":"2026-08-01T02:28:04.772880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-01T02:28:04.775717Z","title":"arXiv preprint arXiv:2401.10774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.775717Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:b5bd3e621ebe1ec7643506a1efc94e7b63b6f5d9e541f267b65ba22c8b751619","observation_id":"44627741-e9ec-4b81-a030-9d8a93c10901","resolution":{"observed_at":"2026-08-01T02:28:04.775717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07177","last_updated":"2024-06-10T01:36:31Z","snapshot_observed_at":"2026-07-06T16:30:55.043821Z","submitted_at":"2023-10-11T04:03:42Z","title":"Online Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07177","snapshot_observed_at":"2026-08-01T02:28:04.778477Z","title":"arXiv preprint arXiv:2310.07177 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.778477Z"},"links":{"cited_paper":"/paper/2310.07177","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:8c99a5028e806ce8347867a32558424a57a44bcb44b7643c11be5acebb741c59","observation_id":"34685473-2c52-4ada-8074-33d15d87d7c5","resolution":{"observed_at":"2026-08-01T02:28:04.778477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20330","last_updated":"2025-06-23T03:05:26Z","snapshot_observed_at":"2026-08-03T23:20:27.948091Z","submitted_at":"2025-02-27T17:59:36Z","title":"RAPID: Long-Context Inference with Retrieval-Augmented Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20330","snapshot_observed_at":"2026-08-01T02:28:04.781491Z","title":"arXiv preprint arXiv:2502.20330 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.781491Z"},"links":{"cited_paper":"/paper/2502.20330","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:cfb9fa62e329bf041f2d81e4ca893843caab73cb24e16c646c18f8eb0b04f4d1","observation_id":"63f985f8-6ca4-4e31-b1bf-ad2607abdc89","resolution":{"observed_at":"2026-08-01T02:28:04.781491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11049","last_updated":"2025-04-02T01:58:38Z","snapshot_observed_at":"2026-07-06T19:03:39.672411Z","submitted_at":"2024-08-20T17:57:31Z","title":"MagicDec: Breaking the Latency-Throughput Tradeoff for Long Context Generation with Speculative Decoding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11049","snapshot_observed_at":"2026-08-01T02:28:04.784269Z","title":"arXiv preprint arXiv:2408.11049 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.784269Z"},"links":{"cited_paper":"/paper/2408.11049","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:d996c02896e0ccaaa3251715c2817b0c1d985b3ba0cbf9cd2bf9f7b71407cf0d","observation_id":"7c7ba51d-07d8-42be-9d79-0aa6fcac4444","resolution":{"observed_at":"2026-08-01T02:28:04.784269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.787128Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.787128Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:ab402669ee7d386ed058243c680563638606502403c34e7c1865d37d66116bb9","observation_id":"d1666edf-d0fa-49f7-a70e-a030627fb026","resolution":{"observed_at":"2026-08-01T02:28:04.787128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.789765Z","title":"Proceedings of the 62nd annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.789765Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:621bb7c3deb72c0dc7504c12e5f30033a961fc16e0357448390a0cbc86a1f34b","observation_id":"64863c10-0eac-4a3a-a0d8-8c760b7ad4b6","resolution":{"observed_at":"2026-08-01T02:28:04.789765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.792566Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.792566Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:de1abdf3dadb192935b0dab01130bc3de82817e9a6524fc82f35adefc297e021","observation_id":"586059d7-eb61-48cd-ba0c-75d5edefabbd","resolution":{"observed_at":"2026-08-01T02:28:04.792566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.795320Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.795320Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:2ff85f089117d334466c854c019cbbae3b8316635f65b247a54b8944b1da2b80","observation_id":"1c1f8247-a94b-4dcd-9d0f-bc8e9c11d4d6","resolution":{"observed_at":"2026-08-01T02:28:04.795320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-01T02:28:04.797987Z","title":"arXiv preprint arXiv:2307.08691 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.797987Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:51ee928c6790c36c87583feea9d2578d3d832ae9073065c877a822c05933bf71","observation_id":"a56c88a4-e5c5-47d3-9db5-576379693dde","resolution":{"observed_at":"2026-08-01T02:28:04.797987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.800851Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.800851Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:209f640c6976bc772273ade317e541beb19a1925a7bc59d813524b0c62959722","observation_id":"986d81b0-5350-4d83-adb7-b1ab4f274df0","resolution":{"observed_at":"2026-08-01T02:28:04.800851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-01T02:28:04.804140Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.804140Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:676d97d3c7a347e8b39724a0681d44bf1d908d33f92ed02b8e124a77314d31c3","observation_id":"11d286cb-7345-43a3-b217-d4b87c47c28b","resolution":{"observed_at":"2026-08-01T02:28:04.804140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-01T02:28:04.807023Z","title":"5-coder technical report , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.807023Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:779c9b366e2da56b884a6f809d8e50ae92e77c69942e34df7b7c50b4db59a44c","observation_id":"4772a483-45c4-41c5-8126-2f02c4003b83","resolution":{"observed_at":"2026-08-01T02:28:04.807023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.809898Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.809898Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:08e0edf64f9de0665da3ed888b541f3d0c061775d9be9644396c33cd79ad68a1","observation_id":"0a8edb0c-f290-4ee3-b545-af735fa225d4","resolution":{"observed_at":"2026-08-01T02:28:04.809898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.812427Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.812427Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:b0fe8e77e52af1766a50dbe5b653ac84fb5ae8eea038ebb1e1e821aef2d2c783","observation_id":"664647d4-b938-4171-9588-a309a5a4455c","resolution":{"observed_at":"2026-08-01T02:28:04.812427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.815153Z","title":"Proceedings of the 2020 conference on empirical methods in natural language processing: system demonstrations , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.815153Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:5699c9834764c671ccafc4d3682c94dfdb3bb990b861b38c703aea4356c9c74c","observation_id":"aab47e77-9905-4e3b-8755-0e33208a28a6","resolution":{"observed_at":"2026-08-01T02:28:04.815153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.817897Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.817897Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:964483bc732d866b25a26be8d729583e2d5c80dbbca85e1d12f758bbd937121d","observation_id":"3ebe6b02-9723-4de0-8acb-d61a06759eb1","resolution":{"observed_at":"2026-08-01T02:28:04.817897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.820426Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.820426Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:7eac1f016ec5312eda7a5550c566fce152cc0073f4876afca0aa5aee156e8136","observation_id":"0d915841-15af-42c6-9abb-d5fcebcf4438","resolution":{"observed_at":"2026-08-01T02:28:04.820426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-01T02:28:04.823026Z","title":"arXiv preprint arXiv:2406.02069 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.823026Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:1070e8c883913597efafcce1aaccbe6508ad41385f43ec92d65743cd085b89fa","observation_id":"3e9bfc5b-40a7-4b91-bce5-5bd1552012a3","resolution":{"observed_at":"2026-08-01T02:28:04.823026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.826169Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.826169Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:d903bc360f532a25031a1e7d427f8f466a1113094c52efd8ef9b9de393f573b7","observation_id":"c50ed756-db11-4cfe-bac4-210dbe89662d","resolution":{"observed_at":"2026-08-01T02:28:04.826169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.828798Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.828798Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:0e5626cf918ac6e989fcb356844a1ecd563bf01e723ebf2775565336a3b9786a","observation_id":"18c996a0-48e2-4ed0-9777-aaed2d894823","resolution":{"observed_at":"2026-08-01T02:28:04.828798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.831386Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.831386Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:7c9a3bc06a7f8fadc811ea9181e7f662086666ad7f20d503d806ddf40cb43100","observation_id":"7633c5e8-3293-4749-ac5a-d0fd741a5434","resolution":{"observed_at":"2026-08-01T02:28:04.831386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11912","last_updated":"2024-08-04T00:58:04Z","snapshot_observed_at":"2026-07-06T18:01:57.998555Z","submitted_at":"2024-04-18T05:25:54Z","title":"TriForce: Lossless Acceleration of Long Sequence Generation with Hierarchical Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11912","snapshot_observed_at":"2026-08-01T02:28:04.834122Z","title":"arXiv preprint arXiv:2404.11912 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.834122Z"},"links":{"cited_paper":"/paper/2404.11912","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:423a7b65474a49f2fea9ee06d93972ff302500706751c1864365a87c749a6117","observation_id":"3c1aa857-587a-4a6c-975c-7ccedd3094b7","resolution":{"observed_at":"2026-08-01T02:28:04.834122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.836964Z","title":"arXiv preprint arXiv:2512.01278 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.836964Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:c4ca40290d226cab0ec2868c598efbed1f627cbcdcc07a77b3302b1e4089d8e3","observation_id":"c90dd767-134c-4b35-8e69-c481f9e5ddb5","resolution":{"observed_at":"2026-08-01T02:28:04.836964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07223","last_updated":"2026-05-29T20:44:40Z","snapshot_observed_at":"2026-08-06T16:51:07.869784Z","submitted_at":"2026-02-06T22:12:52Z","title":"Vegas: Self-Speculative Decoding with Verification-Guided Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.07223","snapshot_observed_at":"2026-08-01T02:28:04.839586Z","title":"arXiv preprint arXiv:2602.07223 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.839586Z"},"links":{"cited_paper":"/paper/2602.07223","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:a26cc17d27aa5d3c94085f4ee0b346e4fc0edc180a296d439451e7a970781f0f","observation_id":"032fd074-5a64-481b-86ca-32e9d84ba27d","resolution":{"observed_at":"2026-08-01T02:28:04.839586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T02:28:04.842350Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.842350Z"},"links":{"citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:5df4f4d830c5690a0c8aaad0eb625773867b29ef432bf59aeebbb7dd8004b36b","observation_id":"1525fea9-3a33-47b0-b838-9c9f3d06f47d","resolution":{"observed_at":"2026-08-01T02:28:04.842350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18351","last_updated":"2024-10-24T01:13:43Z","snapshot_observed_at":"2026-07-06T19:38:48.401401Z","submitted_at":"2024-10-24T01:13:43Z","title":"AdaEDL: Early Draft Stopping for Speculative Decoding of Large Language Models via an Entropy-based Lower Bound on Token Acceptance Probability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18351","snapshot_observed_at":"2026-08-01T02:28:04.845296Z","title":"arXiv preprint arXiv:2410.18351 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.845296Z"},"links":{"cited_paper":"/paper/2410.18351","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:d392f8ac7ddbd4d334bd1595ac6364bd8444d8b923e672099696c0867ed211bb","observation_id":"696f17bb-ccea-4c23-8eea-c00687e69305","resolution":{"observed_at":"2026-08-01T02:28:04.845296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04304","last_updated":"2024-11-07T12:59:39Z","snapshot_observed_at":"2026-07-06T18:11:01.734775Z","submitted_at":"2024-05-07T13:27:52Z","title":"Dynamic Speculation Lookahead Accelerates Speculative Decoding of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04304","snapshot_observed_at":"2026-08-01T02:28:04.848394Z","title":"arXiv preprint arXiv:2405.04304 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.848394Z"},"links":{"cited_paper":"/paper/2405.04304","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:d5ca513265a9587cf41e4ade3a8df5bf96a15646610e35debf14a1a6309f466f","observation_id":"12eca8ac-832f-4b00-b9ec-1bfd7669900a","resolution":{"observed_at":"2026-08-01T02:28:04.848394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-01T02:28:04.851282Z","title":"arXiv preprint arXiv:2404.06654 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T02:28:04.851282Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2607.27735"},"observation_digest":"sha256:59d7f02a877629af8d437a8fcf23be6da21ee2fe75689e462eb1804e0638ef64","observation_id":"f83ae6e1-016a-4640-ba94-e8d7910eb051","resolution":{"observed_at":"2026-08-01T02:28:04.851282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27735","last_updated":"2026-07-30T06:16:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T18:13:16.828710Z","submitted_at":"2026-07-30T06:16:56Z","title":"A Sparse Glimpse of the Whole: Train-Free Self-Speculative Decoding"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2607.27735."}