{"as_of":"2026-08-06T18:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:562e4c80a40328533fbcdc45782bd86534592737dbd7cc8b73679258f784bd5c","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T06:53:02.744567Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T08:51:11.662084Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-29T08:53:15.761041Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"cited_work":{"arxiv_id":"2507.01449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01449","snapshot_observed_at":"2026-06-29T08:53:15.761041Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","venue":"cs.CL","work_id":"86404013-83cb-43dc-a8f5-9a937aa3d9d4","year":2025},"citing_paper":{"arxiv_id":"2605.20104","last_updated":"2026-05-19T16:55:48Z","snapshot_observed_at":"2026-08-04T03:30:21.702008Z","submitted_at":"2026-05-19T16:55:48Z","title":"Draft Less, Retrieve More: Hybrid Tree Construction for Speculative Decoding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T06:58:07.996335Z"},"links":{"cited_paper":"/paper/2507.01449","citing_paper":"/paper/2605.20104"},"observation_digest":"sha256:f173080a9cad89f8f639dcf1334516ac96bda490e1d1b2448bd47059b18ae37e","observation_id":"52f544e3-f051-4bcf-b5b7-d7b3c267c899","resolution":{"observed_at":"2026-05-20T07:03:06.485380Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"cited_work":{"arxiv_id":"2507.01449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01449","snapshot_observed_at":"2026-06-29T08:53:15.761041Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","venue":"cs.CL","work_id":"86404013-83cb-43dc-a8f5-9a937aa3d9d4","year":2025},"citing_paper":{"arxiv_id":"2605.29727","last_updated":"2026-05-28T10:21:34Z","snapshot_observed_at":"2026-08-02T01:53:53.633149Z","submitted_at":"2026-05-28T10:21:34Z","title":"Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:11.662084Z"},"links":{"cited_paper":"/paper/2507.01449","citing_paper":"/paper/2605.29727"},"observation_digest":"sha256:cc2e0eda442ba441b70667dc422127d26373704ef1bc879e1914f7999b530324","observation_id":"0402ea6c-6eb6-41e0-8fbd-c6393388b90b","resolution":{"observed_at":"2026-06-29T08:53:15.762859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.01449/citation-record","integrity":"/paper/2507.01449/integrity","json":"/paper/2507.01449/citation-record.json","paper":"/paper/2507.01449"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:ade12c39c261c06dcc51838029a9bf312caf169d7c4ba56abb05736787aac706","observation_id":"449d75ec-30c7-4059-95a7-00d133cc5905","resolution":{"observed_at":"2026-05-19T06:57:08.176418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:8415eab85deebb3a30a7557b11666b61570c82ec54d2640ed2637146178fb60f","observation_id":"fa2a5a18-5c75-4b50-9ca1-90a047b918e0","resolution":{"observed_at":"2026-05-19T06:57:08.172488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:4e94e239d45b89714ff9a0cc4223072e819764483c256cc3aedaec8e783608c2","observation_id":"d05f9975-d744-49cd-8c8b-d69e64ecc149","resolution":{"observed_at":"2026-05-19T06:57:08.162995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:d1443d2088159f129b3ed8db05642a166dac24bb6085344e735e9a11109723a6","observation_id":"cf1831cc-fe68-4330-9047-f1ff1af987ca","resolution":{"observed_at":"2026-05-19T06:57:08.184916Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jksuci.2018.08.005","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A literature review on question answering techniques, paradigms and systems","venue":"Journal of King Saud University - Computer and Information Sciences","work_id":"fc4d53bc-fa4d-4f8d-922b-0087ae321bfa","year":2020},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:9007a8d6729ce54d9d64f1ba7fade862b95f71adec933500a9be61dd75e16d84","observation_id":"f89200ca-6b83-45a1-beae-1f90a3c07e85","resolution":{"observed_at":"2026-05-19T06:57:07.694847Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T03:19:11.980636+00:00","source":"paper_reference_links","state":"open"},"event_date":"2020-11-24","event_type":"correction","notice_doi":"10.1016/j.jksuci.2020.11.015","provenance":{"observed_at":"2026-07-11T03:10:57.907759+00:00","source":"crossref","source_record_id":"10.1016/j.jksuci.2020.11.015->10.1016/j.jksuci.2018.08.005:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":"2406.00515","doi":"10.48550/arxiv.2406.00515","metadata_source":"pith","pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on Large Language Models for Code Generation","venue":"cs.CL","work_id":"7d829146-3160-44c7-9ce4-4201ed9b654c","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:e9e43974191487e77c1758936d0eac0b22bffe40d645f92d981f6857806ba01c","observation_id":"de3152e7-7f50-4f51-9250-a359b6c4a8e7","resolution":{"observed_at":"2026-05-19T06:57:08.189550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T06:49:11.204487+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T06:49:11.204487+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-04T11:22:48.683493Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":"2402.18013","doi":"10.48550/arxiv.2402.18013","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey on recent advances in llm-based multi-turn dialogue systems","venue":"arXiv (Cornell University)","work_id":"d4419b98-6427-493f-8afe-3e4d0d22a371","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:306a619b09c2d543a5ea5be8749658d3d0166a6dca2da806fca85829d629b9bb","observation_id":"2debbe80-b187-4925-9589-fe5de24149d8","resolution":{"observed_at":"2026-05-19T06:57:08.167742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"c36efd9d-ce76-47c4-b27e-b30d8bf08035","year":2023},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:e996edd5bac2f94e9f30449f81b0bc0c91fc9b7186aea400d449f86a29ee34db","observation_id":"179692f7-7061-475f-862a-14503cb7e58d","resolution":{"observed_at":"2026-05-19T06:57:08.963668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":"2302.01318","doi":"10.48550/arxiv.2302.01318","metadata_source":"pith","pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","venue":"cs.CL","work_id":"b53b11e5-8613-439d-9d9d-0e2a9090d79f","year":2023},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:66b542a623a5eddb14be1d28bbd293a24598e3c65b12c4d60182f86f29e821e1","observation_id":"5aed4338-ed2e-467f-a785-ffc13a879e76","resolution":{"observed_at":"2026-05-19T06:57:08.180556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PEARL : Parallel speculative decoding with adaptive draft length","venue":null,"work_id":"32a59da7-6e0e-48aa-813e-eb41f500a18a","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:c44ced29b043863e90fbb194b6ed4800d43e7c1727f3971cbcef826f6929ac49","observation_id":"97452a54-83d3-485c-b1f7-fc4bab9ccb60","resolution":{"observed_at":"2026-05-19T06:57:08.966870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01840","last_updated":"2025-04-23T07:08:17Z","snapshot_observed_at":"2026-07-06T20:45:55.263034Z","submitted_at":"2025-03-03T18:59:04Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","version":3},"cited_work":{"arxiv_id":"2503.01840","doi":"10.48550/arxiv.2503.01840","metadata_source":"pith","pith_arxiv_id":"2503.01840","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","venue":"cs.CL","work_id":"323c1b68-aec5-4444-944f-155a771bd8c6","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2503.01840","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:9a04d686643e8c7ab99313dfcf4f71bf853b323c35f71179d24875ca8da0589b","observation_id":"4a834c8d-220a-471b-90b4-8620bd087dcd","resolution":{"observed_at":"2026-05-19T06:57:08.157988Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt lookup decoding, November 2023","venue":null,"work_id":"c20edf6d-326e-4d70-b8d9-c15925695c01","year":2023},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:09ae2e1efb997cc7e1ceb686bad1d4433fbee0f734b0b245b6467b97daf9f8db","observation_id":"c10c9f6d-b2aa-4641-964f-72f0022b1c0b","resolution":{"observed_at":"2026-05-19T06:57:08.960270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Break the sequential dependency of llm inference using lookahead decoding","venue":null,"work_id":"9bd5101c-58a8-46dd-9afb-94955ef260a8","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:f7045964082e55d77631c1085e195e561715cbf790c9202aa62ab29eb49371cf","observation_id":"e5dac906-1699-4a09-81b9-5581154de82f","resolution":{"observed_at":"2026-05-19T06:57:08.969889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.88","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"REST : Retrieval-based speculative decoding","venue":null,"work_id":"1e2c2421-0a42-4fd9-9d11-55d709217e14","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:17f378e4b7818a3b66e7af82ff531932bed5fd122fa36f3595e689a558ce7741","observation_id":"1476bf48-dcee-42a7-bc81-e9353df1a2a4","resolution":{"observed_at":"2026-05-19T06:57:07.684371Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-17T21:20:55.059943+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T21:20:55.059943+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"57e64bde-be74-4079-bd6d-8cb8f21feef6","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:64c1a4e5e6a0f46049627e629f834e487e781a3b4b90dfa22a2711490445fee3","observation_id":"8a0d9f78-7b9a-42c2-906e-11faae93ec84","resolution":{"observed_at":"2026-05-19T06:57:08.990096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hydra: Sequentially-dependent draft heads for medusa decoding","venue":null,"work_id":"e3e5e981-2768-405c-b787-d93b8d2cde24","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:786bb94873df81ff4c50ce5896f4887b10ee276cd38e04ad2fd13ea5cc5e1a44","observation_id":"b685de85-7fae-484b-836c-dfaab4041ea6","resolution":{"observed_at":"2026-05-19T06:57:08.987102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00263","last_updated":"2024-05-01T00:46:22Z","snapshot_observed_at":"2026-07-06T18:08:00.410061Z","submitted_at":"2024-05-01T00:46:22Z","title":"Clover: Regressive Lightweight Speculative Decoding with Sequential Knowledge","version":1},"cited_work":{"arxiv_id":"2405.00263","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00263","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clover: Regressive lightweight speculative decoding with sequential knowledge","venue":null,"work_id":"cdbb5eb0-0360-4e64-8dd8-43a2f65f02c8","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2405.00263","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:43e64b22bbfcf3c361ea1abf30c20aac279d73c268da850b88dee43121185fc1","observation_id":"14dafdaf-dcd8-4514-b109-ba5175e81103","resolution":{"observed_at":"2026-05-19T06:57:08.072937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glide with a cape: a low-hassle method to accelerate speculative decoding","venue":null,"work_id":"6be452f9-1cbe-4fe8-a9bc-e69bf3536de9","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:29f8be799a7da7f3f136243b379bd431804c2d26a3afa167541b7e44f85de3da","observation_id":"75a57627-e671-4ecc-a770-edab50cf7327","resolution":{"observed_at":"2026-05-19T06:57:08.993349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":"2401.15077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-07-10T21:57:38.979373Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","venue":"cs.LG","work_id":"9d4637dd-1cab-4f10-82d4-8c8d14bb96ed","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:f77d9ddbf4d53365136bcf545f953b1aef70ffa74ee5bbc58e52e210924b7320","observation_id":"8454cdb8-3719-4a26-a347-a22faa81bf3d","resolution":{"observed_at":"2026-05-19T06:57:08.078215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.422","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EAGLE -2: Faster inference of language models with dynamic draft trees","venue":null,"work_id":"e684b360-f452-4e24-9f65-82df5b135184","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:c270cad444cb94e7cdb15e424eb03bc1922e2a0bebab9228885c002e389ff42d","observation_id":"7bfc0cca-f048-4dfd-9c07-14a83abde9b6","resolution":{"observed_at":"2026-05-19T06:57:07.688103Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T20:19:09.111696+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T20:19:09.111696+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.607","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:57:36.636486Z","title":"An Yang, Anfeng Li, Baosong Yang, Beichen Zhang, Binyuan Hui, Bo Zheng, Bowen Yu, Chang Gao, Chengen Huang, Chenxu Lv, et al","venue":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"df5d9ae6-4f51-4947-8f81-a6122141b13a","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:914889156880c1c07e74c156c18cdcf5cf1161ece964ed15d131fead6ee0ad24","observation_id":"fe8616eb-819f-4de3-b854-2f586f9929bc","resolution":{"observed_at":"2026-05-19T06:57:07.680775Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T20:19:12.533336+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T20:19:12.533336+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Layerskip: Enabling early exit inference and self-speculative decoding, August 2024","venue":null,"work_id":"aeb251f3-a684-4e8a-9066-7e24fb0bbff0","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:c48da13aa4b804858bfbac32331394b94e5462f3452f213bdb28643c829c8a1c","observation_id":"999f06f0-d54d-4884-a8d4-e8224cc9e040","resolution":{"observed_at":"2026-05-19T06:57:08.997539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SWIFT : On-the-fly self-speculative decoding for LLM inference acceleration","venue":null,"work_id":"198430d2-e659-48fe-ab2f-5d4e8f1cc7e1","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:3cd9b2ad094c74ed4293e0db09ba11d30b177e26b612f76b6d5d7c71fc2bb9e6","observation_id":"8332a367-4a86-4ef0-b4ca-6166c54bca9f","resolution":{"observed_at":"2026-05-19T06:57:08.983203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":"2404.19737","doi":"10.48550/arxiv.2404.19737","metadata_source":"pith","pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Better & Faster Large Language Models via Multi-token Prediction","venue":"cs.CL","work_id":"7235774b-df35-4d85-a7ef-7deebd473172","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:83f945efcf92bf85b9e689d5acf7c7825d9635a24b1e2388a1b57939ea624217","observation_id":"6764b41d-4ee8-4f51-9233-32f010cda71a","resolution":{"observed_at":"2026-05-19T06:57:08.114826Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.456","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":"f0ee04ac-0c06-4614-8a7c-93a024d63dc2","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:711a882c3066bd88a724c1cfa408b00d0f027abaea6449aee452fd9d713140ea","observation_id":"c7ab0fbb-0a2e-4cf9-b8bb-5a8ebb9d665b","resolution":{"observed_at":"2026-05-19T06:57:07.691485Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T20:19:12.312541+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T20:19:12.312541+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0666.365133","doi":"10.1145/3620666.3651335","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Specinfer: Accelerating large language model serving with tree-based speculative inference and verification","venue":null,"work_id":"787d8561-54f3-48ff-bca1-03582f84d470","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:908e350f3d2881caa61493d6da37189aa78f28929dff701b0fcafdb6b27b9b67","observation_id":"f9ff4ddd-f9c4-4903-9207-6c3ae186342a","resolution":{"observed_at":"2026-05-19T06:57:07.670470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T17:50:18.8352+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T17:50:18.8352+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:19eb2551112e10e25fecf6dc51239205d653d868350dff057194c6329f06d379","observation_id":"3f923c47-44d8-4b3c-afa3-9db5c59c5a17","resolution":{"observed_at":"2026-05-19T06:57:08.119876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:263eb913e36440cc1706d93d066c91d525befaafafb7f560b20d27e57545725c","observation_id":"b0823f8b-03df-45bf-9abb-bd6b32a51123","resolution":{"observed_at":"2026-05-19T06:57:08.109871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/k16-1028","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/K16-1028","venue":null,"work_id":"c6848274-3353-4417-9ad4-b34ccead1119","year":2016},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:c211e873ebeaccd902b8cd1cc754028a3463c41f68043434124b9aaf8c336888","observation_id":"42fddce5-9517-409c-b75c-5f552002168b","resolution":{"observed_at":"2026-05-19T06:57:07.675556Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":"1912.01703","doi":"10.1109/92.335012","metadata_source":"pith","pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","venue":"cs.LG","work_id":"c30b6d2c-7bb4-4ab0-8ef8-2015313610a9","year":2019},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:aa9eac413e0b433435c029fa498e1d63f6e52ada844e15ed8a4eac6a19b37905","observation_id":"f46ed9df-2044-4ca4-9554-4804ec0797e7","resolution":{"observed_at":"2026-05-19T06:57:08.129890Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"749deaa0-70d1-4b4c-9ea8-12af4bdbbbfa","year":2020},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:f8aafdcc95090b32042fc3fc5ece52ea3e7063abc75efecf0b370b547f19645f","observation_id":"c7081234-a92b-49a4-b847-6f447c1a7851","resolution":{"observed_at":"2026-05-19T06:57:09.001195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c126ddd6-f9dd-4386-8b13-99ef1e1db8a3","year":2020},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:09f2168e9b6599c09bbca64ed539957e0d7c238efb8aac84cdc3a3847baf581b","observation_id":"58015956-5278-4b43-81ea-880f59240af7","resolution":{"observed_at":"2026-05-19T06:57:08.976313Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning harmonized representations for speculative sampling","venue":null,"work_id":"75d13754-ae9a-4ee9-a4e1-d03ebf674219","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:4b236c891263e01e490c2cd45d8e607486a55a5e6a97c4b104d2f37349ac3d86","observation_id":"6bd0b6f5-9e1a-4f4e-8060-912879c9bfcf","resolution":{"observed_at":"2026-05-19T06:57:08.979582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16880","last_updated":"2025-05-25T14:16:22Z","snapshot_observed_at":"2026-08-03T23:38:45.873467Z","submitted_at":"2025-02-24T06:28:26Z","title":"CORAL: Learning Consistent Representations across Multi-step Training with Lighter Speculative Drafter","version":3},"cited_work":{"arxiv_id":"2502.16880","doi":"10.48550/arxiv.2502.16880","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.16880","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Coral: Learning consistent representations across multi-step training with lighter speculative drafter","venue":"ArXiv.org","work_id":"ad828ef6-c484-4710-a758-29a599cf8edc","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2502.16880","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:75096e65cf34693390fa4ee85a5bf6dc73a8c5efe56c32d7a5c5cf388e1f581a","observation_id":"705a7607-254e-48fa-aa1d-17d3eba5bdb0","resolution":{"observed_at":"2026-05-19T06:57:08.125103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-07-06T20:29:07.258163Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:31f27360a26d744422c5bb3e5c421347cf42f8867c6060be4f499874d4ece4ba","observation_id":"2c564df3-6203-45b1-8ebc-7fbf0db78e40","resolution":{"observed_at":"2026-05-19T06:57:08.105128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10135","last_updated":"2025-06-30T04:51:00Z","snapshot_observed_at":"2026-08-01T12:51:01.649314Z","submitted_at":"2025-03-13T07:55:38Z","title":"Gumiho: A Hybrid Architecture to Prioritize Early Tokens in Speculative Decoding","version":2},"cited_work":{"arxiv_id":"2503.10135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10135","snapshot_observed_at":"2026-07-04T16:49:57.085438Z","title":"Gumiho: A hybrid architecture to prioritize early tokens in speculative decoding.arXiv preprint arXiv:2503.10135, 2025a","venue":null,"work_id":"aef4178e-4b15-4490-9587-7480321148ac","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2503.10135","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:2071638a1a4a74778ad3407ff4653fa1c6c28024d21ba6e62924757abfcb469c","observation_id":"b3508aa2-8d2e-4923-b84c-1ad52d8633d4","resolution":{"observed_at":"2026-05-19T06:57:08.095013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Specdec++: Boosting speculative decoding via adaptive candidate lengths","venue":null,"work_id":"ab85cf34-3ba7-4896-a6d5-b4698b40058a","year":2025},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:a95ec93ff4d8aed1edabe17c7a82bbbd7d1766f3180d3e89fa386df7d9e3dabd","observation_id":"c16603b6-fb3a-4fbc-8329-d993895b2d7b","resolution":{"observed_at":"2026-05-19T06:57:08.972900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17276","last_updated":"2025-04-24T08:52:19Z","snapshot_observed_at":"2026-07-06T18:36:34.369503Z","submitted_at":"2024-06-25T04:45:53Z","title":"OPT-Tree: Speculative Decoding with Adaptive Draft Tree Structure","version":4},"cited_work":{"arxiv_id":"2406.17276","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17276","snapshot_observed_at":"2026-07-03T10:37:56.264863Z","title":"Opt-tree: Speculative decoding with adaptive draft tree structure","venue":null,"work_id":"68f87d8a-5aba-4e03-bd2c-6d0d526a6682","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2406.17276","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:ccb5cb23c87d2d1e2e48dcade9b38e37913107e5d2b482ddb67940a9043f3116","observation_id":"9ee1140b-8668-434f-a425-165eb6ee4be3","resolution":{"observed_at":"2026-05-19T06:57:08.147003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-04T21:01:27.776015Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"cited_work":{"arxiv_id":"2412.18910","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18910","snapshot_observed_at":"2026-06-29T08:53:15.807429Z","title":"Adaeagle: Optimizing speculative decoding via explicit modeling of adaptive draft structures, 2024 b","venue":null,"work_id":"ea26080a-2dd4-42d4-ac9e-612b7b6abad5","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2412.18910","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:b9a8e068af6ff6e0aa124ae6768cdfcc3c416e0e1d46c869b40919dcfbe2d74e","observation_id":"c74aa8a4-11e6-45e3-8260-f48ea7ff17a7","resolution":{"observed_at":"2026-05-19T06:57:08.140921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12072","last_updated":"2024-01-03T00:32:43Z","snapshot_observed_at":"2026-07-06T16:35:07.121479Z","submitted_at":"2023-10-18T16:07:01Z","title":"SPEED: Speculative Pipelined Execution for Efficient Decoding","version":2},"cited_work":{"arxiv_id":"2310.12072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.12072","snapshot_observed_at":"2026-07-03T10:37:56.283023Z","title":"Speed: Speculative pipelined execution for efficient decoding","venue":null,"work_id":"82ad9c47-5f9d-44b6-bb07-e99a4a6ec4a8","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2310.12072","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:37df7ff301838b4eda5c64ecb82fc46063103a3b2e71e89e8d9c002d1dbbcd26","observation_id":"9c1bed11-a931-4505-9992-8c898b93414c","resolution":{"observed_at":"2026-05-19T06:57:08.135410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05424","last_updated":"2023-10-09T05:53:05Z","snapshot_observed_at":"2026-08-01T16:29:48.158575Z","submitted_at":"2023-10-09T05:53:05Z","title":"Fast and Robust Early-Exiting Framework for Autoregressive Language Models with Synchronized Parallel Decoding","version":1},"cited_work":{"arxiv_id":"2310.05424","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05424","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast and robust early-exiting framework for autoregressive language models with synchronized parallel decoding","venue":null,"work_id":"96ab7e7e-b35f-46f5-9a23-a956c2be810d","year":2023},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2310.05424","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:9b1347b6ad895a416d54b566338480112ca8687fb6abb9dfc3f5015accd2e467","observation_id":"85e0fd8a-988d-49e2-8754-1092f8090124","resolution":{"observed_at":"2026-05-19T06:57:08.152830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03853","last_updated":"2024-06-06T08:40:28Z","snapshot_observed_at":"2026-08-02T02:45:42.603683Z","submitted_at":"2024-06-06T08:40:28Z","title":"Speculative Decoding via Early-exiting for Faster LLM Inference with Thompson Sampling Control Mechanism","version":1},"cited_work":{"arxiv_id":"2406.03853","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03853","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speculative decoding via early-exiting for faster llm inference with thompson sampling control mechanism","venue":null,"work_id":"206700da-672a-483a-976f-48308ac188f9","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2406.03853","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:b1422e1fcb6bc4df9522dbe6b793a147d68850dc10f270e17b60ef940d23efec","observation_id":"49b79bff-a0fd-4418-b1d9-9897c96311cc","resolution":{"observed_at":"2026-05-19T06:57:08.083769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08696","last_updated":"2025-05-25T12:10:14Z","snapshot_observed_at":"2026-07-06T19:01:32.237848Z","submitted_at":"2024-08-16T12:20:56Z","title":"Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling","version":3},"cited_work":{"arxiv_id":"2408.08696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08696","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Turning trash into treasure: Accelerating inference of large language models with token recycling","venue":null,"work_id":"f1b3d603-124f-4268-8154-6cd8dc88046d","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2408.08696","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:9eed2f6124d981e78a5d87a4ddb0a0d0eb0ba9a46049eb0301f6f33a94016574","observation_id":"f223c0e0-0473-4930-a912-bdac43ab6c89","resolution":{"observed_at":"2026-05-19T06:57:08.089239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10666","last_updated":"2024-12-16T10:48:28Z","snapshot_observed_at":"2026-08-04T01:52:39.614826Z","submitted_at":"2024-11-16T02:02:49Z","title":"SAM Decoding: Speculative Decoding via Suffix Automaton","version":3},"cited_work":{"arxiv_id":"2411.10666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10666","snapshot_observed_at":"2026-07-10T21:57:38.804023Z","title":"Sam decoding: Speculative decoding via suffix automaton","venue":"cs.CL","work_id":"4ecd752b-23ff-45d8-8e3f-99726526dbc3","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2411.10666","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:3b1e65045315d8cd6551f731acab305904ee83e095059038d865c766ab9142d0","observation_id":"fe5b3c85-e7d6-4101-a79c-acd4cb38bd1e","resolution":{"observed_at":"2026-05-19T06:57:08.099694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":1,"verified_exact":29,"verified_fuzzy":11},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2507.01449."}