{"as_of":"2026-08-10T15:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc5f108cf54f83d432d9f3f68fa6af79ef29d398feb136020df08b7664a10fee","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T20:43:27.709855Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T21:57:38.877082Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-09T20:43:27.709855Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-10T14:49:26.194519Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.709855Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:274fa7defd09437f4a25ed799ba389280d8b1e285866c983d724165f24a5dbd6","observation_id":"ca67f8bb-bea2-4a3b-84c2-8dc99c3db2fc","resolution":{"observed_at":"2026-08-09T20:43:27.709855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-09T20:42:44.038874Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-08-10T13:46:16.822794Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T20:42:44.038874Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2501.19324"},"observation_digest":"sha256:9371d20d8ef53679ec9963ed9713456ab75bd8b34ed7fce7988d4284381cbe50","observation_id":"44775d27-2243-4374-b8be-bba113f3069f","resolution":{"observed_at":"2026-08-09T20:42:44.038874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-09T13:58:44.961855Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01976","last_updated":"2025-09-10T02:45:51Z","snapshot_observed_at":"2026-08-10T05:45:27.998309Z","submitted_at":"2025-02-04T03:36:44Z","title":"CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing","version":6},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T13:58:44.961855Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2502.01976"},"observation_digest":"sha256:28c2e75c85eccff54b0a21fa6fc95ca559806b7e750ee784e63beb32af496640","observation_id":"71ce0ee4-1c8f-4fda-92fe-3a28b33cd8b2","resolution":{"observed_at":"2026-08-09T13:58:44.961855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-07T14:55:45.134263Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20316","last_updated":"2025-05-23T02:25:26Z","snapshot_observed_at":"2026-08-08T08:33:09.022524Z","submitted_at":"2025-05-23T02:25:26Z","title":"Reinforcement Speculative Decoding for Fast Ranking","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:55:45.134263Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2505.20316"},"observation_digest":"sha256:c4defa32f3de77fee8519b1ce3960f2c5bd3e8ec741633fa4a55d11f6f84b4ec","observation_id":"5a260b83-81ef-4d10-b341-a15956c9039a","resolution":{"observed_at":"2026-08-07T14:55:45.134263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-07T13:02:10.146184Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23219","last_updated":"2025-06-10T01:54:59Z","snapshot_observed_at":"2026-08-08T16:15:30.488406Z","submitted_at":"2025-05-29T08:03:43Z","title":"Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:10.146184Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2505.23219"},"observation_digest":"sha256:bfdb96503e32cd0d04cb48d22a45356efe10a2f705ed1800731d038800886587","observation_id":"d0fb433f-8dc3-4c79-b65e-8b1912fdd96f","resolution":{"observed_at":"2026-08-07T13:02:10.146184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-07T12:35:10.136842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24196","last_updated":"2025-05-30T04:15:06Z","snapshot_observed_at":"2026-08-08T01:17:54.225702Z","submitted_at":"2025-05-30T04:15:06Z","title":"CLaSp: In-Context Layer Skip for Self-Speculative Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:10.136842Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2505.24196"},"observation_digest":"sha256:bf2ace25edfd3ba265ab7a0a2bf02ba0dd49ebc137d431d8d3867282ff606ea1","observation_id":"e8e408a9-3f68-4a6b-9d9b-66e4a7c6ea7e","resolution":{"observed_at":"2026-08-07T12:35:10.136842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-07T11:04:15.615129Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding.arXiv preprint arXiv:2402.12374, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03566","last_updated":"2025-06-04T04:30:30Z","snapshot_observed_at":"2026-08-09T11:34:13.037312Z","submitted_at":"2025-06-04T04:30:30Z","title":"POSS: Position Specialist Generates Better Draft for Speculative Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:15.615129Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2506.03566"},"observation_digest":"sha256:51209ff1ff1d3ce54448e55ee413ef56b2c1c34d28d1212e602382b48ebdd43d","observation_id":"c16b1021-5b22-406e-aa9f-66951e9de411","resolution":{"observed_at":"2026-08-07T11:04:15.615129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T22:05:26.619470Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22716","last_updated":"2025-06-28T01:52:50Z","snapshot_observed_at":"2026-08-06T21:57:22.791105Z","submitted_at":"2025-06-28T01:52:50Z","title":"BEST-Route: Adaptive LLM Routing with Test-Time Optimal Compute","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T22:05:26.619470Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2506.22716"},"observation_digest":"sha256:f95eedb72c3097d4cbf6633de6a45fa324215e23cad37a27eb618804ad829724","observation_id":"8bd3abf8-8249-48b8-942d-647eee2cf914","resolution":{"observed_at":"2026-08-06T22:05:26.619470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T14:42:56.148559Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.148559Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:c02d3ee0df4386d94d4dc872dcdef49aa96420b8856f3a4de69fe15d76bd2b7a","observation_id":"2b5560ce-9c21-4436-92ab-f9fec4d89794","resolution":{"observed_at":"2026-08-06T14:42:56.148559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2604.26412","last_updated":"2026-05-09T06:52:02Z","snapshot_observed_at":"2026-07-06T23:12:06.349884Z","submitted_at":"2026-04-29T08:25:01Z","title":"When Hidden States Drift: Can KV Caches Rescue Long-Range Speculative Decoding?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T11:08:25.132013Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2604.26412"},"observation_digest":"sha256:47d1b685c18cf3a5a4c8c7252d19419ee499048f708a46f3f556f726108c3523","observation_id":"6562a1fd-004e-427d-8313-e39ddc99c0db","resolution":{"observed_at":"2026-05-12T09:26:25.031764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2604.26412","last_updated":"2026-05-09T06:52:02Z","snapshot_observed_at":"2026-07-06T23:12:06.349884Z","submitted_at":"2026-04-29T08:25:01Z","title":"When Hidden States Drift: Can KV Caches Rescue Long-Range Speculative Decoding?","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T00:59:11.690911Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2604.26412"},"observation_digest":"sha256:e58f2583787e10b520b413cd7f602d720da4e91d5bad3ed28510977a682b9527","observation_id":"df2b6d36-4715-4033-9b8f-b01e22a84554","resolution":{"observed_at":"2026-05-12T08:36:23.911049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2605.12001","last_updated":"2026-05-12T11:50:15Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:50:15Z","title":"CR^2: Cost-Aware Risk-Controlled Routing for Wireless Device-Edge LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T04:55:10.714993Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2605.12001"},"observation_digest":"sha256:6d42f68827f274b85f4a782702323705e9cb69797c7286e4c965c361402442c8","observation_id":"42806ac7-c126-41fc-887e-9f56577700e0","resolution":{"observed_at":"2026-05-13T04:57:17.476800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2605.14978","last_updated":"2026-05-15T02:45:40Z","snapshot_observed_at":"2026-07-06T23:26:18.733776Z","submitted_at":"2026-05-14T15:41:57Z","title":"Performance-Driven Policy Optimization for Speculative Decoding with Adaptive Windowing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T16:40:17.370100Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2605.14978"},"observation_digest":"sha256:12442b2cb1959b2cefb545dd7369d407112f9cc96dd2db97e30467fca076cbde","observation_id":"988fca6a-bc69-4c7a-b112-bbb55a6987d8","resolution":{"observed_at":"2026-05-19T16:42:39.732462Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2605.29727","last_updated":"2026-05-28T10:21:34Z","snapshot_observed_at":"2026-08-02T01:53:53.633149Z","submitted_at":"2026-05-28T10:21:34Z","title":"Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:11.662084Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2605.29727"},"observation_digest":"sha256:c4966442f2d46543b2f6cbfcbede9ec1715ce569882ca1d0c73530b58252af06","observation_id":"48cf4a56-8d38-46e3-b4c2-528d048fa4b3","resolution":{"observed_at":"2026-06-29T08:53:15.751420Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2606.00535","last_updated":"2026-05-30T05:05:24Z","snapshot_observed_at":"2026-08-09T01:45:13.939348Z","submitted_at":"2026-05-30T05:05:24Z","title":"DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-06-28T18:55:51.474956Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2606.00535"},"observation_digest":"sha256:158155637393e24bc6b4c65e4a247c40428cdc7c3898aaa2d34be6fd136a48e2","observation_id":"107303cb-72e3-4c49-a2e1-198f9a4e2f38","resolution":{"observed_at":"2026-06-28T19:02:34.612384Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2606.04446","last_updated":"2026-06-03T04:48:00Z","snapshot_observed_at":"2026-08-07T01:21:46.551219Z","submitted_at":"2026-06-03T04:48:00Z","title":"D^2SD: Accelerating Speculative Decoding with Dual Diffusion Draft Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T04:51:28.419612Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2606.04446"},"observation_digest":"sha256:83820b6b952385e67b9365ef816e64bfae2768e08ad2f9e5d8b23fcbfd4341dc","observation_id":"0b5056c8-38e7-4d2a-b2e1-11655373fc27","resolution":{"observed_at":"2026-07-02T10:56:52.695567Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2606.12303","last_updated":"2026-06-10T16:40:18Z","snapshot_observed_at":"2026-08-06T21:12:26.166982Z","submitted_at":"2026-06-10T16:40:18Z","title":"From 2D Grids to 1D Tokens: Reforming Shared Representations for Multimodal Image Fusion","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-27T09:58:02.298704Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2606.12303"},"observation_digest":"sha256:9b1fac80ff951b85ec00bbfd8571946f8bb9e8a505d5d34f96acf46cf1407568","observation_id":"002ffb3f-9754-446c-8184-c2d8f7f99e89","resolution":{"observed_at":"2026-07-03T10:27:57.134688Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2606.24957","last_updated":"2026-06-23T08:51:20Z","snapshot_observed_at":"2026-08-06T21:01:25.213982Z","submitted_at":"2026-06-23T08:51:20Z","title":"Dustin: Draft-Augmented Sparse Verification for Efficient Long-Context Generation with Speculative Decoding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:58.636939Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2606.24957"},"observation_digest":"sha256:9db9c3921cf69f23ed8c697351733be6449a340dc0e6c78f20255920152f4d19","observation_id":"5bb77a62-e345-4888-b117-22dbdf2ac765","resolution":{"observed_at":"2026-07-04T16:49:58.015384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2606.25097","last_updated":"2026-06-23T19:06:42Z","snapshot_observed_at":"2026-08-02T20:00:46.182561Z","submitted_at":"2026-06-23T19:06:42Z","title":"Speculative Decoding at Temperature Zero: A Scoped Safety-Invariance Screen with a 48,072-Sample Expansion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T00:05:06.647295Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2606.25097"},"observation_digest":"sha256:813495b1353fed60a5a18d9db4f456ed9646c6a8d966e43e0713eb9d390c0ecc","observation_id":"4461339e-ed35-4fd6-8c97-9c8243cc06ca","resolution":{"observed_at":"2026-07-04T16:59:58.305364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":"2402.12374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-10T21:57:38.877082Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":"cs.CL","work_id":"cb83df8f-1cce-43a2-94c0-da1309e7dd25","year":2024},"citing_paper":{"arxiv_id":"2607.06763","last_updated":"2026-07-12T19:52:09Z","snapshot_observed_at":"2026-08-04T00:51:59.830713Z","submitted_at":"2026-07-07T19:48:36Z","title":"Trees from Marginals: Autoregressive drafting with factorized priors","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-10T21:49:34.512370Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2607.06763"},"observation_digest":"sha256:6dee2c447d723f5c48a3fa6eb0d29e1fdb764ff4aafb2b0096cdd68a59cc5534","observation_id":"833eb78a-1ee1-4d0d-be6a-9d4f0bec8023","resolution":{"observed_at":"2026-07-10T21:57:38.893570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-07-14T15:58:05.356765Z","title":"Sequoia: Scalable, Robust, and Hardware ­aware Specula­ tive Decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06763","last_updated":"2026-07-12T19:52:09Z","snapshot_observed_at":"2026-08-04T00:51:59.830713Z","submitted_at":"2026-07-07T19:48:36Z","title":"Trees from Marginals: Autoregressive drafting with factorized priors","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T15:58:05.356765Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2607.06763"},"observation_digest":"sha256:782dfadd736c2b8e51918d21217baacc6002a27954c8ffbb9b0afd1768f9e5e1","observation_id":"b9dedb55-c2b9-46f1-a5ad-17618170da72","resolution":{"observed_at":"2026-07-14T15:58:05.356765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-01T01:22:12.843921Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25852","last_updated":"2026-07-29T07:31:33Z","snapshot_observed_at":"2026-08-07T17:12:03.331999Z","submitted_at":"2026-07-28T15:25:05Z","title":"AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:22:12.843921Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2607.25852"},"observation_digest":"sha256:b2808aadc0767c178a1256cda58683ae09df4a85ed24e78aab0b6be2a346f680","observation_id":"9867d121-fb41-499d-ad4e-5a2fd5c66598","resolution":{"observed_at":"2026-08-01T01:22:12.843921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-01T10:55:32.079893Z","title":"arXiv preprint arXiv:2402.12374 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27269","last_updated":"2026-07-29T10:54:46Z","snapshot_observed_at":"2026-08-07T19:42:20.077952Z","submitted_at":"2026-07-29T10:54:46Z","title":"Beyond KV Reconstruction: Functional Reconstruction for MLA Draft Models in Speculative Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T10:55:32.079893Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2607.27269"},"observation_digest":"sha256:f1b76ad621e640a1ad8af73fb242cd819c2e672ab99cb6054945cdfdf28c49f8","observation_id":"a3de8ecb-b680-473d-be28-b5d77abdf3a5","resolution":{"observed_at":"2026-08-01T10:55:32.079893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-04T23:34:56.714038Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01651","last_updated":"2026-08-03T03:43:14Z","snapshot_observed_at":"2026-08-08T02:11:52.585692Z","submitted_at":"2026-08-03T03:43:14Z","title":"Bole: Efficient Tree Speculation for Hybrid-Attention Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T23:34:56.714038Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2608.01651"},"observation_digest":"sha256:0d7ea2c5d972beb6232425baeb03730a5e863da5e3d506b793f813d5927a76a5","observation_id":"41c3e34a-2038-4378-b496-0fa3be60e862","resolution":{"observed_at":"2026-08-04T23:34:56.714038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-05T19:02:12.568118Z","title":"Advances in Neural Information Processing Systems (","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03447","last_updated":"2026-08-04T10:45:24Z","snapshot_observed_at":"2026-08-09T14:12:21.093867Z","submitted_at":"2026-08-04T10:45:24Z","title":"Approximate Speculative Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T19:02:12.568118Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2608.03447"},"observation_digest":"sha256:092800b5be6abc7288450d279bbd68286564ff9b459a8753d189b194474e4f32","observation_id":"1c4fb294-1a60-40a8-8bdb-5c749b5ced11","resolution":{"observed_at":"2026-08-05T19:02:12.568118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T12:36:19.898830Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-09T17:20:53.488063Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.898830Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:47f761b39dfe59cab4b59996ffa65acbac5eff10422c1d17006438da75079e09","observation_id":"efa1ef77-0fb2-48ac-89d2-8614997cad04","resolution":{"observed_at":"2026-08-06T12:36:19.898830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-08T15:48:05.504790Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05303","last_updated":"2026-08-05T18:03:47Z","snapshot_observed_at":"2026-08-09T23:10:32.065952Z","submitted_at":"2026-08-05T18:03:47Z","title":"EdgeXpert: An Edge Device for Memory-Efficient LLM Inference with Mixture-of-Experts and Speculative Decoding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T15:48:05.504790Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2608.05303"},"observation_digest":"sha256:b0dff8ff5304ed8dbccc8b78e3df57846a8dd0e922215a5d50a941ce2956d70b","observation_id":"2055f79f-efb3-4781-b2ee-6dea2c53cc7a","resolution":{"observed_at":"2026-08-08T15:48:05.504790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.12374/citation-record","integrity":"/paper/2402.12374/integrity","json":"/paper/2402.12374/citation-record.json","paper":"/paper/2402.12374"},"outbound":[],"paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2402.12374."}