{"as_of":"2026-08-09T14:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e630bbaf6051222cf0fd1dd0d4b28f18cbd5616c7a25a4f3d48ba4cb8317ed9","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:14:51.048500Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.18016/citation-record","integrity":"/paper/2603.18016/integrity","json":"/paper/2603.18016/citation-record.json","paper":"/paper/2603.18016"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:46.600284Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:46.600284Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:a0914d99bc7234224fbd94400bd04734e1b9c7130e90b59ba939bfdce8cd19b3","observation_id":"a69c6223-3e02-438f-828d-83bc75e5164b","resolution":{"observed_at":"2026-08-02T21:14:46.600284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16369","last_updated":"2023-08-31T00:03:02Z","snapshot_observed_at":"2026-08-06T15:43:00.292272Z","submitted_at":"2023-08-31T00:03:02Z","title":"SARATHI: Efficient LLM Inference by Piggybacking Decodes with Chunked Prefills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16369","snapshot_observed_at":"2026-08-02T21:14:46.669096Z","title":"S., and Ramjee, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:46.669096Z"},"links":{"cited_paper":"/paper/2308.16369","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:c458bae37f5025cfc4326936ca95948379c2229261a38dee7116d24fa63fd947","observation_id":"1fe7abec-fc54-4930-b95b-570e5b69389c","resolution":{"observed_at":"2026-08-02T21:14:46.669096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:46.786173Z","title":"Sharegpt dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:46.786173Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:1d68cd6bfc92eaf3f0f07fe1d0b15403010cd76fde8fea9c3b28eaa5da41a70b","observation_id":"a3bce2f3-f5d4-45bc-8f8f-7d3d622eb094","resolution":{"observed_at":"2026-08-02T21:14:46.786173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:46.911164Z","title":"D., Chen, D., and Dao, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:46.911164Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:b5bab6955a978cca130a2c90a99216a3db493b1905ba640267152ed6535b6038","observation_id":"9b59e4c8-dbc5-4275-9cc0-58022c554d7d","resolution":{"observed_at":"2026-08-02T21:14:46.911164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09919","last_updated":"2024-12-13T19:50:19Z","snapshot_observed_at":"2026-07-06T17:44:58.325407Z","submitted_at":"2024-03-14T23:40:56Z","title":"Recurrent Drafter for Fast Speculative Decoding in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09919","snapshot_observed_at":"2026-08-02T21:14:47.037475Z","title":"Recurrent drafter for fast speculative decoding in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.037475Z"},"links":{"cited_paper":"/paper/2403.09919","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:f557eeef6795f9629fa032900db75f6b8ab02739b87b8abf0e1fd1f2ff474d0f","observation_id":"90208bc0-7082-4ed5-9efb-46549c373407","resolution":{"observed_at":"2026-08-02T21:14:47.037475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-02T21:14:47.147459Z","title":"X., Gao, H., Chen, D., Li, J., Zeng, W., Yu, X., Wu, Y., Xie, Z., Li, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.147459Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:40461b5678a8d7e3e04643d4c5fc2a3670d54266150945e8a5d512d27f40b7b9","observation_id":"9bc5af93-b56f-45c4-b4d8-8584ea99e97d","resolution":{"observed_at":"2026-08-02T21:14:47.147459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T21:14:47.254920Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.254920Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:1e77555b249c2cace35650cfc53850ade068dc1502e1ea6ff313ef0c52a99ab7","observation_id":"a042fb18-1d7f-4ee5-840e-dc4913762615","resolution":{"observed_at":"2026-08-02T21:14:47.254920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:47.407048Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.407048Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:c2054cfdf40da1573c8dd72887f239142aedb9fe0d77ce914fba255519448af9","observation_id":"cdba3d89-b08e-48d2-ae5b-0b62c228a920","resolution":{"observed_at":"2026-08-02T21:14:47.407048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:47.526576Z","title":"Specserve: Efficient and slo-aware large language model serving with adaptive speculative decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.526576Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:66ce0b4294f7ec80e6a332b40f8dbcb99214f7cce70889cde8bd7ce58bc81528","observation_id":"e33df120-8630-4d14-b205-c7a1738320fe","resolution":{"observed_at":"2026-08-02T21:14:47.526576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:47.624918Z","title":"Transformers v4.53.3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.624918Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:6db2a2250152cb66f7a196468e79ea684cd0c4969d60d2830af7945840a596bc","observation_id":"75ebd1ac-313e-4d96-b7ed-013763a93896","resolution":{"observed_at":"2026-08-02T21:14:47.624918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:47.739237Z","title":"ibnzterrell/meta-llama-3.3-70b-instruct-awq-int4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.739237Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:c4abe46946daf9db62c3eefc4a573507cd97fa51e5ae242164350b65be26f77f","observation_id":"cc54fd00-c9f8-43a8-a85e-b2442afe863d","resolution":{"observed_at":"2026-08-02T21:14:47.739237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:47.913177Z","title":"H., Gonzalez, J., Zhang, H., and Stoica, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:47.913177Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:8ee193bb5f0da86d1f7070a33ad46aaa6d6773e6ee85756c76f24eca765ec304","observation_id":"b6a656f7-5fc2-4da8-a191-4c388593195e","resolution":{"observed_at":"2026-08-02T21:14:47.913177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:48.072409Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.072409Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:d8b73294f17097fe840612e36e42fd61a3b5ae490ae598100958a6927b035b0f","observation_id":"c3876205-edbf-4a5c-afe9-93f9f1261392","resolution":{"observed_at":"2026-08-02T21:14:48.072409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:48.196174Z","title":"EAGLE : Speculative sampling requires rethinking feature uncertainty","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.196174Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:92a5e0b7dfe7fbfe18366efd1d6158e88cec69eba729f427b38fad0b7a404b44","observation_id":"d4947ebe-87da-4ed8-90e7-abb46008b96a","resolution":{"observed_at":"2026-08-02T21:14:48.196174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:48.356425Z","title":"EAGLE -2: Faster inference of language models with dynamic draft trees","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.356425Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:ec51f4a6319f8a0d0325d33ad920915cfac162ba2223fe2214cb66fdf89c0048","observation_id":"ad033fcc-896e-44f6-b886-6ccb33468e56","resolution":{"observed_at":"2026-08-02T21:14:48.356425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01840","last_updated":"2025-04-23T07:08:17Z","snapshot_observed_at":"2026-07-06T20:45:55.263034Z","submitted_at":"2025-03-03T18:59:04Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01840","snapshot_observed_at":"2026-08-02T21:14:48.491243Z","title":"Eagle-3: Scaling up inference acceleration of large language models via training-time test","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.491243Z"},"links":{"cited_paper":"/paper/2503.01840","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:a51685530bcb2c789702e28cc1c368dc68895374b3f78392b5bf6b9b7f6c4a4b","observation_id":"0f8f9bde-28a3-49b5-bc53-db2b10fb0651","resolution":{"observed_at":"2026-08-02T21:14:48.491243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12162","last_updated":"2025-05-17T07:09:10Z","snapshot_observed_at":"2026-08-05T21:38:55.998982Z","submitted_at":"2025-01-21T14:15:01Z","title":"AdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12162","snapshot_observed_at":"2026-08-02T21:14:48.629742Z","title":"Adaserve: Accelerating multi-slo llm serving with slo-customized speculative decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.629742Z"},"links":{"cited_paper":"/paper/2501.12162","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:35c95bc300f1cb0241a2384939546194ed412910ab08e13836aec6c4fdd29969","observation_id":"6722a6bf-1307-4619-a1e6-304ebba110c7","resolution":{"observed_at":"2026-08-02T21:14:48.629742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:48.746466Z","title":"PEARL : Parallel speculative decoding with adaptive draft length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.746466Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:46e1cb2ab6ab66f5e83e59d7f40ad7b479f6156f47316a603ff4a5effba55a4e","observation_id":"d534511e-9e55-458b-a9dd-25cf9b231862","resolution":{"observed_at":"2026-08-02T21:14:48.746466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14066","last_updated":"2025-07-27T03:20:41Z","snapshot_observed_at":"2026-07-06T18:34:03.037351Z","submitted_at":"2024-06-20T07:43:33Z","title":"TurboSpec: Closed-loop Speculation Control System for Optimizing LLM Serving Goodput","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14066","snapshot_observed_at":"2026-08-02T21:14:48.916679Z","title":"Turbospec: Closed-loop speculation control system for optimizing llm serving goodput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:48.916679Z"},"links":{"cited_paper":"/paper/2406.14066","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:a376f4a6a1b30cb8bb034aa3c64842b08dfd4230ba8876ceec784bef808f96c6","observation_id":"4d6cfdfc-82f7-484e-b7f3-8669c44dbdaa","resolution":{"observed_at":"2026-08-02T21:14:48.916679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.052378Z","title":"NVIDIA Nsight Systems 2024.2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.052378Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:f1f7352b1e9b8a5ee39605ee0ab86140598f0ffb1067e8f7b887c7b77e3bc291","observation_id":"2db38151-d015-48e6-a8ae-808ede11aafc","resolution":{"observed_at":"2026-08-02T21:14:49.052378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.163280Z","title":"Suffixdecoding: Extreme speculative decoding for emerging ai applications","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.163280Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:f206243e92608dde3211e44240428a3d2f780ef46d58247fd318a1652b634d98","observation_id":"b58c61b5-a5b7-40b3-8993-285bbda241c0","resolution":{"observed_at":"2026-08-02T21:14:49.163280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.273155Z","title":"Pytorch 2.7.0","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.273155Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:5dc48953bd42f758892e2c061353c9c652ab1b1218c2df8de3c0efdad1a0ada3","observation_id":"8dc45b6c-153e-401d-b5e2-27e2d4685cc8","resolution":{"observed_at":"2026-08-02T21:14:49.273155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13157","last_updated":"2024-11-27T03:25:44Z","snapshot_observed_at":"2026-08-05T08:43:18.453409Z","submitted_at":"2024-11-20T09:46:30Z","title":"Closer Look at Efficient Inference Methods: A Survey of Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13157","snapshot_observed_at":"2026-08-02T21:14:49.396548Z","title":"and Kim, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.396548Z"},"links":{"cited_paper":"/paper/2411.13157","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:1dc96d6c5ead84d43549b04454036a0c1db247188e650aa916ec62fc6bc1f32a","observation_id":"1e4581c2-f0a9-4a66-ac11-d89c5b5ce6e1","resolution":{"observed_at":"2026-08-02T21:14:49.396548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.542832Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.542832Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:353ef673aa5bafc133dba6453c5c21452663e744b0d071ff83fd62f5d8b491a1","observation_id":"abf001af-1e76-4868-af25-779fd8ccd8a4","resolution":{"observed_at":"2026-08-02T21:14:49.542832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.663480Z","title":"Distributed speculative inference ( DSI ): Speculation parallelism for provably faster lossless language model inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.663480Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:e7de5693e1900f31788dbbe5c62847ef378971921986d322d22c5c228ebd105b","observation_id":"40505f20-96ee-4095-9f69-9daaa04512a8","resolution":{"observed_at":"2026-08-02T21:14:49.663480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.791536Z","title":"[performance]: vllm eagle performance is worse than expected","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.791536Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:c104573c67782c4dd8037623a39db44812d293fbab945343f566b821665a2a80","observation_id":"84c3e34a-924f-4d06-8687-964e55e632fb","resolution":{"observed_at":"2026-08-02T21:14:49.791536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:49.904704Z","title":"vllm v0.9.2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:49.904704Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:42d1838b7db6673a3d9c975c7b42a1b7a3af355b96dadb55665dc0f426484ce7","observation_id":"525a5462-fea4-48d9-a2ae-a18be2bd0aa0","resolution":{"observed_at":"2026-08-02T21:14:49.904704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:50.122042Z","title":"OPT -tree: Speculative decoding with adaptive draft tree structure","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.122042Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:294ae4ca0c6dbfd01a176d2d44c5f55b366dfd9e6afc2032c6741a05b3ca1c37","observation_id":"6c4b610e-ef0b-44f1-9a79-82e169f1ce40","resolution":{"observed_at":"2026-08-02T21:14:50.122042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15678","last_updated":"2024-10-30T02:10:46Z","snapshot_observed_at":"2026-07-06T17:34:49.001670Z","submitted_at":"2024-02-24T01:45:35Z","title":"Minions: Accelerating Large Language Model Inference with Aggregated Speculative Execution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15678","snapshot_observed_at":"2026-08-02T21:14:50.222538Z","title":"Minions : Accelerating large language model inference with aggregated speculative execution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.222538Z"},"links":{"cited_paper":"/paper/2402.15678","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:aa612c27eee417ebedb58215f61c05cee8c06250679277f130424d6150b868b2","observation_id":"495bec5c-218c-4941-a7c9-27b0094c92b0","resolution":{"observed_at":"2026-08-02T21:14:50.222538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:50.340335Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.340335Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:fdbf45f4ef8364c2876b4fec61a30de462321eca2ed7a950207a9caf554f3c1b","observation_id":"1460c91f-5374-4f7a-a1ba-68558e4f1b07","resolution":{"observed_at":"2026-08-02T21:14:50.340335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:50.472687Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.472687Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:2b015c678ed1a57df00b9faab0df7304b1836ebbb2e3fe96f6f463033d4f0f30","observation_id":"68231890-d1ee-4f21-be50-100e38d583e2","resolution":{"observed_at":"2026-08-02T21:14:50.472687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05589","last_updated":"2024-10-08T01:05:08Z","snapshot_observed_at":"2026-08-06T14:56:30.087964Z","submitted_at":"2024-10-08T01:05:08Z","title":"ParallelSpec: Parallel Drafter for Efficient Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05589","snapshot_observed_at":"2026-08-02T21:14:50.581257Z","title":"Parallelspec: Parallel drafter for efficient speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.581257Z"},"links":{"cited_paper":"/paper/2410.05589","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:51f84a8171e6d0c319bef4f0b7e5c68e7f580ef4d31e33f16e7e8f56faf0fca2","observation_id":"4faeb111-b210-48ae-afd5-42d1a5d5ffcc","resolution":{"observed_at":"2026-08-02T21:14:50.581257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T21:14:50.671835Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.671835Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:c6c7b9658f60d844f2a53b3930ac8aa5b7abb73cdffa4a2dd61e4726a2c0e449","observation_id":"33fecf6e-5328-4b72-b60b-df007142ea84","resolution":{"observed_at":"2026-08-02T21:14:50.671835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:50.763821Z","title":"Llm-tough-questions dataset: A collection of complex questions across 100 domains","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.763821Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:ae906c34036de6d52d2f7869891a64f439bb9ce8432a84c1aa66d74da5802980","observation_id":"c038e494-dc7d-4dab-a8b6-3e380776e45c","resolution":{"observed_at":"2026-08-02T21:14:50.763821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:50.839904Z","title":"S., Kim, G.-W., Kim, S., and Chun, B.-G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.839904Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:55738b8b0de64216801add96b92ec8cca0f00917b9f6825ebde1a6b3e7f6de58","observation_id":"758d793c-0b58-4959-ae17-1fc0ca9dd364","resolution":{"observed_at":"2026-08-02T21:14:50.839904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:50.941081Z","title":"Draft & verify: Lossless large language model acceleration via self-speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:50.941081Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:eddcad3cc18e926da48a162c270a942075f66748d2b02d77cff4ecd70c581c88","observation_id":"720e337c-508e-409e-bc07-bbbe1b19e5d4","resolution":{"observed_at":"2026-08-02T21:14:50.941081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:14:51.048500Z","title":"E., and Stoica, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T21:14:51.048500Z"},"links":{"citing_paper":"/paper/2603.18016"},"observation_digest":"sha256:f2940a1f142fc0f938f316b705076f710eefd2b8bc117c31425f273e69c8faf3","observation_id":"0acec2aa-c140-4ca7-ba60-34a9ff906c32","resolution":{"observed_at":"2026-08-02T21:14:51.048500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.18016","last_updated":"2026-06-01T17:56:47Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T14:28:28.848023Z","submitted_at":"2026-02-24T17:24:50Z","title":"MineDraft: A Framework for Batch Parallel Speculative Decoding"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2603.18016."}