{"as_of":"2026-08-10T05:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fc29783f90f8599effe632b4b3522e8000206b19b3638103fa4e56f6b686b37","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T07:23:20.404741Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02438/citation-record","integrity":"/paper/2608.02438/integrity","json":"/paper/2608.02438/citation-record.json","paper":"/paper/2608.02438"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:16.343509Z","title":"Accelerating large language model decoding with speculative sampling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.343509Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:fb278819a7a4c568ad66d6a6b4dea1b773b9926af57d6d6e548a7f9cb81ee582","observation_id":"bb65e14f-356d-438b-aa19-12440cef62cd","resolution":{"observed_at":"2026-08-04T07:23:16.343509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17192","last_updated":"2023-05-18T20:28:20Z","snapshot_observed_at":"2026-08-08T11:03:33.403601Z","submitted_at":"2022-11-30T17:33:28Z","title":"Fast Inference from Transformers via Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17192","snapshot_observed_at":"2026-08-04T07:23:16.465713Z","title":"Fast inference from transformers via speculative decoding.ICML, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.465713Z"},"links":{"cited_paper":"/paper/2211.17192","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:52bf10a16b61277e343918a1c240fac483f3b306685e657406b9dbc0f06d7688","observation_id":"31944f9d-4ca3-47cc-8951-8a7e94369236","resolution":{"observed_at":"2026-08-04T07:23:16.465713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-04T07:23:16.584753Z","title":"Eagle: Speculative sampling requires rethinking feature uncertainty.ICML, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.584753Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:38ea98854d3243ceeb4bbd807c7ec2fc8813c8a9623838c1ea7d444f82dc5819","observation_id":"32725374-759c-4c20-857f-61aa21f03727","resolution":{"observed_at":"2026-08-04T07:23:16.584753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:16.730520Z","title":"Eagle-2: Faster inference of language models with dynamic draft trees, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.730520Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:eec2dee50c6aed6b4b6241fad4fafbaec7db317927f61e449a2508d174a6de0d","observation_id":"bab3872e-1e6c-40b3-b37c-0a21352a3589","resolution":{"observed_at":"2026-08-04T07:23:16.730520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:16.824759Z","title":"Eagle-3: Scaling up inference acceleration of large language models via training-time test, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.824759Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:a8c567cf9c34a929dfcdf5411ee42fff9acd3b909709ade5747ad2ad3970f505","observation_id":"87913380-dfdd-41d6-a51e-4a97d936ef52","resolution":{"observed_at":"2026-08-04T07:23:16.824759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06036","last_updated":"2026-05-28T09:13:25Z","snapshot_observed_at":"2026-08-03T04:09:50.707111Z","submitted_at":"2026-02-05T18:59:30Z","title":"DFlash: Block Diffusion for Flash Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06036","snapshot_observed_at":"2026-08-04T07:23:16.944748Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.944748Z"},"links":{"cited_paper":"/paper/2602.06036","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:e6bb3c8c46b7f7a734fa23ad18775037e3a6c5c490fb2ba4b4140a119ed6c203","observation_id":"9500b7d7-60ff-48d4-83f9-8ef4d409d431","resolution":{"observed_at":"2026-08-04T07:23:16.944748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.094835Z","title":"Fast-dllm v2: Efficient block-diffusion llm, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.094835Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:6f361c2734fbceb90a5a1ef6dc800970edc09bae5b68c8e1833a7c75eeb18599","observation_id":"a6274d55-a003-4fbd-965d-2eec69bfd038","resolution":{"observed_at":"2026-08-04T07:23:17.094835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.275081Z","title":"Tidar: Think in diffusion, talk in autoregression, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.275081Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:0fd002b053de11a0f9f9184dfce41c930f2c729ecc2d88c4f791c78de34c9aae","observation_id":"d5a673b1-4fe0-4ed5-a21d-024c4097561c","resolution":{"observed_at":"2026-08-04T07:23:17.275081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.364765Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.364765Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:acfb5102426978ebe4ebc36d093f039bc65b9715d39864a1bcbdb4cb098b7114","observation_id":"8f9412a3-5d1e-4f12-a11d-921a3d042750","resolution":{"observed_at":"2026-08-04T07:23:17.364765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12989","last_updated":"2026-04-14T17:23:14Z","snapshot_observed_at":"2026-08-06T01:59:43.470767Z","submitted_at":"2026-04-14T17:23:14Z","title":"Accelerating Speculative Decoding with Block Diffusion Draft Trees","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12989","snapshot_observed_at":"2026-08-04T07:23:17.415736Z","title":"Ringel and Y","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.415736Z"},"links":{"cited_paper":"/paper/2604.12989","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:043387b16652e919ba97286d93c303f94fe58de8437180c794c8148f698c3895","observation_id":"25a4b97a-1c19-4eb4-afa4-1efb1894225e","resolution":{"observed_at":"2026-08-04T07:23:17.415736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.545685Z","title":"Diffuspec: Unlocking diffusion language models for speculative decoding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.545685Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:4e091d90c9ba6f209a00be3c127c33b250c9921d401d0d0c98b663ca1ec9738b","observation_id":"c73768be-6966-4ba4-8e26-a1345a41f704","resolution":{"observed_at":"2026-08-04T07:23:17.545685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.804761Z","title":"Christopher, Thomas Hartvigsen, and Ferdinando Fioretto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.804761Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:5cbde5fa532ddbc20f117d34047fcacb11ca71d7f44bdf0404b760a8a439e7df","observation_id":"83864740-ff5e-4fbb-b97b-02e6685a7bb2","resolution":{"observed_at":"2026-08-04T07:23:17.804761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:18.014750Z","title":"Nemotron-labs-diffusion: A tri-mode language model unifying autoregressive, diffusion, and self-speculation decoding, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.014750Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:17e11ddf4bf37448daec2937c1e2bd0ec1af8e8934e441d55f103566c4bd1e6a","observation_id":"7ec57304-d725-4159-8917-dfa8b34ec191","resolution":{"observed_at":"2026-08-04T07:23:18.014750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:18.154780Z","title":"Jetspec: Breaking the scaling ceiling of speculative decoding with parallel tree drafting, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.154780Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:379202a46cade0a6f2b08f1cd9a89e58511f0716a883e5e5c3901d5a101a4568","observation_id":"081a25d9-63f9-47e2-a219-cde9a98e18c1","resolution":{"observed_at":"2026-08-04T07:23:18.154780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29707","last_updated":"2026-05-28T10:07:44Z","snapshot_observed_at":"2026-08-02T05:37:29.736109Z","submitted_at":"2026-05-28T10:07:44Z","title":"Domino: Decoupling Causal Modeling from Autoregressive Drafting in Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29707","snapshot_observed_at":"2026-08-04T07:23:18.317159Z","title":"Domino: Decoupling causal modeling from autoregressive drafting in speculative decoding","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.317159Z"},"links":{"cited_paper":"/paper/2605.29707","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:242ce04752a6997d78175cc4c29585a1f2403e771f4d213e4e2b25ac7f37a8e4","observation_id":"1800b6d9-bb29-45de-944e-bc5b6344f08f","resolution":{"observed_at":"2026-08-04T07:23:18.317159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05147","last_updated":"2026-07-06T14:28:06Z","snapshot_observed_at":"2026-08-10T04:42:28.132985Z","submitted_at":"2026-07-06T14:28:06Z","title":"DSpark: Confidence-Scheduled Speculative Decoding with Semi-Autoregressive Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05147","snapshot_observed_at":"2026-08-04T07:23:18.474757Z","title":"Cheng, X","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.474757Z"},"links":{"cited_paper":"/paper/2607.05147","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:a5b1f683f93724b48f8d735ab4aeb33533f84281a95d14e376ed70dd2fe97dd5","observation_id":"49c8122c-c595-4953-9ec2-72d46d1b47e2","resolution":{"observed_at":"2026-08-04T07:23:18.474757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09969","last_updated":"2026-05-11T04:20:04Z","snapshot_observed_at":"2026-08-02T06:56:43.284236Z","submitted_at":"2026-05-11T04:20:04Z","title":"The Truth Lies Somewhere in the Middle (of the Generated Tokens)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09969","snapshot_observed_at":"2026-08-04T07:23:18.614803Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.614803Z"},"links":{"cited_paper":"/paper/2605.09969","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:c6495a4a93ec4d66e5aec79699656ccbae811d8da21768334e8b4773937cd5b3","observation_id":"22e65202-db4c-442a-9f02-53624738ddf8","resolution":{"observed_at":"2026-08-04T07:23:18.614803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03629","last_updated":"2021-06-11T21:44:07Z","snapshot_observed_at":"2026-08-08T22:33:32.614060Z","submitted_at":"2020-02-10T10:11:31Z","title":"Accelerating Feedforward Computation via Parallel Nonlinear Equation Solving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03629","snapshot_observed_at":"2026-08-04T07:23:18.764751Z","title":"Accelerating feedforward compu- tation via parallel nonlinear equation solving.ICML, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.764751Z"},"links":{"cited_paper":"/paper/2002.03629","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:4c6dbc87ecd3ee65ddd0c57f644b314b4e5c44b5a3ba47695a7f49f804714644","observation_id":"229b6f30-b25d-4a83-b361-9cc9ffd72b07","resolution":{"observed_at":"2026-08-04T07:23:18.764751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:18.914754Z","title":"Santilli et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.914754Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:3edf2528c7fe8882b3ff43adeccf8de7b9ac7d391a07869aa7661dbb617f8033","observation_id":"bf6a6bdf-4d20-427b-98c3-30e88ca4fd79","resolution":{"observed_at":"2026-08-04T07:23:18.914754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00835","last_updated":"2024-06-13T08:41:28Z","snapshot_observed_at":"2026-08-09T21:40:29.985039Z","submitted_at":"2024-02-28T20:17:04Z","title":"CLLMs: Consistency Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00835","snapshot_observed_at":"2026-08-04T07:23:19.084749Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.084749Z"},"links":{"cited_paper":"/paper/2403.00835","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:a26c77cc734be2c128b440852c84e003989c3c6e8432b2cfd9e9704b9f677e3f","observation_id":"5ba658f3-2ebc-425f-b402-20624caf23cb","resolution":{"observed_at":"2026-08-04T07:23:19.084749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.233730Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.233730Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:81d421061c9a3d0a988f329341b77c643a7fe2bf860a1991fc61a408f2103e0a","observation_id":"94570b0a-d1cf-4371-bd4c-265e0972858d","resolution":{"observed_at":"2026-08-04T07:23:19.233730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.414749Z","title":"The perfect blend: Redefining rlhf with mixture of judges, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.414749Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:c6a212612a5066de84ea44b400c34d3ae73a0aeee60cd204f26ca6bbe4c3b504","observation_id":"9ecb00e8-f39a-4fac-82fa-d565069f2a9b","resolution":{"observed_at":"2026-08-04T07:23:19.414749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.574748Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.574748Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:15a63acc5625225d2028f1da7b6aa395a7fc0c3b8b73762fb877ff05d0f2861c","observation_id":"42971fdd-1f8e-4af2-9753-7de2c8f48e3e","resolution":{"observed_at":"2026-08-04T07:23:19.574748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.724749Z","title":"Let’s verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.724749Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:4a2ed1ab732a569afa7235eaf397cafcffc4008fb2d523ea01462b7a7c9737a4","observation_id":"2e50b42e-a483-4c63-b0cc-5b7f867046e4","resolution":{"observed_at":"2026-08-04T07:23:19.724749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.855175Z","title":"American invitational mathematics examination (aime).https://maa.org/ math-competitions/aime","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.855175Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:470c559f51a1635ef659ec0659f27068d5a73399432f68970fa4a7b31a097d6a","observation_id":"7b526c6f-b669-4162-abc3-4f074525c0ac","resolution":{"observed_at":"2026-08-04T07:23:19.855175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.936741Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.936741Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:ab4370effeaaff72741459d6bf90092aeda3236025043277c6ec0d1cc8a14752","observation_id":"24e21f02-9219-47ec-b631-348b350716cb","resolution":{"observed_at":"2026-08-04T07:23:19.936741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.087246Z","title":"Programsynthesis with large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.087246Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:e9370dc0a046ad7fd30c9e44807f0a423a76848f454a8676505663a8505e8ea5","observation_id":"f5be1667-749c-4018-a43c-f4d2c21867fb","resolution":{"observed_at":"2026-08-04T07:23:20.087246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.186333Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.186333Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:f359b270390a168dd0d4b8333f652e2b2a8f49dad0da0efffaacad211aa9595a","observation_id":"95e6b52d-23b3-47ce-a150-9ff74601c6ac","resolution":{"observed_at":"2026-08-04T07:23:20.186333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.320115Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.320115Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:6a8c0aeb097e94e850ed0566457ec11f118d103d4821e44b8254542ed8451205","observation_id":"49cab41b-d5fc-432f-aa59-dab035996870","resolution":{"observed_at":"2026-08-04T07:23:20.320115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.404741Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.404741Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:2a754f06f2fc496a28b7b362a5ca23fdcc6078a278e2a21d79524a175bd5608a","observation_id":"391b8900-4ad8-4306-8974-cd95a203c7b9","resolution":{"observed_at":"2026-08-04T07:23:20.404741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T04:42:40.825096Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2608.02438."}