{"as_of":"2026-08-05T01:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b15493d669752ae4d6000ed57a7f91437f571853851968826e21fccab00b4c26","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T21:32:41.428871Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.18967/citation-record","integrity":"/paper/2606.18967/integrity","json":"/paper/2606.18967/citation-record.json","paper":"/paper/2606.18967"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"ShareGPT_Vicuna_unfiltered","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:2ff470dc5da4ad7d12b0d1e90f632060340d2643899651d464102c85078ce769","observation_id":"401e0ff3-67fc-43ae-8181-4123737467e8","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Gqa: Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:8cfa0a70dddfabc86de9664278e971b84a66bebe082fa575800d8f3ee1c6ca9f","observation_id":"74a8250b-186d-43de-9914-e72701a9791c","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Qwen3-8B_eagle3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:a31d5055e917fe49dd05cdaa3fb2646c012cbd652794175a94539f4932a8817a","observation_id":"491c12e2-642f-4243-94bc-ba6578d1f919","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:bf056dbab0fa4fc71f22126fc75b7f743ccf9962f697c5693a8f473919357522","observation_id":"6b586df9-bb75-4094-b114-bf83e6d953f8","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13585","last_updated":"2025-06-16T15:08:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T15:08:02Z","title":"MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention","version":1},"cited_work":{"arxiv_id":"2506.13585","doi":"10.1109/tkde.2022.3168611","metadata_source":"pith","pith_arxiv_id":"2506.13585","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention","venue":"cs.CL","work_id":"c59fbe20-f41e-4140-a81c-40a12e7e8364","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2506.13585","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:df1a8f7cdac3fb062b099751256b4826a4ddc5e5c55c8b2c562a8efc0509c7c7","observation_id":"01a3e45a-ff06-4614-b9ad-7d31f4933a9c","resolution":{"observed_at":"2026-07-03T23:59:07.225539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":"2302.01318","doi":"10.48550/arxiv.2302.01318","metadata_source":"pith","pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-07-10T21:57:38.593329Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","venue":"cs.CL","work_id":"b53b11e5-8613-439d-9d9d-0e2a9090d79f","year":2023},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:9c530269208bce0b81f6da1b2a952f694cd3f35cb5686b56ac3fc48d1f33cb69","observation_id":"d52f6851-713c-4a7b-ae0e-951787e68ebe","resolution":{"observed_at":"2026-07-03T23:59:07.244700Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Clasp: In-context layer skip for self-speculative decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:a2d6e919f929d5b8fd657bde6ce8564a172c40a59356590c944597b71e628c09","observation_id":"2d1ea871-053f-44de-ac83-f4fa1cf6ea8a","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Respec: Towards optimizing speculative decoding in reinforcement learning systems","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:34d4122aac2af1290bf86fe26a1d699aab43a225af814e574f4d2daa2a3d273e","observation_id":"089ab0e4-1fe8-420c-80de-37333be75d7b","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Do NOT think that much for 2+3=? on the overthinking of long reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:1a86f1e23cd2bd127d5aed51031a9cdb89f735ef203c872117dd795966caf167","observation_id":"f8f1d795-b2f8-405d-946e-684de8676e8b","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:59:07.246466Z","title":"Jackpot: Optimal budgeted rejection sampling for extreme actor-policy discrep- ancy","venue":null,"work_id":"f0288666-a7a4-4813-8b9c-b580e1eda1e2","year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:0c6db5aecb0393a5d4c89e89c17bc3dac34412efc8c1d41e6a23c47a92b2ad22","observation_id":"f2e6d733-b962-4b59-a5ae-cfb53b81ce57","resolution":{"observed_at":"2026-07-03T23:59:07.249152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16362","last_updated":"2021-05-20T14:48:30Z","snapshot_observed_at":"2026-08-03T06:27:16.268656Z","submitted_at":"2020-06-29T20:28:52Z","title":"Multi-Head Attention: Collaborate Instead of Concatenate","version":2},"cited_work":{"arxiv_id":"2006.16362","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.16362","snapshot_observed_at":"2026-07-03T23:59:07.199652Z","title":"Multi-head attention: Collaborate instead of concatenate","venue":null,"work_id":"122d504b-cee2-47b2-afb8-f2bad267791e","year":2006},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2006.16362","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:471acb148dd288b776c7d2002e3939260e15b957c0bd4388c3448fd50265cc0e","observation_id":"096435c1-5ca0-491d-a364-d197d4d79e39","resolution":{"observed_at":"2026-07-03T23:59:07.202274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22617","last_updated":"2025-05-28T17:38:45Z","snapshot_observed_at":"2026-07-06T21:32:23.537939Z","submitted_at":"2025-05-28T17:38:45Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":"2505.22617","doi":"10.48550/arxiv.2505.22617","metadata_source":"pith","pith_arxiv_id":"2505.22617","snapshot_observed_at":"2026-07-10T21:57:38.198014Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","venue":"cs.LG","work_id":"d4b4aee4-d20f-4572-886a-4ba9ea6c9b81","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2505.22617","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:3d517c691b14922fc78f85e7ec5d00ff13581d88e371fd6a4fa5bb3a93841729","observation_id":"3a823961-1684-4781-9146-3824217df725","resolution":{"observed_at":"2026-07-03T23:59:07.282111Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"QLoRA: Efficient finetuning of quantized LLMs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:0a144082ae644f68a5e92fec7517c2462c6228d11d672a076e99bd2851663d58","observation_id":"df675402-2c1d-418b-839f-2afa0b89b328","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Marlin: Mixed- precision auto-regressive parallel inference on large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:97206f6af05bdd3748b11424c079202ac464419f95cdbc31b0b165312f59d559","observation_id":"61546bbc-5478-4c52-9caa-82cdb170d942","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"AREAL: A large-scale asynchronous reinforcement learning system for language reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:7705e578e5ee7f22ca3c279166b41b44b9d7dd0fe5fd5c4d86922a1dc361aadb","observation_id":"b815452b-940e-4eda-b942-618666a520a9","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Ai and memory wall.IEEE Micro, 44(3):33–39, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:1582b247d2d253d830b5624c550ac3fb4cb8ecc2f74eeffc7085dd44ac8030cd","observation_id":"7b66cd37-9c2f-478f-9b8e-7282c5f24bd6","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:6c1dbe104e44471804e294c1f2a9782da267568ae549e2166d38ec22096fa92d","observation_id":"b8c02048-5cc8-477a-91c0-3ef9024c4899","resolution":{"observed_at":"2026-07-03T23:59:07.245022Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:53a6eb17c5ed8184c938e51a3a238737bf2515754f6fd96621f21c0f9d08e1ea","observation_id":"5c0f9995-c7ac-4cd2-8fce-2a93d1c4be8f","resolution":{"observed_at":"2026-07-03T23:59:07.248890Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18588","last_updated":"2025-08-26T01:42:46Z","snapshot_observed_at":"2026-07-06T22:18:35.948728Z","submitted_at":"2025-08-26T01:42:46Z","title":"History Rhymes: Accelerating LLM Reinforcement Learning with RhymeRL","version":1},"cited_work":{"arxiv_id":"2508.18588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18588","snapshot_observed_at":"2026-07-03T23:59:07.264671Z","title":"History rhymes: Accelerating llm reinforcement learning with rhymerl","venue":null,"work_id":"2b77db42-385a-4db7-8b75-d164235015ec","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2508.18588","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:337afb33673b0f2ad69f08034606567d88469ef53e3965fd2f08529df41744ef","observation_id":"6ef0ae08-8da4-46f6-abff-172ecf02e0b6","resolution":{"observed_at":"2026-07-03T23:59:07.266551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Rest: Retrieval-based speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:cb466cb0634467a3a31cd5a3650daa8c635e6897b5af3515a2d89fe9475c9a81","observation_id":"03ddd7fb-1475-4523-a9e8-b943733a0d2f","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-07-10T16:57:24.565388Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:49e6d4a201bb9ff7e3a891ce4ef4246a14295f885bb0dfe0105fc45cf49921fa","observation_id":"df752bd7-8ba6-4da1-b2aa-69fea7e0ced5","resolution":{"observed_at":"2026-07-03T23:59:07.255776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Taming the long-tail: Efficient reasoning rl training with adaptive drafter","venue":null,"work_id":null,"year":1933},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:4895709639746340e70548a55f02583b27b7b39541dd0ad29ef9ead21a605489","observation_id":"c28e7810-ae48-440d-9e80-f589b2ddf503","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Ash, and Akshay Krishnamurthy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:c7b36bc3309707842cbcf4f9026d43310176a65780df7c510c37fcc4be6a446b","observation_id":"624c4b42-c59b-4bd6-aca8-64c5d12ac679","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:d295d07fda3cf07c2af51ae4d87a1c3bd4f6c7cab3824eb38ea1dcbeee3ae14f","observation_id":"b3239e70-32c3-48d7-8522-89eff86a266a","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26779","last_updated":"2026-04-29T15:11:48Z","snapshot_observed_at":"2026-07-06T23:12:24.456023Z","submitted_at":"2026-04-29T15:11:48Z","title":"Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding","version":1},"cited_work":{"arxiv_id":"2604.26779","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26779","snapshot_observed_at":"2026-07-03T23:59:07.262685Z","title":"Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding","venue":"cs.LG","work_id":"1bd4e816-a548-4988-ba3c-42e9e6f26e29","year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2604.26779","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:553640c1293f11a1a9e4fa48571ac5bd9de35cc3d3fbdd1a853e12a3014b6db5","observation_id":"e799e847-4719-458c-be4e-93a7cfa8cfac","resolution":{"observed_at":"2026-07-03T23:59:07.265004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.05993","last_updated":"2026-04-19T11:25:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-08T12:50:41Z","title":"Revisiting Entropy in Reinforcement Learning for Large Reasoning Models","version":3},"cited_work":{"arxiv_id":"2511.05993","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.05993","snapshot_observed_at":"2026-07-04T03:49:30.169449Z","title":"Revisiting Entropy in Reinforcement Learning for Large Reasoning Models","venue":"cs.CL","work_id":"80adc027-2a49-4795-af10-381a8bf9557c","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2511.05993","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:72d721bd7a4f7b52b5c2c157af22558c303ad7761a88b2566f9baba1af31fe65","observation_id":"f579feef-5ee2-4e77-a45a-40e2a210a6a1","resolution":{"observed_at":"2026-07-03T23:59:07.277857Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04146","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:09:37.898730Z","title":"Beyond next-token prediction: A perfor- mance characterization of diffusion versus autoregressive language models.arXiv preprint arXiv:2510.04146, 2025","venue":null,"work_id":"abde5593-9a36-4b36-b987-cfa9fa03e89f","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:ef6d8200a3c20f0a05112b39f58c4a7be6e6dab1c1778422651046723c4475dd","observation_id":"5824601c-62e8-4424-abff-11db2ac62598","resolution":{"observed_at":"2026-07-03T23:59:07.269288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21321","last_updated":"2025-03-24T09:34:38Z","snapshot_observed_at":"2026-07-06T20:44:35.837721Z","submitted_at":"2025-02-28T18:59:54Z","title":"LLM Post-Training: A Deep Dive into Reasoning Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.21321","doi":"10.48550/arxiv.2502.21321","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.21321","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"CoRR , volume =","venue":null,"work_id":"4c10bffb-560d-4de2-9f8e-b3290faa7d18","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2502.21321","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:70e12cfa7cc4837198a412b01f1228330f4ef54f1cbe8b13693ab8ab04676fc6","observation_id":"d9d72b58-3f14-4544-8534-ceba0ab01eca","resolution":{"observed_at":"2026-07-03T23:59:07.220274Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:118852729c400b844258de752098fb92b53a468bfd9f6b92353aa2cea0c5ef04","observation_id":"a0b4c0c4-8816-4b42-a26d-da55a68b3a1f","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:e8a58bbfc4c4554344b03f08a3b3047bfa342c5ec649b35e26197453cd510595","observation_id":"4e25db5c-46f8-452f-afea-d2eccd38ce2f","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"QuRL: Low-precision reinforcement learning for efficient reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:b0933a902855a7fd55ba150ac8edf90ec056211083e9d3ddd37ecd555523af9d","observation_id":"539fca33-6f90-4834-9ec0-911d5121f236","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"EAGLE: Speculative sampling requires rethinking feature uncertainty","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:604615df1cd5a07a888e9a32ec9e0b1268a2b7171b5ddbc389493309f5eaa083","observation_id":"6e84057a-ba8f-49e8-b30f-20eca83479c9","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"EAGLE-3: Scaling up inference acceleration of large language models via training-time test","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:bac4519f30a817f1aa02d59fca5a0ea8fdbecfd4cb97a8457d1e8f8f1af14141","observation_id":"689d5d5f-9169-458b-b169-558496cc64a4","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration.Proceedings of machine learning and systems, 6:87–100, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:4844892718863f3fe44e1249a12573734c387871670fc52484d83bea18357c21","observation_id":"033e901e-b131-4ae1-9a7f-f395d0defdfb","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":"2405.04434","doi":"10.1145/3593013.3594097","metadata_source":"pith","pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","venue":"cs.CL","work_id":"1e1df141-cac8-47fd-b068-c4c96e51e331","year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:bb6ead65961b3cc9eab6561ba6e7c01fea9b2356251d8d020bbe7434a00d8a22","observation_id":"aa27d7c8-80b4-486d-ad77-532f36c3f82a","resolution":{"observed_at":"2026-07-03T23:59:07.269924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:59:07.271123Z","title":"Spec-rl: Accelerating on-policy reinforcement learning with speculative rollouts.arXiv preprint arXiv:2509.23232, 2025a","venue":null,"work_id":"b46d9834-cc9a-48a8-83f1-1c63d863f199","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:6806030b3dfb2b4fa2e35f0af91fe85583a21b483a10996d78617ddcbef0a050","observation_id":"3a33f6f3-f0d3-477b-9a0d-a82932393ea7","resolution":{"observed_at":"2026-07-03T23:59:07.273259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Speculative decoding: Performance or illusion? InNinth Conference on Machine Learning and Systems, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:c7f19e0d36599c6f5d323f8db2f8a7f44bf28d875777c21160d39e640c383439","observation_id":"002875a9-3515-430f-951e-b0f587047687","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":"2503.20783","doi":"10.48550/arxiv.2503.20783","metadata_source":"pith","pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","venue":"cs.LG","work_id":"ec354f3b-9484-4a0c-94c8-92d4d0260835","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:080047e0dc48eba710de13dfc880f0ca33b04067e8456bc823c2281494c722c7","observation_id":"e04402bd-41bb-4253-b032-17af098dd397","resolution":{"observed_at":"2026-07-03T23:59:07.273927Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Qwen2.5-7B-Eagle-RL","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:6459940f9e393ae53b0c401dc8f6dbd9ea38b19e7031d1179250a77eb76b6806","observation_id":"b6d3321f-121a-4e6c-ba11-31d9858187dd","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"OpenThoughts2-1M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:fa217b33cbd71f12d093eb2cd3ce177a1748ee7fcb6a374da4f4c55543ee9582","observation_id":"3c7602ad-03e5-4fb9-9c58-1d7b1b9825a4","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Lossless acceleration of large language model via adaptive n-gram parallel decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:60af71ba2756a0c865bc11c55d8b193d0ca5f4777678aa174cb6fa760aa1d67f","observation_id":"f42b4ab3-400b-4482-a123-6f799ea2bce6","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Llama-3.1-8B-Instruct-speculator.eagle3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:4ce663ecdd92085feea7922674e53f064cb6a917baa1eb2ee6829d18b6213a02","observation_id":"6c35a01c-f8ba-4f29-9177-06cb39196d6c","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Qwen3-8B-speculator.eagle3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:404bbf8419d39e9e5418d55e37a1ca15d9c7133dbdfc8604e5e80968ee7a0366","observation_id":"aed89340-b385-42cd-9ae4-0bb4e88f518a","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Qwen3-8B-Thinking-speculator.eagle3","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:ddc3e2dd8d5eeaac00597253596426981670191283e01b2f28496dfa25d6856d","observation_id":"ec8d9786-dc88-43df-8f96-87e013c0998b","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Magicdec: Breaking the latency- throughput tradeoff for long context generation with speculative decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:e065ce40e170ee044ec219f099ea3c67f602570d5f7e702aaa52b9dccfb6fb1d","observation_id":"07ae8e72-244d-4f0c-a86e-79ab460cecc1","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:25bec777873892c2fd121bd32a08254b4bdfa7591796c0416e53077df1987a47","observation_id":"5162ea17-7fec-4162-9a11-328b89e201be","resolution":{"observed_at":"2026-07-03T23:59:07.196426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Beat the long tail: Distribution-aware speculative decoding for RL training","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:181f90b1935d83ede7d6b4ef169e52f283788049632ad0a09f7c0631e701fdfe","observation_id":"5eae0e86-037b-41b2-8f18-04404ee066ed","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:10955bdf84e3486e4dde533e0a22a75a14036159ea25f7367cf50838a0419cf6","observation_id":"d525bc95-f198-4347-a670-cfe530223610","resolution":{"observed_at":"2026-07-03T23:59:07.192273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":"1911.02150","doi":"10.48550/arxiv.1911.02150","metadata_source":"pith","pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-07-11T03:27:46.785958Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","venue":"cs.NE","work_id":"160ea164-b1d4-4adb-8ccb-a4655d8a0bb4","year":2019},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:9549a0e457f09e729339c12e2fae8db172cabf5873671836be8d01c104109a2d","observation_id":"74a57d62-c63a-4c76-927f-0ebce3fb9472","resolution":{"observed_at":"2026-07-03T23:59:07.200433Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:32de3fe737030ac4854b2e2ac27701409399887c5f847edf3a0a743a3904db3f","observation_id":"ad3e1935-6b89-458a-97bd-c92e83aee2d0","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-07-10T16:37:23.051852Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:794d3852067198ba595e8fb52b84a18c8756eaca031a1fadc41ee813131a8337","observation_id":"4a998feb-e360-4f50-abbd-524b958259e9","resolution":{"observed_at":"2026-07-03T23:59:07.221087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Knn-ssd: Enabling dynamic self-speculative decoding via nearest neighbor layer set optimization","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:66985c1485e262f85a65ed7e82c0b734e930b775f9b84fba6f798b0aa8a45a33","observation_id":"2c0eaa85-2e43-4fde-a8f1-1c490703b6b3","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03786","last_updated":"2024-11-06T09:23:50Z","snapshot_observed_at":"2026-07-06T19:46:02.181982Z","submitted_at":"2024-11-06T09:23:50Z","title":"The N-Grammys: Accelerating Autoregressive Inference with Learning-Free Batched Speculation","version":1},"cited_work":{"arxiv_id":"2411.03786","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.03786","snapshot_observed_at":"2026-07-03T23:59:07.186796Z","title":"The n- grammys: Accelerating autoregressive inference with learning-free batched speculation.arXiv preprint arXiv:2411.03786, 2024","venue":null,"work_id":"aaac3727-ae77-43ab-b519-9d9072e750f9","year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2411.03786","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:0ed149caab46be4fcf97085428a289e2f420e8809b34e5d307966b28f8cb739b","observation_id":"3b1b71bf-0513-4e60-9368-e20f9ecc045c","resolution":{"observed_at":"2026-07-03T23:59:07.188814Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"QUEST: Query-aware sparsity for efficient long-context LLM inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:b5f14d2c6a33a2adee0f765e861ed2a501205723c2e60b6a41d26363635ade11","observation_id":"591e8ae2-7f7b-4d52-99d0-b2491c32bbd1","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:0cc4e820c048905947f003a3851277d16fab6d9e88bbc110fa5d38f2190aaa1b","observation_id":"775e39a8-a16a-4cb1-8da9-ad2f6ad83792","resolution":{"observed_at":"2026-07-03T23:59:07.217202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Mahoney, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:89544c1895d9135e874fe2927a0331ec40a8021f17f393aa43331b1ce78888db","observation_id":"5e44f48a-6cfc-48c4-90a0-fed1cf1991bf","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Reinforcement learning with verifiable rewards implicitly incentivizes correct reasoning in base LLMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:80aafc92b3c1580690d4e4a49df31b927eaa28ba51b68d3ba44340b6044d1635","observation_id":"6bcbeb72-5cf0-4aeb-9c79-2e56942c88b5","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Roofline: an insightful visual performance model for multicore architectures.Communications of the ACM, 52(4):65–76, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:aef6f6c31b16e28edd5f24d14bad7123f33c5e13d2ae99ff6d66f8ba10ed0b41","observation_id":"5570306a-6e39-4318-be6d-bfd10c89c666","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:e2a7318b28ce2a3e1c4ed44a4a7e0a9c7bcd4132f5373dd0dce1fa28ac7000b6","observation_id":"2c9f3bfe-dd90-4519-9d1b-3385a3b5e572","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"SWIFT: On-the-fly self- speculative decoding for LLM inference acceleration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:8101efac52ce563e5df36fce52e5f43f525f96ad56ae07391e6fd8c1a2da6ed8","observation_id":"3f1fccc6-92c5-41b5-8ed2-9327557dccdf","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:8a0c3faeb020cd4a54610f5ad4ed3cc6ab677ec5365b0bbc064002b3ce874769","observation_id":"22659c0b-b384-40a3-a05f-660fe3ec4b88","resolution":{"observed_at":"2026-07-03T23:59:07.286798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.17871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:59:07.257949Z","title":"LLM Probability Concentration: How Alignment Shrinks the Generative Horizon","venue":null,"work_id":"b6cfbab4-4813-40b9-840a-26e378ad2ad8","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:e93cf4b46a2321f0ca49a4f1157257d70b8b0dbf87b8ab67ea7c25bb8c885243","observation_id":"3f83e017-9b04-43e7-8638-b5e75446d455","resolution":{"observed_at":"2026-07-03T23:59:07.260894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:0d41cb7ff19e0eb34b4f0bb9d9b85f8d016b472ce6443fe4c1e2bc76cdfb84c2","observation_id":"929eabc7-458a-4c90-9fdf-ffc2ba7be07e","resolution":{"observed_at":"2026-07-03T23:59:07.204186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"DAPO: An open-source LLM reinforcement learning system at scale","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:cc1eb0e887d2eb7be161ba1f88bcf5374c6025d6840617cc524cdc3a18af0b3c","observation_id":"32bc576d-d5fc-436c-afa3-67ba8ac95c74","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-01T22:52:35.092898Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":"2402.16363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-07-11T01:57:51.001945Z","title":"Llm inference unveiled: Survey and roofline model insights","venue":"cs.CL","work_id":"ab1b1623-49b9-406b-9b4a-f5de11424e01","year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:ec76813f526fe496cf3622a040a85dd0b40572d994a4e29ef678b7ec33314e4c","observation_id":"d58a23c3-f7e6-4a53-997d-a141d21b67c9","resolution":{"observed_at":"2026-07-03T23:59:07.177818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07223","last_updated":"2026-05-29T20:44:40Z","snapshot_observed_at":"2026-08-03T03:43:27.683465Z","submitted_at":"2026-02-06T22:12:52Z","title":"Vegas: Self-Speculative Decoding with Verification-Guided Sparse Attention","version":2},"cited_work":{"arxiv_id":"2602.07223","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.07223","snapshot_observed_at":"2026-07-03T23:59:07.184711Z","title":"Vegas: Self-Speculative Decoding with Verification-Guided Sparse Attention","venue":"cs.LG","work_id":"0eebe090-8fb6-4f32-a88a-8fcc1d27e016","year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2602.07223","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:7f14c8240c28128946c535dd89960ae6a8f57486b00cc3a0ace32895d1e9fdd6","observation_id":"41f815be-0c80-48af-91d9-4f25852e9020","resolution":{"observed_at":"2026-07-03T23:59:07.186895Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"EAGLE3-LLaMA3.1-Instruct-8B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:4cb91e64a638fbec86aa739340a854d26fe1812c33e2d23875892ba3579463b0","observation_id":"9f7c7221-9750-4376-9a02-c799102237f1","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-07-11T01:07:44.097694Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:9a4b084fe207c512d76e060a030dec9ceae3514a25638f2fb59aaddb30f8de3a","observation_id":"63714f56-12bb-4c06-a05f-6d7ee12f4b93","resolution":{"observed_at":"2026-07-03T23:59:07.290498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"SimpleRL-zoo: Investigating and taming zero reinforcement learning for open base models in the wild","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:2131032f3249ddb839572aa2574f521fe52169d83a2f27f1b1d439851f2bdd2f","observation_id":"273489d2-45c8-436a-86ad-a3e7d637df99","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Draft& verify: Lossless large language model acceleration via self-speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:98b63764bab583158f55bef2972bf3dd482d46e100907454ac25370aa67dc279","observation_id":"44ba7741-56cd-46cb-8991-406ebcc61ac3","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.23414","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:59:07.235718Z","title":"Sortedrl: Accelerating rl training for llms through online length-aware scheduling.arXiv preprint arXiv:2603.23414, 2026","venue":null,"work_id":"220a7195-6b72-4c2b-a622-c335e2d6f058","year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:6629f1d84cb4757ab99c93c318a8559c9fc0ac4e17c924c71bfdca9ef7ebdfb0","observation_id":"38ab0e32-9700-4cec-8cd9-fae29696699b","resolution":{"observed_at":"2026-07-03T23:59:07.237657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"FastGRPO: Accelerating policy optimization via concurrency-aware speculative decoding and online draft learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:0ec30793ea39f7575219c604aa2bd36b67d80a095248e0567a4891c7bdfb5ea7","observation_id":"6acab2f0-2517-49cb-9bd5-a122ac62e56c","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Kakade, Cengiz Pehlevan, Samy Jelassi, and Eran Malach","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:40215a70904b8d451d84bf4c9abce421b4214b54ba35f288d6b8916183727a84","observation_id":"1808f50c-6a46-4344-9807-5866e98943b9","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:4fefcd018d8211b09ad078b9bdc4e0f75b4bc74d138686122dd385b5a4ab382a","observation_id":"0834e3f0-9eed-415a-a7db-9437ded4256b","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:32:41.428871Z","title":"Distillspec: Improving speculative decoding via knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:84c1692cf1af80f5e268c61fa1b086aff107b319c7803e43daaf60a60a4af93b","observation_id":"f4e6a1f5-29bd-417a-94f0-b55b764beccb","resolution":{"observed_at":"2026-06-26T21:32:41.428871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.18521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:59:07.239475Z","title":"April: Active partial rollouts in reinforcement learning to tame long-tail generation","venue":null,"work_id":"1dbddb4e-72f6-4f75-b868-c94d9107fc2d","year":2025},"citing_paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-26T21:32:41.428871Z"},"links":{"citing_paper":"/paper/2606.18967"},"observation_digest":"sha256:ab4440b7f5e6f4c76a376982017ba27805f41f96de01bd6165714fe22b0b3d23","observation_id":"37327a86-a726-488a-8257-ecb4590938ee","resolution":{"observed_at":"2026-07-03T23:59:07.241728Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.18967","last_updated":"2026-06-17T11:51:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T03:11:43.085236Z","submitted_at":"2026-06-17T11:51:06Z","title":"EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":46,"verified_exact":28,"verified_fuzzy":0},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2606.18967."}