{"as_of":"2026-08-06T06:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e04e17769335af813f6461f5ffb05405feecc20a7945c6ccc1671b1c29858342","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:23:13.071107Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.08862/citation-record","integrity":"/paper/2605.08862/integrity","json":"/paper/2605.08862/citation-record.json","paper":"/paper/2605.08862"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Polaris: A post- training recipe for scaling reinforcement learning on ad- vanced reasoning models, 2025.URL https://hkunlp","venue":null,"work_id":"8cfad05d-17ea-4c5c-9812-aac57cd628ec","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:9896c5e5bd48a5fa252554b54692677d6cdaeb436f16fc7e12fa5f47f345a813","observation_id":"e05570b8-bc9a-4e10-a03d-c3e6e8b59ed5","resolution":{"observed_at":"2026-05-14T07:24:49.626886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-03T23:07:15.667650Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":"2402.05109","doi":"10.48550/arxiv.2402.05109","metadata_source":"pith","pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hydra: Sequentially-dependent draft heads for medusa decoding","venue":"cs.LG","work_id":"e51f556b-4111-49b3-96b0-6191c097ea33","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:48bdb27d93e316a6c5c6927ceb9f2cf4f8a23e62393d7f2c7a70f82bb9eb7372","observation_id":"5100b6ed-3547-4220-9fd4-f64ec2cdb5be","resolution":{"observed_at":"2026-05-12T08:01:30.715459Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:d2551b026a58bb1e153255dbeff2ec2b9d57ca5d3dc507dbdcb9ca6060e7e353","observation_id":"47ed2012-08f6-4c70-8cce-43db2b63052c","resolution":{"observed_at":"2026-05-12T08:01:30.903338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":"2401.10774","doi":"10.48550/arxiv.2401.10774","metadata_source":"pith","pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","venue":"cs.LG","work_id":"f6202cd1-1a78-4c19-8242-688acf4952b6","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:85331319d6a4b18223143abcb340750ba952f9906d7eca75c28f7772044e473d","observation_id":"fe2067c4-2c78-4ae1-81d8-15965985ecca","resolution":{"observed_at":"2026-05-13T10:36:18.892007Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":"2505.24298","doi":"10.48550/arxiv.2505.24298","metadata_source":"pith","pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","venue":"cs.LG","work_id":"60017c83-cbbd-4807-b8e4-f8149a6aeaf0","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:4c6e6a18147fcf72d98a21b97533873ef904627eb5c8f287588251d6eab991b2","observation_id":"8d917e05-0452-4a23-8e23-8177d57a79de","resolution":{"observed_at":"2026-05-15T14:24:22.137431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20347","last_updated":"2025-12-01T12:02:46Z","snapshot_observed_at":"2026-08-05T19:35:12.428969Z","submitted_at":"2025-11-25T14:25:19Z","title":"Soft Adaptive Policy Optimization","version":2},"cited_work":{"arxiv_id":"2511.20347","doi":"10.48550/arxiv.2511.20347","metadata_source":"pith","pith_arxiv_id":"2511.20347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Soft Adaptive Policy Optimization","venue":"cs.LG","work_id":"2d2c49f8-7feb-48c2-af7e-025b94c5d4f9","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2511.20347","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:9067e907e4d1d974ee1a22c78ec861da0d85dad46dae04f8dbfa2021f08722f2","observation_id":"32b95ca7-e9dc-4256-933a-b5ab4e5aecab","resolution":{"observed_at":"2026-05-15T07:14:32.897338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18588","last_updated":"2025-08-26T01:42:46Z","snapshot_observed_at":"2026-08-05T16:20:23.166001Z","submitted_at":"2025-08-26T01:42:46Z","title":"History Rhymes: Accelerating LLM Reinforcement Learning with RhymeRL","version":1},"cited_work":{"arxiv_id":"2508.18588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18588","snapshot_observed_at":"2026-07-03T23:59:07.264671Z","title":"History rhymes: Accelerating llm reinforcement learning with rhymerl","venue":null,"work_id":"2b77db42-385a-4db7-8b75-d164235015ec","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2508.18588","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:90918c793c068554589a9185c0ee2d19500bd1061c780de20df179ca52eafb76","observation_id":"ea386b91-1233-496f-a36f-0bf3911ab6ef","resolution":{"observed_at":"2026-05-12T08:01:30.843384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-07-31T12:28:37.704994Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":"2405.11143","doi":"10.48550/arxiv.2405.11143","metadata_source":"pith","pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","venue":"cs.AI","work_id":"70fa48c9-2f84-49f6-9aca-37476e021fc3","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:ecfc847c6c706362064ec791d772ce24f2f6f2ad2ac1f2cc5bbb1515e6549a01","observation_id":"f1b05fe5-3698-47e2-8fc0-1362b22e2cac","resolution":{"observed_at":"2026-05-15T03:28:57.414349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.16665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T02:49:24.711707Z","title":"Taming the long-tail: Efficient reasoning rl training with adaptive drafter.arXiv preprint arXiv:2511.16665","venue":null,"work_id":"f9f16138-08bb-4443-895d-1070993b7545","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:9869e1ad3f0ba757123d3808a5d9925223a433f6162081972106c327750a7f17","observation_id":"af40d67d-8f32-42b6-8d77-c2325c8385e9","resolution":{"observed_at":"2026-05-12T08:01:30.894242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:b75d8226de54d1b0afa8592a8ef9adc199c9a0019eebb74d207ce22fcd2d227d","observation_id":"6a00875e-4e0d-479b-a8a8-3abf1ebd103a","resolution":{"observed_at":"2026-05-12T08:01:30.787686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-07-29T18:39:02.141391Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":"2310.06452","doi":"10.48550/arxiv.2310.06452","metadata_source":"pith","pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","venue":"cs.LG","work_id":"13d47639-3500-414f-b6ea-1f277577ad3b","year":2023},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:2485ad59b038504755e287f3b07591a33ae6669309f287993c6f6292be08c5b6","observation_id":"3f2f4a67-2f64-4c34-8b46-44c4e5e3ebbb","resolution":{"observed_at":"2026-05-19T02:34:44.407176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":"2401.15077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-07-10T21:57:38.979373Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","venue":"cs.LG","work_id":"9d4637dd-1cab-4f10-82d4-8c8d14bb96ed","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:244ec250ffb747643811cfaf143d5d1193f5011b3832b02288af85670f9fbb56","observation_id":"914c09ce-b2cc-4343-875f-9fa281a1dc1e","resolution":{"observed_at":"2026-05-15T00:15:49.524886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01840","last_updated":"2025-04-23T07:08:17Z","snapshot_observed_at":"2026-07-06T20:45:55.263034Z","submitted_at":"2025-03-03T18:59:04Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","version":3},"cited_work":{"arxiv_id":"2503.01840","doi":"10.48550/arxiv.2503.01840","metadata_source":"pith","pith_arxiv_id":"2503.01840","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","venue":"cs.CL","work_id":"323c1b68-aec5-4444-944f-155a771bd8c6","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2503.01840","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:0e82993408cf85b9ef57129f53722bdf595765f220634143716b4b73d4835cb5","observation_id":"0d7ffdfa-24d6-45e9-ac6b-83cbffc4dd0f","resolution":{"observed_at":"2026-05-15T18:52:19.804345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:59:07.271123Z","title":"Spec-rl: Accelerating on-policy reinforcement learning with speculative rollouts.arXiv preprint arXiv:2509.23232, 2025a","venue":null,"work_id":"b46d9834-cc9a-48a8-83f1-1c63d863f199","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:ca6653af27496258430e2cc55cf390eda1a595ac97acf56ab4ac3007f9cf0d39","observation_id":"38067cc4-94fc-4f5a-a2ee-f5eda571a40a","resolution":{"observed_at":"2026-05-12T08:01:30.959383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Faithful chain- of-thought reasoning","venue":null,"work_id":"2dc033df-e4a3-47f8-9485-730f2e8723d2","year":2023},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:eaba750b26132b5dbdb080684aa38d6f89f6461a4f7922112774ff9aa44d79a9","observation_id":"ec2eace2-6a9f-4f50-bb0c-25f4a22b274b","resolution":{"observed_at":"2026-05-14T07:24:49.631190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.26788","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T05:59:38.002040Z","title":"Defeating the training-inference mismatch via fp16","venue":null,"work_id":"0130b8e1-ddae-4ab2-b584-1de5b6918454","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:194892d963905d6686e1121a792a144641c44a5798a73c8b051b4ae3c67dcce5","observation_id":"ed7516dc-0572-481a-b551-4871e40c5470","resolution":{"observed_at":"2026-05-12T08:01:30.993342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:3e0e9d42bca044f9e30567874f0d63cdc02ddd108bb837c59d319ab7652d67f0","observation_id":"5ba84f2b-f5dc-457e-aafc-24365278e0ca","resolution":{"observed_at":"2026-05-12T08:01:30.924069Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:05dbe62c7507480af061ab8573c53b843df7e884310a99c12bec0166833c95a8","observation_id":"9c561d49-c98d-4e75-9a09-5e0ab25d70db","resolution":{"observed_at":"2026-05-12T08:01:30.936203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":"2501.12599","doi":"10.48550/arxiv.2501.12599","metadata_source":"pith","pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","venue":"cs.AI","work_id":"bff96ab1-bd6a-4585-be23-74fdb51969c7","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:d39ec190a7ccbbb50435a0ce0c0f967032d02fffb5f44b8ffd366c1ce07c66d8","observation_id":"711743ff-97a3-423d-aea1-7aa6529bb2a3","resolution":{"observed_at":"2026-05-12T08:01:30.969467Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.585868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.14243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T22:05:06.238916Z","title":"Jet-RL: Enabling on-policy FP8 reinforcement learning with unified training and rollout precision flow.arXiv preprint arXiv:2601.14243","venue":null,"work_id":"65f6e86b-21f3-4e45-a09d-437dafb9fa4f","year":2026},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:4edb4085bad670c4c137bf309a912e55b7074f912997ffaf73184b6171cf688b","observation_id":"a1fd7f19-e681-4c2e-b9c0-38c35549ed28","resolution":{"observed_at":"2026-05-12T08:01:30.749988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6672.2025","doi":"10.1109/rtss66672.2025.00038","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jones, Zheng Dong, and Peipei Zhou","venue":null,"work_id":"2db14621-f864-4734-9e07-313190f6f3df","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:8105e6f3d1dcc553876b85f610df712c3c55a88b0290393b888fea00ac57a4dd","observation_id":"95ecc842-2b36-4188-b412-707249b926f4","resolution":{"observed_at":"2026-05-12T01:26:16.160665Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gen- eration meets verification: Accelerating large language model inference with smart parallel auto-correct decod- ing","venue":null,"work_id":"04d43165-842e-4151-9614-ab5ae1276123","year":2024},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:c7ab2371534b852c5481e6cc32ce2862f40b3af61ca9ac8672a96074b973601b","observation_id":"7cc00459-56c1-4fde-b935-6ce7b469bc7e","resolution":{"observed_at":"2026-05-14T07:24:49.635744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:aa3c4893d37792d26706cd0e2eb4a9a9bc87d8838ea6c41e70117d8d5a598476","observation_id":"b09292b2-e795-4a3b-aedc-887f4605f136","resolution":{"observed_at":"2026-05-12T08:01:30.740386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":"2503.18892","doi":"10.48550/arxiv.2503.18892","metadata_source":"pith","pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","venue":"cs.LG","work_id":"94a68437-02e7-425a-91b2-5846ddcbd38c","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:ba4ae7ead777702234dcf1782cd28eff3112cb62f48497870fea29ed5ef32326","observation_id":"f6446d80-5e02-4200-b38d-980f0fa53438","resolution":{"observed_at":"2026-05-13T08:21:05.971096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-08-06T04:31:03.113409Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":"2507.18071","doi":"10.48550/arxiv.2507.18071","metadata_source":"pith","pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Group Sequence Policy Optimization","venue":"cs.LG","work_id":"3a98b53b-9f52-4d95-adf7-89353c0a9a65","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:f297b45deab40cf2f0e308debf4c8816bc57c9ba076243788e1ff49d08d942e0","observation_id":"f10b9858-4408-424d-b838-35a2ac468996","resolution":{"observed_at":"2026-05-12T08:01:30.728922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15930","last_updated":"2025-04-22T14:19:06Z","snapshot_observed_at":"2026-07-06T21:13:04.549829Z","submitted_at":"2025-04-22T14:19:06Z","title":"StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation","version":1},"cited_work":{"arxiv_id":"2504.15930","doi":"10.48550/arxiv.2504.15930","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15930","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Streamrl: Scalable, heterogeneous, and elastic rl for llms with disaggregated stream generation","venue":"ArXiv.org","work_id":"63df3644-702d-4ae6-8e4a-954a41887545","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"cited_paper":"/paper/2504.15930","citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:f78e2c41e68abe43431bccce49e0f2d1d07e2499e58818a0259a0e255acb84cd","observation_id":"2b31c08b-f0c0-41bb-b1a6-12f9e9f58af4","resolution":{"observed_at":"2026-05-12T08:01:30.777660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:16.320291+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:16.320291+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"31c49d5b-895b-4718-ad1f-5bba6b5a5ca1","year":2025},"citing_paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T01:23:13.071107Z"},"links":{"citing_paper":"/paper/2605.08862"},"observation_digest":"sha256:3e979360925ad4c221ad4ece20ebafbb7c8a410f65dc69396d9de3312f80a1eb","observation_id":"fc0adcb2-c068-4a48-9360-207c7538cf3d","resolution":{"observed_at":"2026-05-14T07:24:49.622140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08862","last_updated":"2026-05-09T10:21:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T00:52:53.092284Z","submitted_at":"2026-05-09T10:21:38Z","title":"BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":20,"verified_fuzzy":3},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2605.08862."}