{"as_of":"2026-08-15T19:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0557bfc973c6ea561c8849a95d3cb27dd23d4aefc86707b352d9ce9f9aa14f2f","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:13:50.303760Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11152/citation-record","integrity":"/paper/2608.11152/integrity","json":"/paper/2608.11152/citation-record.json","paper":"/paper/2608.11152"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.26256","last_updated":"2026-04-29T03:25:36Z","snapshot_observed_at":"2026-07-06T23:11:57.238808Z","submitted_at":"2026-04-29T03:25:36Z","title":"DORA: A Scalable Asynchronous Reinforcement Learning System for Language Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26256","snapshot_observed_at":"2026-08-12T05:13:50.241693Z","title":"DORA: A scalable asynchronous reinforcement learning system for language model training.arXiv preprint arXiv:2604.26256,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.241693Z"},"links":{"cited_paper":"/paper/2604.26256","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:46ab9ee894d6fa690ca158ed14d4398c000bd16faaba1aaa973a5b808b56756b","observation_id":"9bd5af01-ac29-4835-b3fa-681efceaaf43","resolution":{"observed_at":"2026-08-12T05:13:50.241693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24871","last_updated":"2025-06-05T05:13:46Z","snapshot_observed_at":"2026-08-14T12:50:25.203482Z","submitted_at":"2025-05-30T17:59:38Z","title":"MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24871","snapshot_observed_at":"2026-08-12T05:13:50.256666Z","title":"MoDoMoDo: Multi-domain data mixtures for multimodal LLM reinforcement learning.arXiv preprint arXiv:2505.24871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.256666Z"},"links":{"cited_paper":"/paper/2505.24871","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:c8ca426947632389c993bcbd34eda4c13d0c239c1fed1ac602cacec3c1dbb682","observation_id":"26aa98ce-529c-419a-afc7-dfc748f6ad00","resolution":{"observed_at":"2026-08-12T05:13:50.256666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30406","last_updated":"2026-06-29T14:51:28Z","snapshot_observed_at":"2026-08-10T09:37:40.339025Z","submitted_at":"2026-06-29T14:51:28Z","title":"MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30406","snapshot_observed_at":"2026-08-12T05:13:50.261766Z","title":"MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training.arXiv preprint arXiv:2606.30406,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.261766Z"},"links":{"cited_paper":"/paper/2606.30406","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:b7a9a60b5eedc9fa5d61574a0e0aaac59741e6a9f324f71703943c34323d8b9e","observation_id":"059665f4-b5f4-4339-9757-61b67fe9640e","resolution":{"observed_at":"2026-08-12T05:13:50.261766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-08-12T23:31:10.409888Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-08-12T05:13:50.266654Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation.arXiv preprint arXiv:2602.12125,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.266654Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:e7ad87aa67641a2eb19cd9421fac706477e78bd1704cc60e11968ecb82a72e05","observation_id":"d2ad585f-1a64-4d26-8784-8d10fe6b558d","resolution":{"observed_at":"2026-08-12T05:13:50.266654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27703","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.718591Z","title":"KAT-Coder-V2 Technical Report.arXiv preprint arXiv:2603.27703,","venue":null,"work_id":"4ac0a085-bf93-43f6-914d-370fb16d30a7","year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.270847Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:0ebe92e89c0911beb0d53bf22ea44a407b127a6a6925027a09dc645c2c9b0b7a","observation_id":"5b25d3c0-a868-407b-bc6e-78e5ccbf48d8","resolution":{"observed_at":"2026-08-12T05:13:50.726406Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-08-14T07:48:23.313445Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-12T05:13:50.275166Z","title":"MiMo-V2-Flash Technical Report.arXiv preprint arXiv:2601.02780,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.275166Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:1ea8819c27f1d4fd7c630602efe434e40853548d3565653c451316621a55238d","observation_id":"21c695b2-5360-4c6f-81f0-dfc84e924d5a","resolution":{"observed_at":"2026-08-12T05:13:50.275166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.280102Z","title":"Kimi K3: Open Frontier Intelligence.arXiv preprint arXiv:2607.24653,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.280102Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:936764b9dea5684c1fdc7d72c9088482303c1b9b26e72ff06dd7fa3a40f89e04","observation_id":"57559907-9567-4754-ab35-da735ff18afd","resolution":{"observed_at":"2026-08-12T05:13:50.280102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-12T05:13:50.284601Z","title":"Qwen3 Technical Report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.284601Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:881509906132fc683c017d57e71bef34e62725b9814d7e3873c56a12c9a9d689","observation_id":"1f060fe1-b9e9-4c7a-abb0-6c41d4761e2a","resolution":{"observed_at":"2026-08-12T05:13:50.284601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.289735Z","title":"Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning.arXiv preprint arXiv:2606.15007,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.289735Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:9f32c6d3bc3b6b7ece1238a3ca073f2feb64d94c28edd676f0a4585eea84be6c","observation_id":"3b75c79e-3b91-476a-a9a5-1304988c7509","resolution":{"observed_at":"2026-08-12T05:13:50.289735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.294197Z","title":"Nemotron-Cascade 2: Post-training LLMs with cascade RL and multi-domain on-policy distillation.arXiv preprint arXiv:2603.19220,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.294197Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:71d957ee43fa326ee2f83feb0af8cd4f3d84161a12c5cc45e34318994ba5d1b5","observation_id":"5bce5595-a8de-4c77-a26f-28112221dc9c","resolution":{"observed_at":"2026-08-12T05:13:50.294197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12652","last_updated":"2026-06-01T07:33:52Z","snapshot_observed_at":"2026-08-11T13:23:10.571972Z","submitted_at":"2026-05-12T18:57:44Z","title":"Multi-Rollout On-Policy Distillation via Peer Successes and Failures","version":2},"cited_work":{"arxiv_id":"2605.12652","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12652","snapshot_observed_at":"2026-08-12T05:13:50.355792Z","title":"Multi-Rollout On-Policy Distillation via Peer Successes and Failures","venue":"cs.LG","work_id":"9055c5ce-14d2-40f2-b703-cad985daea81","year":2026},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.298520Z"},"links":{"cited_paper":"/paper/2605.12652","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:0e8f9a38dbc666a625c9dc28d7191eebd2e4b41370bd46883b1fe771f8ba0e8f","observation_id":"fa0a4b2a-818b-48e8-8461-e9da2bad22d0","resolution":{"observed_at":"2026-08-12T05:13:50.363281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-14T04:52:35.539573Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-08-12T05:13:50.303760Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.303760Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:80bdc41c94344341783a143a19562afc5ce1c0dea0dfe38b995275b6ee38d956","observation_id":"33e088e5-c92f-4645-b6e3-a4810de06ce4","resolution":{"observed_at":"2026-08-12T05:13:50.303760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30560","last_updated":"2026-06-30T15:39:15Z","snapshot_observed_at":"2026-08-04T01:15:04.905446Z","submitted_at":"2026-06-29T16:59:05Z","title":"TraceLab: Characterizing Coding Agent Workloads for LLM Serving","version":2},"cited_work":{"arxiv_id":"2606.30560","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.30560","snapshot_observed_at":"2026-08-12T05:13:50.789488Z","title":"TraceLab: Characterizing Coding Agent Workloads for LLM Serving","venue":"cs.LG","work_id":"67006132-bb05-4dae-bfd4-21cd42dd9bd4","year":2026},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.251655Z"},"links":{"cited_paper":"/paper/2606.30560","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:7d796be6a1cce7be4e1574e96c6d6e676449e555b5e89dc1b37608ad5974f28d","observation_id":"261e113b-7e5c-4f2c-96ae-14495d02965e","resolution":{"observed_at":"2026-08-12T05:13:50.795099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.235549Z","title":"AReaL-Hex: Accommodating asynchronous RL training over heteroge- neous GPUs.arXiv preprint arXiv:2511.00796,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.235549Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:6443a4640168426d4b6689349aa04a95fc578905a6bf0beef7385916e00319b8","observation_id":"f607c615-1000-45f0-883b-64f85de4b384","resolution":{"observed_at":"2026-08-12T05:13:50.235549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19766","last_updated":"2025-07-26T03:42:33Z","snapshot_observed_at":"2026-08-09T10:38:35.557078Z","submitted_at":"2025-07-26T03:42:33Z","title":"UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19766","snapshot_observed_at":"2026-08-12T05:13:50.246705Z","title":"UloRL: An ultra-long output reinforcement learning approach for advancing large language models’ reasoning abilities.arXiv preprint arXiv:2507.19766,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.246705Z"},"links":{"cited_paper":"/paper/2507.19766","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:214963c88c031872165386f0b6bc31d7c05ad5124672b672238665635b4255e8","observation_id":"785f8f85-1cd2-46a6-b982-d95e14da7afa","resolution":{"observed_at":"2026-08-12T05:13:50.246705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-15T14:35:59.816729Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2608.11152."}