{"as_of":"2026-08-20T21:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2c8e5ef833310935671003c115da552deb63f4490c20faac1ac0905c7c78b671","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:07:35.118320Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:26:49.704505Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T20:26:10.436046Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"cited_work":{"arxiv_id":"2507.19017","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19017","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"hi\") ==","venue":null,"work_id":"fa0d356b-bb46-402a-9434-b4968da271c8","year":2025},"citing_paper":{"arxiv_id":"2605.06111","last_updated":"2026-05-07T12:24:53Z","snapshot_observed_at":"2026-08-11T14:34:50.450334Z","submitted_at":"2026-05-07T12:24:53Z","title":"Schedule-and-Calibrate: Utility-Guided Multi-Task Reinforcement Learning for Code LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T09:11:20.733960Z"},"links":{"cited_paper":"/paper/2507.19017","citing_paper":"/paper/2605.06111"},"observation_digest":"sha256:c9e4a808c7b5bce797b7aaf8720a636012537009afc8d18e04b588bf5f1066dc","observation_id":"e15eb777-934a-4431-ba3c-601a2b9b9378","resolution":{"observed_at":"2026-05-11T20:26:10.438554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19017","snapshot_observed_at":"2026-08-15T14:26:49.704505Z","title":"Mindspeed rl: Distributed dataflow for scalable and efficient rl training on ascend npu cluster.arXiv preprint arXiv:2507.19017, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10402","last_updated":"2026-08-11T02:49:33Z","snapshot_observed_at":"2026-08-20T11:51:22.600442Z","submitted_at":"2026-08-11T02:49:33Z","title":"TideRL: Boosting Agentic RL Goodput with Readiness-Aware Scheduling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:49.704505Z"},"links":{"cited_paper":"/paper/2507.19017","citing_paper":"/paper/2608.10402"},"observation_digest":"sha256:002bbb9264b0a9c29bbbc58f3513210ae60d655749adef466a6d3dc8d0874c43","observation_id":"a8b5541e-3e30-436d-804b-0ed94e9d8c6e","resolution":{"observed_at":"2026-08-15T14:26:49.704505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.19017/citation-record","integrity":"/paper/2507.19017/integrity","json":"/paper/2507.19017/citation-record.json","paper":"/paper/2507.19017"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.463061Z","title":null,"venue":null,"work_id":"cfa45410-55f0-4e60-b958-f8ee7ca5a93b","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.951530Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:605d22fd2db3a2514f82a6ffb5595ac9338d7e9d4703170785dc344407163b20","observation_id":"94f1291f-620c-4117-9c39-f664a2d054f0","resolution":{"observed_at":"2026-08-15T18:07:35.466129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.456135Z","title":null,"venue":null,"work_id":"a369b89b-2bcc-42ca-8c6a-e61331a716b9","year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.954797Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:90beba7e0f016092d8b91c97bddd6b0c0ffe9bf453074ed9bec68777791d8f36","observation_id":"e7b00ddf-2bdc-419d-b60d-141835a96aaf","resolution":{"observed_at":"2026-08-15T18:07:35.458483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-15T18:07:34.958676Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.958676Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:c09ca0702eed327f6d91c28679fac58594ad2132b70d3aabfcba453d7c8e257b","observation_id":"840a01f6-312f-4f4e-abd8-9b024ffb70bc","resolution":{"observed_at":"2026-08-15T18:07:34.958676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T18:07:34.961985Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.961985Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:766ac4cef43900b2202ae7105d05498d527325fe7d2116e8a3f170888bd479d1","observation_id":"ebbcfd94-bb66-4e87-92d0-62649c8bea83","resolution":{"observed_at":"2026-08-15T18:07:34.961985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-15T18:07:34.964925Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.964925Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:48e9fd23182884c26c6cb5c13bb1376100c89ab2865047121ee3157b894d0805","observation_id":"89ad4549-b54c-490c-b514-75a11640561b","resolution":{"observed_at":"2026-08-15T18:07:34.964925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09577","last_updated":"2026-04-24T18:51:15Z","snapshot_observed_at":"2026-08-16T04:37:28.929345Z","submitted_at":"2024-07-12T00:37:55Z","title":"FlashNorm: Fast Normalization for Transformers","version":5},"cited_work":{"arxiv_id":"2407.09577","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.09577","snapshot_observed_at":"2026-08-15T18:07:35.292452Z","title":"FlashNorm: Fast Normalization for Transformers","venue":"cs.LG","work_id":"fddf8514-93b6-4303-92b1-5cc40a95f712","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.968888Z"},"links":{"cited_paper":"/paper/2407.09577","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:7b506869693e6637c57b295bde3198ab456bb2df9dcfe030d99c82f565ce7f91","observation_id":"753cb2c1-a66a-4c6d-89b9-a5cfaf212dd5","resolution":{"observed_at":"2026-08-15T18:07:35.295439Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.449556Z","title":null,"venue":null,"work_id":"e9145221-2d89-49d9-87c4-af733e8f80eb","year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.973000Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:580caf1c807d2f7bd81c6f06ac410c7992db6581fa9a229d4d9c80100ddf4387","observation_id":"ef0dfd9a-1b6a-4f4c-9052-d6bda61c6aae","resolution":{"observed_at":"2026-08-15T18:07:35.451899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.442910Z","title":null,"venue":null,"work_id":"8844275a-8572-4846-ab0c-c2fecef4eaca","year":2021},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.975646Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:a27d8613e9ada270d493251ee64bcd68694998e2fbca8220795a8e9147bf6454","observation_id":"8619193d-a692-4691-a714-cdea857271be","resolution":{"observed_at":"2026-08-15T18:07:35.445264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-08-18T04:26:49.778619Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-15T18:07:34.979251Z","title":"K.; Zhu, Z.; Wang, W.; Jiang, S.; Wang, H.; Chen, H.; Chen, B.; Fang, W.; Xianyu; Cao, Y.; Xu, H.; and Liu, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.979251Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:3dea099b12a6983c06622d353d91cc8c1c197008d5b5867edb45e1ba959da9da","observation_id":"56f1cc2c-0b98-4d23-a43e-d1ff3c582b8b","resolution":{"observed_at":"2026-08-15T18:07:34.979251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.435952Z","title":"X.; Chen, D.; Lee, H","venue":null,"work_id":"3a518a2f-46b0-4c33-b6d0-b8a97f7c8ccd","year":2019},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.982745Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:e4aaa0454ffe03e8457bbf98074845141a4ff31966dded9898aafddcb05da762","observation_id":"74a59b31-9d2a-4496-8778-49ae4baef79e","resolution":{"observed_at":"2026-08-15T18:07:35.438334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.429239Z","title":"A.; Tanaka, M.; Zhang, C.; Zhang, M.; Aminabadi, R","venue":null,"work_id":"dbfec521-1fcf-4dba-ab98-a864f7e83c41","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.986302Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:10e953679fe5c94443ca561c6fcb77fbe570335d34d78812f7a425b2992b4e9f","observation_id":"27378040-ba78-45dd-a90f-3ab75a6b130c","resolution":{"observed_at":"2026-08-15T18:07:35.432069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.422832Z","title":null,"venue":null,"work_id":"de226faa-5fdf-4824-a3d8-046390d4219c","year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.989539Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:36ef3d39c0c6621691248501a9189503ecd5b4a7ad06f0eace3b907be2f42700","observation_id":"0c3921ca-5b03-4c57-8e65-a454473a4c44","resolution":{"observed_at":"2026-08-15T18:07:35.425296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.12719","last_updated":"2021-10-28T18:31:07Z","snapshot_observed_at":"2026-08-16T19:03:21.231110Z","submitted_at":"2020-11-25T13:28:16Z","title":"RLlib Flow: Distributed Reinforcement Learning is a Dataflow Problem","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.12719","snapshot_observed_at":"2026-08-15T18:07:34.992842Z","title":"E.; and Stoica, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.992842Z"},"links":{"cited_paper":"/paper/2011.12719","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:b44c69cfdc9a4e1737ca6d3de5cfeb5de69ab8b7f069e28d6fabe2efec937130","observation_id":"7424fa68-1741-4a3a-b37c-cd5759b34ede","resolution":{"observed_at":"2026-08-15T18:07:34.992842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-15T18:07:34.996287Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.996287Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:ddc6e5bd2bc7493a58ec364951d6c88c826de6a04d49bbcf36e4c2cd2395e303","observation_id":"507d8c7c-ac35-46ff-8dff-be1967d58240","resolution":{"observed_at":"2026-08-15T18:07:34.996287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.416396Z","title":"Y.; Roongta, M.; Cai, C.; Luo, J.; Li, L","venue":null,"work_id":"1c5e8180-c362-4613-8fed-ca5de1176346","year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:34.999848Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:2f745f18efa384994bb4c08354ef43d682c2c27805d7ee3eaf5e621bd3a20e71","observation_id":"309d336c-11dc-424b-b304-cce559117312","resolution":{"observed_at":"2026-08-15T18:07:35.418848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.410212Z","title":null,"venue":null,"work_id":"2a092172-41ed-4e52-960c-14e7e057a2c8","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.002929Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:83354149d899dff330f1a91d713af2d4896ed462396e96c3dac2a1fe4a81b178","observation_id":"ece80389-b587-4800-8f37-41c170e589d1","resolution":{"observed_at":"2026-08-15T18:07:35.412462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14088","last_updated":"2025-04-24T13:24:42Z","snapshot_observed_at":"2026-08-18T05:27:38.591666Z","submitted_at":"2024-06-20T08:04:07Z","title":"ReaL: Efficient RLHF Training of Large Language Models with Parameter Reallocation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14088","snapshot_observed_at":"2026-08-15T18:07:35.005076Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.005076Z"},"links":{"cited_paper":"/paper/2406.14088","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:a407f34e5fa1f828d26f7d5f80c20ba8403731f8ed5d1261c2d3c1501f058719","observation_id":"b8ec1b39-c291-4b52-ba9d-2c16cba2ad62","resolution":{"observed_at":"2026-08-15T18:07:35.005076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05889","last_updated":"2018-09-30T03:14:16Z","snapshot_observed_at":"2026-08-19T14:09:13.755256Z","submitted_at":"2017-12-16T01:29:49Z","title":"Ray: A Distributed Framework for Emerging AI Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05889","snapshot_observed_at":"2026-08-15T18:07:35.008292Z","title":"I.; and Stoica, I","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.008292Z"},"links":{"cited_paper":"/paper/1712.05889","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:41b4ff2d22e19e30bb29ffec7d43f0034b7596740c2cc30943ad77c635d151d4","observation_id":"125480ec-2d46-4170-8c0a-0af4df8a7bf4","resolution":{"observed_at":"2026-08-15T18:07:35.008292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.404249Z","title":null,"venue":null,"work_id":"8868bef5-7254-4d81-8d19-f11447082f16","year":2021},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.012485Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:acf2350c82f6addc2dcb76020a3b656b436b2063d3880ff319154e0a73cc869e","observation_id":"2dc228bb-0df8-4800-b3d4-13b550690708","resolution":{"observed_at":"2026-08-15T18:07:35.406430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.397652Z","title":null,"venue":null,"work_id":"6a49e4aa-79d1-4610-8252-b75adfe8ee51","year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.014719Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:2670d1c217a681d70289b7063cdec83b037de4e5d6caaa2f1c984e30df0ba734","observation_id":"bfb31e64-6bfc-42be-bdb2-7dd500da9784","resolution":{"observed_at":"2026-08-15T18:07:35.399985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.390698Z","title":null,"venue":null,"work_id":"83abba8e-66aa-4231-9475-039bb7eea0b6","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.017880Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:feb99b1dfd758eb3ee55c578cb39031fd6f12dd09c5c98562f6b64c7af531965","observation_id":"587cf96f-62f1-403a-805c-4607dce9534f","resolution":{"observed_at":"2026-08-15T18:07:35.392981Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T18:07:35.021115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.021115Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:ab83882b5db059bc3cdc3aca70014b08ec456646325934850e6bad4c83a89629","observation_id":"4838eca3-c3b4-4af8-9ef4-75008db0c8a0","resolution":{"observed_at":"2026-08-15T18:07:35.021115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-15T18:07:35.023574Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.023574Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:58a7faf9270b7124eeabe3a13768f80570b264d3c8bc97f0d34ce2685907fa6b","observation_id":"9fb2e852-daad-490f-bb0a-cd05a80b2517","resolution":{"observed_at":"2026-08-15T18:07:35.023574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10241","last_updated":"2023-11-30T10:40:34Z","snapshot_observed_at":"2026-08-20T15:52:53.227740Z","submitted_at":"2023-11-30T10:40:34Z","title":"Zero Bubble Pipeline Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10241","snapshot_observed_at":"2026-08-15T18:07:35.026073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.026073Z"},"links":{"cited_paper":"/paper/2401.10241","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:b0e70166dc59392b8da9aa2206affe2e90e1ef5038b961dce3f4292ecec1e6ef","observation_id":"beb524af-4d9c-4eff-839f-2d0f5deb3a0a","resolution":{"observed_at":"2026-08-15T18:07:35.026073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05596","last_updated":"2022-07-21T18:21:36Z","snapshot_observed_at":"2026-08-16T17:28:17.146479Z","submitted_at":"2022-01-14T18:36:04Z","title":"DeepSpeed-MoE: Advancing Mixture-of-Experts Inference and Training to Power Next-Generation AI Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.05596","snapshot_observed_at":"2026-08-15T18:07:35.028705Z","title":"Y.; Awan, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.028705Z"},"links":{"cited_paper":"/paper/2201.05596","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:2f66a610af1ddaf649704fff84c032f31a09ce596077dd86c54e51120b608e09","observation_id":"e9f8e3a1-bdbe-4adc-94fd-9bb5e037feab","resolution":{"observed_at":"2026-08-15T18:07:35.028705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.384085Z","title":null,"venue":null,"work_id":"e68ce225-3f6f-4b1e-bc34-d500d8aea902","year":2020},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.031930Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:2b1110b1b7de5ba1160c8ce8ee22a4c0abf49ee056aaa068d56de30fb54d2f87","observation_id":"f7bfac71-291a-42e4-8ef2-1a6395b6c13b","resolution":{"observed_at":"2026-08-15T18:07:35.386734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.377758Z","title":null,"venue":null,"work_id":"99cd487d-1de1-42bf-a6fd-8ed877f3f475","year":2020},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.034397Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:c5fd1a578bc6532585fb39b68d8007914b2f9281bcd3010d16925eb0ef54c700","observation_id":"d0e9de4d-e451-409c-83a6-4cfc164297ac","resolution":{"observed_at":"2026-08-15T18:07:35.380019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-18T14:12:03.598270Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-15T18:07:35.036822Z","title":"L.; Stickland, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.036822Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:c59c025b94d79c0021bb211ccdcaced864cb73cff08bfab48f253fdef99eb2d1","observation_id":"d46233d5-0f64-486a-a28d-424f1f570b32","resolution":{"observed_at":"2026-08-15T18:07:35.036822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.371428Z","title":null,"venue":null,"work_id":"0bc7d280-29e9-404a-b77b-0f8e554a6d7c","year":2017},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.040232Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:5498ffdb4d50b19e3acee61815a975b12d463bbc9779337ae93b054070cad09c","observation_id":"839a6ab6-b9d8-4d8e-8826-dd33bbeeee11","resolution":{"observed_at":"2026-08-15T18:07:35.373816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T18:07:35.043416Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.043416Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:e352e77384f557d6fdc327db6a54284608a78ad902056ca3751d7a83959a2378","observation_id":"ed56c3b8-b0e3-4188-9827-55d875e5e693","resolution":{"observed_at":"2026-08-15T18:07:35.043416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-15T18:07:35.046202Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.046202Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:93b00b6d717ceba27bccbeb46694a29e1306d8f3bf78b41ab88d34baf4c94fa3","observation_id":"30cb4c25-086f-498e-8596-70538033dbe2","resolution":{"observed_at":"2026-08-15T18:07:35.046202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-18T02:20:34.618916Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-15T18:07:35.049613Z","title":"S.; Aithal, A.; and Kuchaiev, O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.049613Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:12f2bd750f68ed23f14ba2b6acb033eddaa4d110ffae94871e4b6ac4895deb31","observation_id":"316d40cd-98bb-4086-a9b6-3e0f7ecd197e","resolution":{"observed_at":"2026-08-15T18:07:35.049613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22230","last_updated":"2025-04-02T13:26:34Z","snapshot_observed_at":"2026-08-17T16:08:53.256982Z","submitted_at":"2025-03-28T08:26:41Z","title":"Exploring Data Scaling Trends and Effects in Reinforcement Learning from Human Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.22230","snapshot_observed_at":"2026-08-15T18:07:35.052248Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.052248Z"},"links":{"cited_paper":"/paper/2503.22230","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:428a2fac94f579daaea52fd778710cbca204c4ed8aaf82093bcc06303d8c6388","observation_id":"faeb5e32-4a34-4bc2-b4f3-f386b777ee92","resolution":{"observed_at":"2026-08-15T18:07:35.052248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.364519Z","title":null,"venue":null,"work_id":"1e71a943-0b4a-4cac-9098-10d5b2622458","year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.054745Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:8a36007cc1c8ca95659b7a8176ebec62e1726905fe6a59dc5b0a13b767973b11","observation_id":"c2e4eec4-178c-404b-ada9-70485864a88b","resolution":{"observed_at":"2026-08-15T18:07:35.366896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.357814Z","title":null,"venue":null,"work_id":"a82ca465-756d-4174-aa39-345cfb0faa74","year":2019},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.057150Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:93c957f5fa8ff62ec106150484ccece52c0c63593252cc6054ff14f177f0f879","observation_id":"c1625def-5d68-4474-ae3a-7cadbb169993","resolution":{"observed_at":"2026-08-15T18:07:35.360412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09029","last_updated":"2026-05-31T02:40:58Z","snapshot_observed_at":"2026-08-09T07:04:00.337129Z","submitted_at":"2025-07-11T21:25:11Z","title":"Model Parallelism With Subnetwork Data Parallelism","version":5},"cited_work":{"arxiv_id":"2507.09029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.09029","snapshot_observed_at":"2026-08-15T18:07:35.209935Z","title":"Model Parallelism With Subnetwork Data Parallelism","venue":"cs.LG","work_id":"6a123555-b911-43e9-957d-5ad8bfe7b113","year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.060903Z"},"links":{"cited_paper":"/paper/2507.09029","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:43434cc7c3d3be44d4be6bbbeabb361d7465aa7b9fcf1b7e2e3e9b94bcb86f80","observation_id":"39c653dd-69d3-4796-8bee-cf5785049be4","resolution":{"observed_at":"2026-08-15T18:07:35.214451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-15T18:07:35.064355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.064355Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:2984db3e5ef807201382ee19d8d2ffb0468dee331d30dafeecee707f17457d40","observation_id":"1000a28a-3c06-46a4-8452-a456b27a25d1","resolution":{"observed_at":"2026-08-15T18:07:35.064355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-15T18:07:35.067892Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.067892Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:668101841a07fd0ecbea1173f407df8d3862cfcf323f0914f0651014439d7840","observation_id":"5dec1695-e5b4-49b5-bc2a-87d7c0d64e38","resolution":{"observed_at":"2026-08-15T18:07:35.067892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10400","last_updated":"2025-02-24T08:57:10Z","snapshot_observed_at":"2026-08-20T02:58:27.466335Z","submitted_at":"2024-12-05T16:10:42Z","title":"Reinforcement Learning Enhanced LLMs: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10400","snapshot_observed_at":"2026-08-15T18:07:35.071702Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.071702Z"},"links":{"cited_paper":"/paper/2412.10400","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:4c6683bd9f2fbcd544f347103b790c05b4ee9302978a1e29257d8619f4551db4","observation_id":"6994cb7c-e363-4dcc-b699-96031fada953","resolution":{"observed_at":"2026-08-15T18:07:35.071702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.350353Z","title":null,"venue":null,"work_id":"a8c5251d-3cd2-4dd6-89f4-ecd902f5e222","year":2022},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.074885Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:98f7a231a1061ec1c2de8dc54d37392b146628d35dd595687f9918c12f8a1645","observation_id":"b7d45633-a306-4f96-9379-b118a333a841","resolution":{"observed_at":"2026-08-15T18:07:35.352862Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-15T18:07:35.078289Z","title":"L.; Gugger, S.; Drame, M.; Lhoest, Q.; and Rush, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.078289Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:319676e2cc991aba98df123c00d676b83469bc324c613b726a8ab781cc4e77ce","observation_id":"8053a4b1-e1d9-44ac-abf5-475fd956475e","resolution":{"observed_at":"2026-08-15T18:07:35.078289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-15T18:07:35.081382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.081382Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:7a0172470e07d1f81a6e2af93b491287d367d548b9b2d067e7183872241c3773","observation_id":"492ba260-3140-4f48-82ac-df2ff2d4bcc0","resolution":{"observed_at":"2026-08-15T18:07:35.081382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01320","last_updated":"2023-08-02T18:49:57Z","snapshot_observed_at":"2026-08-16T15:11:14.289525Z","submitted_at":"2023-08-02T18:49:57Z","title":"DeepSpeed-Chat: Easy, Fast and Affordable RLHF Training of ChatGPT-like Models at All Scales","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01320","snapshot_observed_at":"2026-08-15T18:07:35.083833Z","title":"Y.; Ruwase, O.; Rajbhandari, S.; Wu, X.; Awan, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.083833Z"},"links":{"cited_paper":"/paper/2308.01320","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:70fa17372750c45f08cf02e13a9917170ccbf96717758326a976c317005749b9","observation_id":"6ef14aef-05b1-4edc-9552-e013cbf37125","resolution":{"observed_at":"2026-08-15T18:07:35.083833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-15T18:07:35.086295Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.086295Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:6c2aa88ae5b73999c73b87c7ec093b668ea058d8f09cd95a4213cef58b1bbeed","observation_id":"1cc576a2-71c6-4e41-86a5-b8b5aabd5328","resolution":{"observed_at":"2026-08-15T18:07:35.086295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18292","last_updated":"2025-03-24T02:28:04Z","snapshot_observed_at":"2026-08-19T00:24:51.262568Z","submitted_at":"2025-03-24T02:28:04Z","title":"Jenga: Effective Memory Management for Serving LLM with Heterogeneity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18292","snapshot_observed_at":"2026-08-15T18:07:35.089407Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.089407Z"},"links":{"cited_paper":"/paper/2503.18292","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:64d873c848831c3d083f62312ad16d0d6f93cac97f9374d5912a448faca8805b","observation_id":"e5d02f0d-7ba9-4478-a393-3e2549207f83","resolution":{"observed_at":"2026-08-15T18:07:35.089407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.343619Z","title":null,"venue":null,"work_id":"69a70605-822e-4905-8819-4e821be6494a","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.092869Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:ff3051833baf3057ed02f39874b44abc8b043bbef21c68dede23ccc089f38414","observation_id":"634afb3f-0b6e-4858-ad79-95e6cd71b7b3","resolution":{"observed_at":"2026-08-15T18:07:35.345951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.336990Z","title":null,"venue":null,"work_id":"b926bb41-4bd6-4a8b-893e-cbf9fb1332c0","year":2022},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.095520Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:e8c6f9db6a56e75b09c997e54502f4bec7cc112119e02c62c2698cf991b2b4f7","observation_id":"cc08cee5-606e-4647-97b4-eb9220d84e53","resolution":{"observed_at":"2026-08-15T18:07:35.339291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.329378Z","title":"C.; Xu, M.; Wright, L.; Shojanazeri, H.; Ott, M.; and Shleifer, S","venue":null,"work_id":"87f0f53e-edb2-491d-9b1f-d86a33a6c8f4","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.098450Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:3e656207374cfedabba03ef88efc83daad2f183ec64a0d7ee18cabb646afe72d","observation_id":"d5c0019c-202e-4fd1-9df0-9237943381e4","resolution":{"observed_at":"2026-08-15T18:07:35.332335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11277","snapshot_observed_at":"2026-08-15T18:07:35.101119Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.101119Z"},"links":{"cited_paper":"/paper/2304.11277","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:ce747643637a8016cc0a8a7ad9ee5dc2cdb6ab57545e25656443690bb5c1e4f6","observation_id":"129ae176-1c1b-434b-ab1b-c2ea728d7d3a","resolution":{"observed_at":"2026-08-15T18:07:35.101119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-08-18T16:18:58.765617Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-15T18:07:35.103609Z","title":"H.; Cao, S.; Kozyrakis, C.; Stoica, I.; Gonzalez, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.103609Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:c45d4cb60eb766f4eefa67583d3503ffb7f8e46d5054adae41dac1b073a0a3d1","observation_id":"2f9f3ec1-6e5b-4cf6-8a58-430ae5c9b106","resolution":{"observed_at":"2026-08-15T18:07:35.103609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15930","last_updated":"2025-04-22T14:19:06Z","snapshot_observed_at":"2026-08-20T01:49:19.844891Z","submitted_at":"2025-04-22T14:19:06Z","title":"StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15930","snapshot_observed_at":"2026-08-15T18:07:35.106165Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.106165Z"},"links":{"cited_paper":"/paper/2504.15930","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:ed17b6f0c161a828ff3dcc5ea8ee833d73a87df0cc6c73816f63a98d39300089","observation_id":"25c1c88f-5014-4811-8e10-4c1401053fdb","resolution":{"observed_at":"2026-08-15T18:07:35.106165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13221","last_updated":"2025-04-22T14:32:59Z","snapshot_observed_at":"2026-08-16T13:16:59.537080Z","submitted_at":"2024-09-20T05:15:38Z","title":"Optimizing RLHF Training for Large Language Models with Stage Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13221","snapshot_observed_at":"2026-08-15T18:07:35.109566Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.109566Z"},"links":{"cited_paper":"/paper/2409.13221","citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:dea9ed780ce7f134b43e0fa84e6d1378f5ed49e578a62e07dc8c4bc8cdacf8e4","observation_id":"c6cbf770-f489-4a1e-ae2a-6cdfe4ef4800","resolution":{"observed_at":"2026-08-15T18:07:35.109566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.322432Z","title":null,"venue":null,"work_id":"dfacd5c2-e248-45c2-808f-1b0145699f4b","year":2024},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.112571Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:daabb3bab2744f0ab2b0abaf2b3a68c3de2023ffc5c4e80e0036cab0c8b9ca5f","observation_id":"bff32c95-feea-46f2-9c00-057fd1eb4a39","resolution":{"observed_at":"2026-08-15T18:07:35.324915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.114695Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.114695Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:eda261da8a6083864b4eafca0426c3475f004da7b790b453b38d8e8d4c84ca6b","observation_id":"ba4981af-e42a-4176-be3d-a7b4fa52ea13","resolution":{"observed_at":"2026-08-15T18:07:35.114695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:07:35.118320Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T18:07:35.118320Z"},"links":{"citing_paper":"/paper/2507.19017"},"observation_digest":"sha256:2e57d501572b8854442b31e5e69462fbbfa1f678c3f3b268779592f19e08e8a4","observation_id":"97c41d6c-5a6b-483e-b26f-b708e3165583","resolution":{"observed_at":"2026-08-15T18:07:35.118320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.19017","last_updated":"2025-07-25T07:11:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T06:36:45.292994Z","submitted_at":"2025-07-25T07:11:49Z","title":"MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 2 inbound Pith citation observations for arXiv:2507.19017."}