{"as_of":"2026-08-06T09:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b1bdd1ac0ea60f92d29401888a46abc6db2dc31a9ceae021f86a9eeb43dfa8e","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:32:43.300084Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:14:02.042304Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:20:29.515746Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2602.02192","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.02192","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Echo-2: A large scale distributed rollout framework for cost-efficient reinforcement learning","venue":null,"work_id":"cdba8fbd-d320-4a1d-82d6-ee8489858cb5","year":2026},"citing_paper":{"arxiv_id":"2604.13453","last_updated":"2026-04-15T04:05:10Z","snapshot_observed_at":"2026-08-03T17:25:06.954677Z","submitted_at":"2026-04-15T04:05:10Z","title":"FAST: A Synergistic Framework of Attention and State-space Models for Spatiotemporal Traffic Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T14:20:21.472989Z"},"links":{"cited_paper":"/paper/2602.02192","citing_paper":"/paper/2604.13453"},"observation_digest":"sha256:e000b1a070c81e1e1c15306448c7f843897b85f6adb1239aa8a9a85033c7e737","observation_id":"f336f62a-0335-4939-a84d-3dd93dec191b","resolution":{"observed_at":"2026-05-27T02:04:33.896984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02192","snapshot_observed_at":"2026-08-02T11:14:02.042304Z","title":"2026.ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22614","last_updated":"2026-06-15T09:41:09Z","snapshot_observed_at":"2026-08-02T11:13:58.526737Z","submitted_at":"2026-06-15T09:41:09Z","title":"DynaResize: Runtime GPU Reallocation for Disaggregated LLM Post-Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T11:14:02.042304Z"},"links":{"cited_paper":"/paper/2602.02192","citing_paper":"/paper/2607.22614"},"observation_digest":"sha256:6249d8f78a6bb0d484e11017e409ae94f59fe846ce18f92b28d0c819b6c3d108","observation_id":"73182606-3436-4471-b46d-db063113c303","resolution":{"observed_at":"2026-08-02T11:14:02.042304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.02192/citation-record","integrity":"/paper/2602.02192/integrity","json":"/paper/2602.02192/citation-record.json","paper":"/paper/2602.02192"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-03T05:32:40.373432Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.373432Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:e21055a20a974e08a16e82d59e79cfbf1888e57b23e6dcbca5d6863679be3d8c","observation_id":"fd332074-d05c-4168-a0d0-555cfd9ae0fc","resolution":{"observed_at":"2026-08-03T05:32:40.373432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-03T05:32:40.415345Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.415345Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:684180608339423065615f76fa4c2f201b5fc89afa883052aede73050e38afb4","observation_id":"b736313e-0f23-4fbc-a511-49330b90fc59","resolution":{"observed_at":"2026-08-03T05:32:40.415345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-03T05:32:40.495376Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.495376Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:ed42171a10921f5d8e79fdcf9e9ff15af296940af9d110899df8ae78c93e4f0c","observation_id":"aaf7e38d-3e5e-4cb7-8a64-a84d9bd2f09f","resolution":{"observed_at":"2026-08-03T05:32:40.495376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:40.591203Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.591203Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:c2e76856619b473ae2d77288376bf921ae9271263cf3a21e1b3c9d92958a1c31","observation_id":"5769c27c-b16c-4a2a-8016-ed45413e7fe7","resolution":{"observed_at":"2026-08-03T05:32:40.591203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:40.701006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.701006Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:0631d1cd46802141f9c6df3ab7497bfb45c1af725e616961d31d2a9a6ede34fd","observation_id":"94293c0e-e9fd-4b58-9554-6c3bb9a181ae","resolution":{"observed_at":"2026-08-03T05:32:40.701006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:40.776914Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.776914Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:c915e4c6988b8b2d09b98632eb7502e01a0095244fe2c8705de44a25b72c8f5f","observation_id":"0108285f-5b65-4507-b5eb-b96e32f72cf8","resolution":{"observed_at":"2026-08-03T05:32:40.776914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-03T05:32:40.837833Z","title":"Areal: A large-scale asynchronous reinforcement learning system for language reasoning.arXiv preprint arXiv:2505.24298, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.837833Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:15af94256811d60eb7875ad3e3960eb6f4b56d1d97f376342103705b4eacd5e4","observation_id":"af19c22a-1aa9-4c5b-87fb-42df5799b123","resolution":{"observed_at":"2026-08-03T05:32:40.837833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18588","last_updated":"2025-08-26T01:42:46Z","snapshot_observed_at":"2026-08-05T16:20:23.166001Z","submitted_at":"2025-08-26T01:42:46Z","title":"History Rhymes: Accelerating LLM Reinforcement Learning with RhymeRL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18588","snapshot_observed_at":"2026-08-03T05:32:40.894045Z","title":"History rhymes: Accelerating llm reinforcement learning with rhymerl.arXiv preprint arXiv:2508.18588, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.894045Z"},"links":{"cited_paper":"/paper/2508.18588","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:a4d8b4b67100779f77d038039dfcdfdb853232454b48958fcc424e41f2563c2e","observation_id":"96d1c965-bc1d-46f9-bcf6-a69040c52b5e","resolution":{"observed_at":"2026-08-03T05:32:40.894045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18252","last_updated":"2025-04-26T08:33:32Z","snapshot_observed_at":"2026-08-04T13:37:48.046113Z","submitted_at":"2024-10-23T19:59:50Z","title":"Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18252","snapshot_observed_at":"2026-08-03T05:32:40.971370Z","title":"Asynchronous rlhf: Faster and more efficient off-policy rl for language models.arXiv preprint arXiv:2410.18252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.971370Z"},"links":{"cited_paper":"/paper/2410.18252","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:31ab4998893ab8ba57d783e50cd72932fa05c2daad0169f7c3e2bc5cad50bc03","observation_id":"eb6b8965-7c31-4ef1-a1bd-ef3c6fc643e8","resolution":{"observed_at":"2026-08-03T05:32:40.971370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15930","last_updated":"2025-04-22T14:19:06Z","snapshot_observed_at":"2026-07-06T21:13:04.549829Z","submitted_at":"2025-04-22T14:19:06Z","title":"StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15930","snapshot_observed_at":"2026-08-03T05:32:41.063975Z","title":"Streamrl: Scalable, heterogeneous, and elastic rl for llms with disaggregated stream generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.063975Z"},"links":{"cited_paper":"/paper/2504.15930","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:332f8bf06100144261782b90f06586bdba452e040ca53fdbb83ec47c37ffed7a","observation_id":"850b703d-a73a-4f39-aed9-60976c229ce6","resolution":{"observed_at":"2026-08-03T05:32:41.063975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05387","last_updated":"2025-08-12T15:23:04Z","snapshot_observed_at":"2026-08-05T23:26:57.004250Z","submitted_at":"2025-08-07T13:37:04Z","title":"Echo: Decoupling Inference and Training for Large-Scale RL Alignment on Heterogeneous Swarms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05387","snapshot_observed_at":"2026-08-03T05:32:41.151927Z","title":"Echo: Decoupling inference and training for large-scale rl alignment on heterogeneous swarms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.151927Z"},"links":{"cited_paper":"/paper/2508.05387","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:50d80408ff01820d16ea32e8bd051ddfa19c4ce782d1af0ecf3a60bd16bdcefb","observation_id":"fae02c87-3c7d-444a-9f1d-ee03fb58aea1","resolution":{"observed_at":"2026-08-03T05:32:41.151927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.253596Z","title":"Petals: Collaborative inference and fine-tuning of large models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.253596Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:ca23b69451861d044aa8cc6d8220c89874671dc539e8e6dc765e7c0f6776d4ec","observation_id":"4df1d50b-d04f-4206-b4a9-fc9988bf9375","resolution":{"observed_at":"2026-08-03T05:32:41.253596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.401706Z","title":"Swarm parallelism: Training large models can be surprisingly communication-efficient","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.401706Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:060c69f3c2b320d771033df2422b36c9dfbfde89043f74eac7a01abf15dd4f10","observation_id":"d687caa2-4372-4667-9d84-e19ce5eb68f9","resolution":{"observed_at":"2026-08-03T05:32:41.401706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.464947Z","title":"Parallax: Efficient llm inference service over decentralized environment.arXiv preprint arXiv:2509.26182, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.464947Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:badfc05aa49b3644f883ef88e08e87d435875ca2f33b2d19bfd6ee5b213f123f","observation_id":"2ecfd94a-47e0-4d25-9fa2-aba0a051f621","resolution":{"observed_at":"2026-08-03T05:32:41.464947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.584396Z","title":"Rlax: Large-scale, distributed reinforcement learning for large language models on tpus.arXiv preprint arXiv:2512.06392, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.584396Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:1a790f339d34ee33579461b72b426dd80704e93bc00707cf5dba7f0f03673d44","observation_id":"455bd1ca-a0a2-495c-afcd-1c5a8499f237","resolution":{"observed_at":"2026-08-03T05:32:41.584396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.689686Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.689686Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:4b04da6feb1e6f5bc30e1aae131e2770168f0c0fa4d0bd6e76d2437058f6bcec","observation_id":"1f870cc5-b633-4e0b-94a4-aec29766f9b4","resolution":{"observed_at":"2026-08-03T05:32:41.689686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.805004Z","title":"A survey of reinforcement learning from human feedback, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.805004Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:1a6ba5bce5b57845de4b23fcafb793ab971a0b5d4611e813daba331272b9fdf6","observation_id":"72d94e30-d90c-45a2-8518-98893edff2fe","resolution":{"observed_at":"2026-08-03T05:32:41.805004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.886782Z","title":"Areal-hex: Accommodating asynchronous rl training over heterogeneous gpus.arXiv preprint arXiv:2511.00796, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.886782Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:070e9b8818a148510d5a390ff93ccb6b15b04c27ddedb33a0982e42171e06876","observation_id":"2836fbd5-05ce-498c-a907-273c8b6042fd","resolution":{"observed_at":"2026-08-03T05:32:41.886782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-07-06T21:22:21.577606Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-08-03T05:32:41.992143Z","title":"Intellect-2: A reasoning model trained through globally decentralized reinforcement learning.arXiv preprint arXiv:2505.07291, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.992143Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:271a26950444440c0685269ea63024f2cdb481df01ea4bcec79edaf958ba47ad","observation_id":"8421379f-61e6-4d87-86cd-a33c9be4cd00","resolution":{"observed_at":"2026-08-03T05:32:41.992143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.231201Z","title":"Qiu, and Yuqing Yang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.231201Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:3d2f6294fc300d351daaf7aeb790e9c41f9fb50d2cf33db6fb2651cf09e3b52d","observation_id":"f317fd13-8f3d-41f4-9670-5dc1e9ab3e3e","resolution":{"observed_at":"2026-08-03T05:32:42.231201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.345375Z","title":"Prosperity before collapse: How far can off-policy rl reach with stale data on llms?arXiv preprint arXiv:2510.01161, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.345375Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:14284cbbbf278a2fa7bd7e9410090f3936318c0a1374500ea600e403a573ac23","observation_id":"ac433fdb-c1fc-421c-bb75-796b546a0a9c","resolution":{"observed_at":"2026-08-03T05:32:42.345375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T05:32:42.396096Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.396096Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:069a090461556d26f828d4e12fe841dab855c6297d61caac4a89d3a5ed200bc0","observation_id":"b6b64a8b-f840-41b8-b7ae-3142e11314c9","resolution":{"observed_at":"2026-08-03T05:32:42.396096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.483348Z","title":"American invitational mathematics examination (AIME), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.483348Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:bfe1313dcd75d2a603777005d4f8fd511d77a22b9baf9421ac0eb721ea23dee1","observation_id":"d228c218-06aa-42f9-949b-aaa8edfe2962","resolution":{"observed_at":"2026-08-03T05:32:42.483348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-05T09:35:42.754650Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-03T05:32:42.552709Z","title":"Omni-math: A universal olympiad level mathematic benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.552709Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:bc0602494f4e44c6f4eebba44a5ac72eaf2d0b812453ba911599fccb413cdfb7","observation_id":"e0d579c9-2615-42c2-8439-a081d552c22b","resolution":{"observed_at":"2026-08-03T05:32:42.552709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.620970Z","title":"Have llms advanced enough? a challenging problem solving benchmark for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.620970Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:c1fdf6c22a829328245b1113006d75e23617e153b35cc19d73f36d4360ad0dba","observation_id":"116157ac-edb2-424b-8894-81aeb5d6d64d","resolution":{"observed_at":"2026-08-03T05:32:42.620970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09988","last_updated":"2024-12-13T22:03:43Z","snapshot_observed_at":"2026-07-06T19:32:42.378146Z","submitted_at":"2024-10-13T20:09:41Z","title":"HARDMath: A Benchmark Dataset for Challenging Problems in Applied Mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09988","snapshot_observed_at":"2026-08-03T05:32:42.714144Z","title":"Hardmath: A benchmark dataset for challenging problems in applied mathematics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.714144Z"},"links":{"cited_paper":"/paper/2410.09988","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:4083c21bb5fc16268e216d87afe415c047e2688b0ef697cd7268556b3b868476","observation_id":"4dd2a08d-e0c7-4bf7-b6cd-a2ab1774ba98","resolution":{"observed_at":"2026-08-03T05:32:42.714144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.814718Z","title":"Towards robust mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.814718Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:2e6fcecb5135defc84702060cae524186d1015cd3b2a04bfee20caaf2a230bf4","observation_id":"d7034725-cdcd-4ec5-b007-245f53c7c885","resolution":{"observed_at":"2026-08-03T05:32:42.814718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.880251Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.880251Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:02ef18ba63dd777caff1a3e6f2672e20a8fa3a03f6ed12cfb09873c6ce975d60","observation_id":"1f678e05-4b38-44b7-89b7-87586fe4b4fc","resolution":{"observed_at":"2026-08-03T05:32:42.880251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.969166Z","title":"Openai gpt-5 system card, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.969166Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:900f753492e6e46ec0fe40d5d076f595e227a020d466f0831244691e4223a288","observation_id":"4cb84c57-40e0-4467-abfb-42345349719a","resolution":{"observed_at":"2026-08-03T05:32:42.969166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:43.038027Z","title":"Grok 4 model card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:43.038027Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:15f844b6fb9f89edabec477e30677037646c6cc7daa2e7afef706ae58815c4f3","observation_id":"d7554fe2-e003-4df1-851b-73403727d48c","resolution":{"observed_at":"2026-08-03T05:32:43.038027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:43.169909Z","title":"Claude sonnet 4.5 system card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:43.169909Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:4183193e1aee4beb7ac9a581350c8c10feada9334bac19e202700170c4bd1d10","observation_id":"623f8f9c-b9da-4be0-95a2-5d9ac5067be4","resolution":{"observed_at":"2026-08-03T05:32:43.169909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:43.300084Z","title":"moba://hok_v2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:43.300084Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:a2610ef6610b29530332d007b630ec8c46b1da43f73e887e1b857b7c41b7eb91","observation_id":"93bdf701-1019-4e37-b5f2-86740f778b31","resolution":{"observed_at":"2026-08-03T05:32:43.300084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T05:32:39.033836Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 2 inbound Pith citation observations for arXiv:2602.02192."}