{"as_of":"2026-08-09T04:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b8b3b5c62f6594d479954da2304a3881ce59210f52fad709eacad70fb3982c3","coverage":[{"denominator":8,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:19:43.471104Z","state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:07:43.491850Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13833","snapshot_observed_at":"2026-08-04T16:07:43.491850Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-04T16:07:24.699834Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"reference_index":193,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:43.491850Z"},"links":{"cited_paper":"/paper/2507.13833","citing_paper":"/paper/2509.16679"},"observation_digest":"sha256:6338611ef910ed0dabd2f25892ea0e483db649ec3b13a8b60b371d3e44fd206c","observation_id":"f261017e-8295-440b-8296-4b979df7e659","resolution":{"observed_at":"2026-08-04T16:07:43.491850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.13833/citation-record","integrity":"/paper/2507.13833/integrity","json":"/paper/2507.13833/citation-record.json","paper":"/paper/2507.13833"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:19:43.447887Z","title":"Fu, W., Gao, J., Shen, X., Zhu, C., Mei, Z., He, C., Xu, S., Wei, G., Mei, J., Wang, J., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.447887Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:781db7b472ac1a293a23d50625369069677ff9aaaa0641e1559ca57de4823c4e","observation_id":"84f5e258-d93c-420f-85ec-e0966016eae1","resolution":{"observed_at":"2026-08-06T16:19:43.447887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-09T01:06:58.674891Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-06T16:19:43.455599Z","title":"Meng, F., Du, L., Liu, Z., Zhou, Z., Lu, Q., Fu, D., Han, T., Shi, B., Wang, W., He, J., Zhang, K., Luo, P., Qiao, Y ., Zhang, Q., and Shao, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.455599Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:2c7574774bf7936a097904fc62030ecd92e262454ef3c756d3d75c1b8e95bb95","observation_id":"abdb7607-10b1-4350-b021-82654c4ba76e","resolution":{"observed_at":"2026-08-06T16:19:43.455599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:19:43.710628Z","title":"Accessed: 2025-09-17","venue":null,"work_id":"10f95b4a-08ec-4024-a9a1-f19e6790cac7","year":2025},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.459777Z"},"links":{"citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:8ffb79fb47691150f555f66479c61fc6f393c0cde7d7d9b19b5795510ec56615","observation_id":"5f5cb8a5-aee6-49bc-aba0-684a86abf0af","resolution":{"observed_at":"2026-08-06T16:19:43.715378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:19:43.471104Z","title":"Laminar: A scalable asynchronous rl post-training framework, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.471104Z"},"links":{"citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:f8b5163f5f10633e8dc0ab8137e0ac2433e7bc57ddfcf76f0ef052961bdd0e61","observation_id":"2e46e0af-e552-45fa-a0f8-ae73cf09750c","resolution":{"observed_at":"2026-08-06T16:19:43.471104Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:19:43.463844Z","title":"ISBN 9781450379984","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.463844Z"},"links":{"citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:d8aa3c14cf47b169bcb4b7b2201abe6d71b5e90bd0651e654693fa6c2e61ee87","observation_id":"1ac9c838-70c1-4125-a86a-e59b50114845","resolution":{"observed_at":"2026-08-06T16:19:43.463844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-06T16:19:43.466905Z","title":"Nemo-aligner: Scalable toolkit for efficient model align- ment.arXiv preprint arXiv:2405.01481,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.466905Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:014808c8376d9ec5cc88d5b332bb1248a39175a984577fadc4e815629446aa81","observation_id":"2bf3ee51-b65c-4289-b049-862bb2e7007c","resolution":{"observed_at":"2026-08-06T16:19:43.466905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:19:43.723462Z","title":null,"venue":null,"work_id":"a82ff313-623c-4cc2-a06f-ed6e6b641ff4","year":2025},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.444264Z"},"links":{"citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:440e99b04320b8dd799219233b2167027964d4ed5007dbd7c99706a5bf8352c3","observation_id":"03a7ba04-d454-4284-9139-2006f9635168","resolution":{"observed_at":"2026-08-06T16:19:43.727121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-07-31T12:28:37.704994Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-06T16:19:43.451559Z","title":"Open- RLHF: An easy-to-use, scalable and high-performance rlhf framework.arXiv preprint arXiv:2405.11143,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.451559Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:581010233fe2ab7d07135fc90cf1c6aee435b0694d6caae47bd1c341dfcf1a0a","observation_id":"a312c340-edbd-4b37-9f81-0118ae159be5","resolution":{"observed_at":"2026-08-06T16:19:43.451559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","latest_version":4,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training"},"reference_resolution":{"displayed":8,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":8},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 8 of 8 outbound references and 1 inbound Pith citation observation for arXiv:2507.13833."}