{"as_of":"2026-08-12T10:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cda563ee6cce5c6f2815ef87ae030f79a4fb43bd99f7fc104b992a34e9e7f68e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:11:39.333472Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T09:16:06.674984Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-11T21:11:39.333472Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04964","last_updated":"2024-12-11T13:27:00Z","snapshot_observed_at":"2026-08-11T21:03:53.856888Z","submitted_at":"2024-12-06T11:29:32Z","title":"Flash Communication: Reducing Tensor Parallelization Bottleneck for Fast Large Language Model Inference","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T21:11:39.333472Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2412.04964"},"observation_digest":"sha256:5ba5f01da38955f7618c3b0479335e73b55ee11ce31d3be491195011d28db843","observation_id":"ce954f97-992f-4114-a238-3d42059907ab","resolution":{"observed_at":"2026-08-11T21:11:39.333472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-10T21:42:38.171907Z","title":"Zero++: Extremely efficient collective communication for giant model training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04266","last_updated":"2025-02-04T04:32:42Z","snapshot_observed_at":"2026-08-12T05:25:10.450823Z","submitted_at":"2025-01-08T04:19:57Z","title":"Scaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:42:38.171907Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2501.04266"},"observation_digest":"sha256:5f1c700c5d83a4679ea15bf8f59cc2cbee306155a3b0f3289109d892ed6ca90c","observation_id":"e6cee94d-9069-47d4-9335-4375fccf66f0","resolution":{"observed_at":"2026-08-10T21:42:38.171907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-07T12:45:30.127688Z","title":"Zero++: Extremely efficient collective communication for giant model training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23725","last_updated":"2026-06-02T01:19:21Z","snapshot_observed_at":"2026-08-07T12:36:41.591936Z","submitted_at":"2025-05-29T17:55:37Z","title":"MuLoCo: Muon is a practical inner optimizer for DiLoCo","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:45:30.127688Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2505.23725"},"observation_digest":"sha256:ddfaef0b2a3b62d968958c10c692e2bb7e20e1fb831656fa33bfeb11f99ccd97","observation_id":"5e0d5778-75b7-4ff1-ac7f-29df7773938a","resolution":{"observed_at":"2026-08-07T12:45:30.127688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-06T20:49:19.838142Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01803","last_updated":"2025-07-02T15:21:40Z","snapshot_observed_at":"2026-08-09T22:52:25.577151Z","submitted_at":"2025-07-02T15:21:40Z","title":"Towards Decentralized and Sustainable Foundation Model Training with the Edge","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:19.838142Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2507.01803"},"observation_digest":"sha256:f975d06179c0e8db5b710f1daaef446da6a3b98a2503d49815f552184e182ab3","observation_id":"4112655e-79f4-4063-8ac6-121c08400454","resolution":{"observed_at":"2026-08-06T20:49:19.838142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-06T20:02:14.207316Z","title":"arXiv e-prints arXiv:2306.10209 (Jun 2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10448","last_updated":"2025-07-05T10:12:25Z","snapshot_observed_at":"2026-08-11T14:56:46.316190Z","submitted_at":"2025-07-05T10:12:25Z","title":"FinTeam: A Multi-Agent Collaborative Intelligence System for Comprehensive Financial Scenarios","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:14.207316Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2507.10448"},"observation_digest":"sha256:366b3c22d7b185c485c54d6049bde276d15a24dc9c00cfb1d194e74b3862d9c9","observation_id":"dc73c0e0-d89e-46ed-81c8-57b908b7d4f1","resolution":{"observed_at":"2026-08-06T20:02:14.207316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-05T12:30:43.886921Z","title":"Zero++: Extremely efficient collective communication for giant model training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01555","last_updated":"2025-09-01T15:32:16Z","snapshot_observed_at":"2026-08-05T12:30:40.315873Z","submitted_at":"2025-09-01T15:32:16Z","title":"400-Gbps/$\\lambda$ Ultrafast Silicon Microring Modulator for Scalable Optical Compute Interconnects","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T12:30:43.886921Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2509.01555"},"observation_digest":"sha256:001a3f68569bd02ff070d193436d8e8a43b99b670cdef4896540788673ca8cbb","observation_id":"66031123-0360-482c-b267-a9892f3b4b86","resolution":{"observed_at":"2026-08-05T12:30:43.886921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":"2306.10209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-07-09T09:16:06.674984Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":"cs.DC","work_id":"92286222-082e-48d9-adb1-cc42b4538115","year":2023},"citing_paper":{"arxiv_id":"2603.28239","last_updated":"2026-08-04T08:18:13Z","snapshot_observed_at":"2026-08-11T10:42:23.613672Z","submitted_at":"2026-03-30T09:59:11Z","title":"A Switch-Centric In-Network Architecture for Accelerating LLM Inference in Shared-Memory Network","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-14T01:54:00.951348Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2603.28239"},"observation_digest":"sha256:1f9336b9e55e7adcbced07cf1cc4a6300fafde33a4189bbee0218a90cd5773b1","observation_id":"5a4fdf3c-34ff-499e-b5f5-5df1411334b6","resolution":{"observed_at":"2026-05-14T01:58:36.920410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":"2306.10209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-07-09T09:16:06.674984Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":"cs.DC","work_id":"92286222-082e-48d9-adb1-cc42b4538115","year":2023},"citing_paper":{"arxiv_id":"2604.17172","last_updated":"2026-04-21T04:46:04Z","snapshot_observed_at":"2026-08-02T14:49:40.944781Z","submitted_at":"2026-04-19T00:05:36Z","title":"UCCL-Zip: Lossless Compression Supercharged GPU Communication","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T06:36:43.101810Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2604.17172"},"observation_digest":"sha256:af5674fcd21551a8fc5a7ed651faabdf190de59466d7abc9c02a4e548857bc27","observation_id":"1d61ee0b-b9e6-496e-b564-f7a41926b5a8","resolution":{"observed_at":"2026-05-10T06:41:37.166144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":"2306.10209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-07-09T09:16:06.674984Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":"cs.DC","work_id":"92286222-082e-48d9-adb1-cc42b4538115","year":2023},"citing_paper":{"arxiv_id":"2604.24073","last_updated":"2026-04-27T05:59:44Z","snapshot_observed_at":"2026-08-11T03:42:23.678790Z","submitted_at":"2026-04-27T05:59:44Z","title":"FreeScale: Distributed Training for Sequence Recommendation Models with Minimal Scaling Cost","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T04:27:03.154268Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2604.24073"},"observation_digest":"sha256:8e586edfc2ec9cc995703d281fdce8274aba68220e3377d862bb95672b322f71","observation_id":"42b3f969-4330-487b-8164-2f1d97069cb6","resolution":{"observed_at":"2026-05-11T21:46:37.696149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":"2306.10209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-07-09T09:16:06.674984Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":"cs.DC","work_id":"92286222-082e-48d9-adb1-cc42b4538115","year":2023},"citing_paper":{"arxiv_id":"2606.00539","last_updated":"2026-05-30T05:11:13Z","snapshot_observed_at":"2026-08-11T15:16:00.117942Z","submitted_at":"2026-05-30T05:11:13Z","title":"GNMR: Runtime Stability Control for Low-Precision Large Language Model Training","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T18:53:47.187437Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2606.00539"},"observation_digest":"sha256:f16f4cfd5490c3990e66577012d37d40e813ea396ba29c6e714a157a4ce087a2","observation_id":"40e99615-9c70-405d-ac46-8c65efe92d85","resolution":{"observed_at":"2026-06-28T19:42:36.070499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":"2306.10209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-07-09T09:16:06.674984Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":"cs.DC","work_id":"92286222-082e-48d9-adb1-cc42b4538115","year":2023},"citing_paper":{"arxiv_id":"2607.01678","last_updated":"2026-07-02T04:10:42Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T04:10:42Z","title":"SCAPE: Accurate and Efficient LLM Training with Extreme Sparse Communication","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T17:56:52.510949Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2607.01678"},"observation_digest":"sha256:bfade7ed2d9570c9fd7bebb18251c6a473500a6319437006cac4fd500b3a0799","observation_id":"95f29918-0422-4bcf-9cdf-74dd786aacb6","resolution":{"observed_at":"2026-07-03T17:58:46.532914Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":"2306.10209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-07-09T09:16:06.674984Z","title":"A., Holmes, C., Rajbhandari, S., Ruwase, O., Yan, F., Yang, L., and He, Y","venue":"cs.DC","work_id":"92286222-082e-48d9-adb1-cc42b4538115","year":2023},"citing_paper":{"arxiv_id":"2607.07494","last_updated":"2026-07-08T14:55:51Z","snapshot_observed_at":"2026-08-07T04:54:55.339351Z","submitted_at":"2026-07-08T14:55:51Z","title":"GIFT: Geometry-Informed Low-precision Gradient Communication for LLM Pretraining","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-09T09:15:12.214083Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2607.07494"},"observation_digest":"sha256:b482151883e1b7f87d3876fabe6173507f2324abd78fe9ee9c0f272d086cc727","observation_id":"f72b09a6-2543-4ecb-aea5-a3711a6cba83","resolution":{"observed_at":"2026-07-09T09:16:06.676458Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10209","snapshot_observed_at":"2026-08-01T06:48:48.837725Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21793","last_updated":"2026-07-23T20:20:56Z","snapshot_observed_at":"2026-08-07T09:56:42.250730Z","submitted_at":"2026-07-23T20:20:56Z","title":"QLPO: Quadrant-weighted Sampling for Length-aware Policy Optimization","version":1},"reference_index":222,"source":"arxiv_source","source_observed_at":"2026-08-01T06:48:48.837725Z"},"links":{"cited_paper":"/paper/2306.10209","citing_paper":"/paper/2607.21793"},"observation_digest":"sha256:11a9c49d35a3071e436a217b0d1a7a7585c0a991575ecb5e774f356eb40a68ef","observation_id":"19afbcb8-52c5-4adb-927e-84752dd2d726","resolution":{"observed_at":"2026-08-01T06:48:48.837725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.10209/citation-record","integrity":"/paper/2306.10209/integrity","json":"/paper/2306.10209/citation-record.json","paper":"/paper/2306.10209"},"outbound":[],"paper":{"arxiv_id":"2306.10209","last_updated":"2023-06-16T23:26:19Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T15:43:42.968496Z","submitted_at":"2023-06-16T23:26:19Z","title":"ZeRO++: Extremely Efficient Collective Communication for Giant Model Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2306.10209."}