{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2021:QX5MJ5M5QTBXTGNDP4ZV6BEUT5","short_pith_number":"pith:QX5MJ5M5","schema_version":"1.0","canonical_sha256":"85fac4f59d84c37999a37f335f04949f7c3bd840cf537a0515ae0797af7f6a87","source":{"kind":"arxiv","id":"2111.04877","version":2},"attestation_state":"computed","paper":{"title":"Papaya: Practical, Private, and Scalable Federated Learning","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.DC"],"primary_cat":"cs.LG","authors_text":"Anthony Shoumikhin, Ashkan Yousefpour, Carole-Jean Wu, Dzmitry Huba, Harish Srinivas, Hongyuan Zhan, Jesik Min, John Nguyen, Kaikai Wang, Kshitiz Malik, Mani Malek, Mike Rabbat, Pavel Ustinov, Ruiyu Zhu","submitted_at":"2021-11-08T23:46:42Z","abstract_excerpt":"Cross-device Federated Learning (FL) is a distributed learning paradigm with several challenges that differentiate it from traditional distributed learning, variability in the system characteristics on each device, and millions of clients coordinating with a central server being primary ones. Most FL systems described in the literature are synchronous - they perform a synchronized aggregation of model updates from individual clients. Scaling synchronous FL is challenging since increasing the number of clients training in parallel leads to diminishing returns in training speed, analogous to lar"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2111.04877","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2021-11-08T23:46:42Z","cross_cats_sorted":["cs.DC"],"title_canon_sha256":"28c34a63aba43e491526ee1333c39f575060d930e81a3557b7b6bb8c4d271c17","abstract_canon_sha256":"a169c6ea1c9c08a7d6c5bdb032e768c1c75b9f11f5f3989eb6fa12ef26c22469"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T04:17:37.300925Z","signature_b64":"LOzyk8ddDZ8lvo+tiCmeTYAxSW1unH9c7yNitZASNVa1WhJSlXIEZeZiOQKZ2WzzfvpoLOoDIOEH9cvoQr6TAA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"85fac4f59d84c37999a37f335f04949f7c3bd840cf537a0515ae0797af7f6a87","last_reissued_at":"2026-07-05T04:17:37.300339Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T04:17:37.300339Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Papaya: Practical, Private, and Scalable Federated Learning","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.DC"],"primary_cat":"cs.LG","authors_text":"Anthony Shoumikhin, Ashkan Yousefpour, Carole-Jean Wu, Dzmitry Huba, Harish Srinivas, Hongyuan Zhan, Jesik Min, John Nguyen, Kaikai Wang, Kshitiz Malik, Mani Malek, Mike Rabbat, Pavel Ustinov, Ruiyu Zhu","submitted_at":"2021-11-08T23:46:42Z","abstract_excerpt":"Cross-device Federated Learning (FL) is a distributed learning paradigm with several challenges that differentiate it from traditional distributed learning, variability in the system characteristics on each device, and millions of clients coordinating with a central server being primary ones. Most FL systems described in the literature are synchronous - they perform a synchronized aggregation of model updates from individual clients. Scaling synchronous FL is challenging since increasing the number of clients training in parallel leads to diminishing returns in training speed, analogous to lar"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2111.04877","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2111.04877/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2111.04877","created_at":"2026-07-05T04:17:37.300412+00:00"},{"alias_kind":"arxiv_version","alias_value":"2111.04877v2","created_at":"2026-07-05T04:17:37.300412+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2111.04877","created_at":"2026-07-05T04:17:37.300412+00:00"},{"alias_kind":"pith_short_12","alias_value":"QX5MJ5M5QTBX","created_at":"2026-07-05T04:17:37.300412+00:00"},{"alias_kind":"pith_short_16","alias_value":"QX5MJ5M5QTBXTGND","created_at":"2026-07-05T04:17:37.300412+00:00"},{"alias_kind":"pith_short_8","alias_value":"QX5MJ5M5","created_at":"2026-07-05T04:17:37.300412+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2605.13434","citing_title":"Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity","ref_index":91,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5","json":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5.json","graph_json":"https://pith.science/api/pith-number/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/graph.json","events_json":"https://pith.science/api/pith-number/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/events.json","paper":"https://pith.science/paper/QX5MJ5M5"},"agent_actions":{"view_html":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5","download_json":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5.json","view_paper":"https://pith.science/paper/QX5MJ5M5","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2111.04877&json=true","fetch_graph":"https://pith.science/api/pith-number/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/graph.json","fetch_events":"https://pith.science/api/pith-number/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/action/timestamp_anchor","attest_storage":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/action/storage_attestation","attest_author":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/action/author_attestation","sign_citation":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/action/citation_signature","submit_replication":"https://pith.science/pith/QX5MJ5M5QTBXTGNDP4ZV6BEUT5/action/replication_record"}},"created_at":"2026-07-05T04:17:37.300412+00:00","updated_at":"2026-07-05T04:17:37.300412+00:00"}