{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2018:4YPAYJISKXETBSY2KXQLWXZO5A","short_pith_number":"pith:4YPAYJIS","schema_version":"1.0","canonical_sha256":"e61e0c251255c930cb1a55e0bb5f2ee81f0048b2e1dd76a2a890f1c6cf090441","source":{"kind":"arxiv","id":"1812.01097","version":3},"attestation_state":"computed","paper":{"title":"LEAF: A Benchmark for Federated Settings","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["stat.ML"],"primary_cat":"cs.LG","authors_text":"Ameet Talwalkar, H. Brendan McMahan, Jakub Kone\\v{c}n\\'y, Peter Wu, Sai Meher Karthik Duddu, Sebastian Caldas, Tian Li, Virginia Smith","submitted_at":"2018-12-03T21:59:41Z","abstract_excerpt":"Modern federated networks, such as those comprised of wearable devices, mobile phones, or autonomous vehicles, generate massive amounts of data each day. This wealth of data can help to learn models that can improve the user experience on each device. However, the scale and heterogeneity of federated data presents new challenges in research areas such as federated learning, meta-learning, and multi-task learning. As the machine learning community begins to tackle these challenges, we are at a critical time to ensure that developments made in these areas are grounded with realistic benchmarks. "},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"1812.01097","kind":"arxiv","version":3},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2018-12-03T21:59:41Z","cross_cats_sorted":["stat.ML"],"title_canon_sha256":"4e3f589d80400eb326f6cc2bad689f9644d6cf40fa853720a3bc978f592c4eba","abstract_canon_sha256":"75b29d20890b81885ae1c17df0058e87dc6f97ee0fdbe402784a8ff6fa33c3b3"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T00:24:54.604117Z","signature_b64":"wZToRa9BfZCjEj6F/V/T8UQAm6w9T8rRgk2z8WmgJQBbi0bPM8d0kVvGje2n1+RULWZpbXN6ms4dBLpRy+WNDQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"e61e0c251255c930cb1a55e0bb5f2ee81f0048b2e1dd76a2a890f1c6cf090441","last_reissued_at":"2026-07-05T00:24:54.603641Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T00:24:54.603641Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"LEAF: A Benchmark for Federated Settings","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["stat.ML"],"primary_cat":"cs.LG","authors_text":"Ameet Talwalkar, H. Brendan McMahan, Jakub Kone\\v{c}n\\'y, Peter Wu, Sai Meher Karthik Duddu, Sebastian Caldas, Tian Li, Virginia Smith","submitted_at":"2018-12-03T21:59:41Z","abstract_excerpt":"Modern federated networks, such as those comprised of wearable devices, mobile phones, or autonomous vehicles, generate massive amounts of data each day. This wealth of data can help to learn models that can improve the user experience on each device. However, the scale and heterogeneity of federated data presents new challenges in research areas such as federated learning, meta-learning, and multi-task learning. As the machine learning community begins to tackle these challenges, we are at a critical time to ensure that developments made in these areas are grounded with realistic benchmarks. "},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"1812.01097","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/1812.01097/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"1812.01097","created_at":"2026-07-05T00:24:54.603696+00:00"},{"alias_kind":"arxiv_version","alias_value":"1812.01097v3","created_at":"2026-07-05T00:24:54.603696+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.1812.01097","created_at":"2026-07-05T00:24:54.603696+00:00"},{"alias_kind":"pith_short_12","alias_value":"4YPAYJISKXET","created_at":"2026-07-05T00:24:54.603696+00:00"},{"alias_kind":"pith_short_16","alias_value":"4YPAYJISKXETBSY2","created_at":"2026-07-05T00:24:54.603696+00:00"},{"alias_kind":"pith_short_8","alias_value":"4YPAYJIS","created_at":"2026-07-05T00:24:54.603696+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":29,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2607.06612","citing_title":"PRoVeFL: Private Robust and Verifiable Aggregation in Federated Learning","ref_index":55,"is_internal_anchor":true},{"citing_arxiv_id":"2606.25533","citing_title":"Security and Privacy in Retrieval-Augmented Generation: Architectures, Threats, Defenses, and Future Directions for Building Trustworthy Systems","ref_index":116,"is_internal_anchor":false},{"citing_arxiv_id":"2604.25421","citing_title":"FED-FSTQ: Fisher-Guided Token Quantization for Communication-Efficient Federated Fine-Tuning of LLMs on Edge Devices","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2604.25421","citing_title":"FED-FSTQ: Fisher-Guided Token Quantization for Communication-Efficient Federated Fine-Tuning of LLMs on Edge Devices","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2606.08521","citing_title":"Exploring CKKS Parameter Trade-offs for Privacy-Preserving Personalized Federated Learning","ref_index":31,"is_internal_anchor":false},{"citing_arxiv_id":"2606.01607","citing_title":"FedMTFI: Feature Importance Based Optimized Multi Teacher Knowledge Distillation in Heterogeneous Federated Learning Environment","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2606.02172","citing_title":"Closing the Alignment-Maturity Gap in Federated Prototype Learning","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2605.26323","citing_title":"Totoro$^+$: An Adaptive and Scalable Edge Federated Learning System","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2606.31742","citing_title":"FedXDS: Leveraging Model Attribution Methods to counteract Data Heterogeneity in Federated Learning","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19969","citing_title":"Your Neighbors Know: Leveraging Local Neighborhoods for Backdoor Detection in Decentralized Learning","ref_index":51,"is_internal_anchor":false},{"citing_arxiv_id":"2606.00947","citing_title":"Silent Failures in Federated Personalization of Foundation Models","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2305.16272","citing_title":"Incentivizing Honesty among Competitors in Collaborative Learning and Optimization","ref_index":7,"is_internal_anchor":false},{"citing_arxiv_id":"2505.06907","citing_title":"A Survey on Foundation Models for Personalized Federated Intelligence","ref_index":141,"is_internal_anchor":false},{"citing_arxiv_id":"2003.00295","citing_title":"Adaptive Federated Optimization","ref_index":209,"is_internal_anchor":false},{"citing_arxiv_id":"2605.21317","citing_title":"CRAFT: Conflict-Resolved Aggregation for Federated Training","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19969","citing_title":"Your Neighbors Know: Leveraging Local Neighborhoods for Backdoor Detection in Decentralized Learning","ref_index":51,"is_internal_anchor":false},{"citing_arxiv_id":"2506.21095","citing_title":"FeDa4Fair: Client-Level Federated Datasets for Fairness Evaluation","ref_index":6,"is_internal_anchor":false},{"citing_arxiv_id":"2510.07922","citing_title":"SketchGuard: Scaling Byzantine-Robust Decentralized Federated Learning via Sketch-Based Screening","ref_index":10,"is_internal_anchor":false},{"citing_arxiv_id":"1909.06335","citing_title":"Measuring the Effects of Non-Identical Data Distribution for Federated Visual Classification","ref_index":17,"is_internal_anchor":false},{"citing_arxiv_id":"2512.05372","citing_title":"Breaking the Capacity Bottleneck in Model-Heterogeneous Federated Learning via Gradual Model Restoration","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2605.14553","citing_title":"Efficient Multi-objective Prompt Optimization via Pure-exploration Bandits","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2605.13434","citing_title":"Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2604.25421","citing_title":"FED-FSTQ: Fisher-Guided Token Quantization for Communication-Efficient Federated Fine-Tuning of LLMs on Edge Devices","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2605.05959","citing_title":"From Coordinate Matching to Structural Alignment: Rethinking Prototype Alignment in Heterogeneous Federated Learning","ref_index":49,"is_internal_anchor":false},{"citing_arxiv_id":"2604.22562","citing_title":"Data-Free Contribution Estimation in Federated Learning using Gradient von Neumann Entropy","ref_index":2,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A","json":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A.json","graph_json":"https://pith.science/api/pith-number/4YPAYJISKXETBSY2KXQLWXZO5A/graph.json","events_json":"https://pith.science/api/pith-number/4YPAYJISKXETBSY2KXQLWXZO5A/events.json","paper":"https://pith.science/paper/4YPAYJIS"},"agent_actions":{"view_html":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A","download_json":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A.json","view_paper":"https://pith.science/paper/4YPAYJIS","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=1812.01097&json=true","fetch_graph":"https://pith.science/api/pith-number/4YPAYJISKXETBSY2KXQLWXZO5A/graph.json","fetch_events":"https://pith.science/api/pith-number/4YPAYJISKXETBSY2KXQLWXZO5A/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A/action/timestamp_anchor","attest_storage":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A/action/storage_attestation","attest_author":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A/action/author_attestation","sign_citation":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A/action/citation_signature","submit_replication":"https://pith.science/pith/4YPAYJISKXETBSY2KXQLWXZO5A/action/replication_record"}},"created_at":"2026-07-05T00:24:54.603696+00:00","updated_at":"2026-07-05T00:24:54.603696+00:00"}