{"as_of":"2026-08-11T11:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb3f096114732aade98694b8ccf75218158d79d1f28bc802fe66f1551e9461e9","coverage":[{"denominator":254,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T21:06:26.210255Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08233/citation-record","integrity":"/paper/2509.08233/integrity","json":"/paper/2509.08233/citation-record.json","paper":"/paper/2509.08233"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.053960Z","title":"Deep learning with differential privacy","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.053960Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:3ef38920c662f3b40cf8f954b6cd17405a178e95e9691c3edca39dbb143c8b65","observation_id":"fad6581d-31f9-440f-b591-414e7bfc5e38","resolution":{"observed_at":"2026-08-04T21:06:25.053960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.05021","last_updated":"2017-07-24T21:47:51Z","snapshot_observed_at":"2026-08-04T09:45:17.283224Z","submitted_at":"2017-04-17T16:32:02Z","title":"Sparse Communication for Distributed Gradient Descent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.05021","snapshot_observed_at":"2026-08-04T21:06:25.113713Z","title":"Sparse communication for distributed gradient descent","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.113713Z"},"links":{"cited_paper":"/paper/1704.05021","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:cbc66b242e94798e77359736de6f7fae16db50f48180b6d53560dfddf66d1c0f","observation_id":"17bce8f7-0e31-45dc-a712-4c25eaaaf194","resolution":{"observed_at":"2026-08-04T21:06:25.113713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.191841Z","title":"Fedrolex: Model-heterogeneous federated learning with rolling sub-model extraction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.191841Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:b1cdc5f8f5c013f50db61e908d8a40ce7fe397b18ea399a71a42210abaf30720","observation_id":"bbba6824-9844-42f8-b118-559c1d5053ab","resolution":{"observed_at":"2026-08-04T21:06:25.191841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03246","last_updated":"2020-10-07T07:58:59Z","snapshot_observed_at":"2026-08-06T20:49:22.362142Z","submitted_at":"2020-10-07T07:58:59Z","title":"Optimal Gradient Compression for Distributed and Federated Learning","version":1},"cited_work":{"arxiv_id":"2010.03246","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.03246","snapshot_observed_at":"2026-08-04T21:06:27.898476Z","title":"Optimal Gradient Compression for Distributed and Federated Learning","venue":"cs.LG","work_id":"e131e922-3022-4262-bf08-4d2fc2c278c7","year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.268705Z"},"links":{"cited_paper":"/paper/2010.03246","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:a09a9c71e3d6958f975a52837520df548872af673504bbd233808911da0aa890","observation_id":"5cc15899-e199-4474-a5c2-e4b12f29da0a","resolution":{"observed_at":"2026-08-04T21:06:27.901946Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.338042Z","title":"Alistarh, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.338042Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:e6ffff13c94d88ee18fde50f0bd5aad1076e44e6d6b8aa95317702ecfac854e3","observation_id":"8c192cb8-7d06-499f-a4d0-6385b69c7864","resolution":{"observed_at":"2026-08-04T21:06:25.338042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.450542Z","title":"Geo-indistinguishability: Differential privacy for location-based systems","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.450542Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:5dd2ff0857a440704d2b9e9673e02d847d57f3a18e082cdde80f5eb5fea331b5","observation_id":"e7f48702-cb15-4ef3-a4af-a5427f8c4dfd","resolution":{"observed_at":"2026-08-04T21:06:25.450542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.00818","last_updated":"2019-12-02T14:29:00Z","snapshot_observed_at":"2026-07-06T08:41:25.156353Z","submitted_at":"2019-12-02T14:29:00Z","title":"Federated Learning with Personalization Layers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.00818","snapshot_observed_at":"2026-08-04T21:06:25.491705Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.491705Z"},"links":{"cited_paper":"/paper/1912.00818","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:8b5b54404e649d116fa25336108de93411ae17f1c73170f9df173b5dae5225c1","observation_id":"4e0277e1-e6b9-4ea6-b3fe-300c88de1150","resolution":{"observed_at":"2026-08-04T21:06:25.491705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.561360Z","title":"A tight convergence analysis for stochastic gradient descent with delayed updates","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.561360Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:25288ed6c900e48115378fd7341b09383b78a9d351c69b859da9ae06be5c644c","observation_id":"fdf52e1a-1747-47c3-8d61-a739c848a743","resolution":{"observed_at":"2026-08-04T21:06:25.561360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.602119Z","title":"Stochastic (approximate) proximal point methods: Convergence, optimality, and adaptivity","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.602119Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:d9c2ee4872421f4fdf8e32987edaa7f58f4a0292541fbf7772593ad8db3beeed","observation_id":"d22086c9-9f0d-4e4e-aa4d-f4c68dc4698f","resolution":{"observed_at":"2026-08-04T21:06:25.602119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.669876Z","title":"Minibatch stochastic approximate proximal point methods","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.669876Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f15e69bf93a635845acfd77ca621ff08a8b6b0b8320a52b9d2635c98a4345263","observation_id":"ab64495f-441c-4afe-9897-70ab770f22d1","resolution":{"observed_at":"2026-08-04T21:06:25.669876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.756737Z","title":"Attouch and J","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.756737Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:1502e0c21beeaa1fc0a200a79dcf48ec813156608e47139f06a86505dcd92926","observation_id":"f13f1c48-0777-47c2-b835-ea40b873e6b1","resolution":{"observed_at":"2026-08-04T21:06:25.756737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.817040Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.817040Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:c0a577160eacaa98d8757e53ee6bd2c7662aca396849c2e38725a42dafac1e51","observation_id":"57b04500-d9ed-4f8f-a2f0-3bce53c33006","resolution":{"observed_at":"2026-08-04T21:06:25.817040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.923795Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.923795Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:b0a451253c42a6bc22b273e57f2c51850c633d9970f40ee90a1e6afee32c975e","observation_id":"86df9263-0da1-4f13-b47d-48c060061719","resolution":{"observed_at":"2026-08-04T21:06:25.923795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.951194Z","title":"Private empirical risk minimization: Efficient algorithms and tight error bounds","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.951194Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f54d6e838f1a9d8a351dc5964b29cb8900091c3df5c7ef2133a774a73664fe9c","observation_id":"a41c00de-a6fc-494b-a988-c68527074df9","resolution":{"observed_at":"2026-08-04T21:06:25.951194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.954592Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.954592Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:663bdec035152578c3e3aedf4e886376e21690e4fb42521cc199f3cbc2c4039d","observation_id":"0fe4294b-bcd6-4b14-862c-c2b9bd0804be","resolution":{"observed_at":"2026-08-04T21:06:25.954592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.957649Z","title":"Deep rewiring: Training very sparse deep networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.957649Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:89e38a714c51ba8a300757c9be38b687e88dbccda2e58f5359ebaea3c6661588","observation_id":"d5156b93-89d2-44db-8794-35f0fda1593b","resolution":{"observed_at":"2026-08-04T21:06:25.957649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.960585Z","title":"Incremental proximal methods for large scale convex optimization","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.960585Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:0231f654db47125d77d4cb1cdf79827fffb0143d31db429b3b74b8922714e089","observation_id":"cf692662-d04e-4d9e-8f5b-d980b25fae66","resolution":{"observed_at":"2026-08-04T21:06:25.960585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.12410","last_updated":"2024-01-14T16:36:09Z","snapshot_observed_at":"2026-07-06T09:00:46.442419Z","submitted_at":"2020-02-27T19:52:24Z","title":"On Biased Compression for Distributed Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.12410","snapshot_observed_at":"2026-08-04T21:06:25.963642Z","title":"Beznosikov, S","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.963642Z"},"links":{"cited_paper":"/paper/2002.12410","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:18e1c83080f6fe832c3511eea3f418f84d79f4d4426d40f67bf7c1927af4b66c","observation_id":"c1d7b0e5-c077-4ba5-a7cd-f80239f887b4","resolution":{"observed_at":"2026-08-04T21:06:25.963642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.967063Z","title":"On biased compression for distributed learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.967063Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:68a59fbe1c4e96fcfdc913f2bd72c5e4d576ce8e1308ce5f5fdf13fc41db224b","observation_id":"9c7729d0-7ec3-4be3-b6af-b9ee00cc0ffc","resolution":{"observed_at":"2026-08-04T21:06:25.967063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10581","last_updated":"2023-03-19T06:06:44Z","snapshot_observed_at":"2026-08-07T04:22:55.396334Z","submitted_at":"2023-03-19T06:06:44Z","title":"An Evaluation of GPU Filters for Accelerating the 2D Convex Hull","version":1},"cited_work":{"arxiv_id":"2303.10581","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.10581","snapshot_observed_at":"2026-08-04T21:06:27.865508Z","title":"An Evaluation of GPU Filters for Accelerating the 2D Convex Hull","venue":"cs.DC","work_id":"06eb3726-1fa1-44b0-bc6c-18ff47421015","year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.970155Z"},"links":{"cited_paper":"/paper/2303.10581","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:8fd82aa81a9a2ba3af914189fcc6da03e9603df0cb6037dc704cc1c8178f6350","observation_id":"936a6b7b-432f-4f23-bcd3-1cb55f138d7b","resolution":{"observed_at":"2026-08-04T21:06:27.868918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01046","last_updated":"2019-03-22T20:25:57Z","snapshot_observed_at":"2026-08-09T11:18:21.803795Z","submitted_at":"2019-02-04T06:27:41Z","title":"Towards Federated Learning at Scale: System Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01046","snapshot_observed_at":"2026-08-04T21:06:25.973307Z","title":"Towards federated learning at scale: Syste m design","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.973307Z"},"links":{"cited_paper":"/paper/1902.01046","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:cede6046942867f410090755818b00d11741dbe2995856e806c9c3a8f775ac0f","observation_id":"d8daaa64-c5b9-4f2f-a26a-d7316b28f63a","resolution":{"observed_at":"2026-08-04T21:06:25.973307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.976896Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.976896Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f5d0508d9aa411dbb508c9e9d46cde3e1d44cf96243077024d60883579082244","observation_id":"3cee71d6-18b9-43c7-967b-7481660db24f","resolution":{"observed_at":"2026-08-04T21:06:25.976896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.980230Z","title":"Quasi-Newton methods and their application to function minimisation","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.980230Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:9104371ec74a7975c3c81bc9e297d51c1e38e4246d92df277f1432ee04b8246e","observation_id":"dd3b2964-cc1b-4f7a-81f4-aed39acee96b","resolution":{"observed_at":"2026-08-04T21:06:25.980230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12535","last_updated":"2019-09-27T07:40:08Z","snapshot_observed_at":"2026-08-08T08:30:06.930085Z","submitted_at":"2019-09-27T07:40:08Z","title":"Federated User Representation Learning","version":1},"cited_work":{"arxiv_id":"1909.12535","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.12535","snapshot_observed_at":"2026-08-04T21:06:27.841618Z","title":"Federated User Representation Learning","venue":"cs.LG","work_id":"e3bd9306-aa47-429e-8ebf-0fdcfa89a43a","year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.983220Z"},"links":{"cited_paper":"/paper/1909.12535","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:9fea45ca8af1fb4eb631c4154d47622186b2c9b7c179e6681cb8c8c7680228bc","observation_id":"293dab22-e98a-4857-bf18-c13a0bc76656","resolution":{"observed_at":"2026-08-04T21:06:27.844955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.986353Z","title":"Efficient implementation of stochastic proximal point algorithm for matrix and tensor completion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.986353Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:c331ee9e96b74e9325838ba102431d2cf8bab43f39dce549332f70684ed5a3ac","observation_id":"1edea290-eaa1-4025-bbf0-91793c48c6fb","resolution":{"observed_at":"2026-08-04T21:06:25.986353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01097","last_updated":"2019-12-09T20:02:37Z","snapshot_observed_at":"2026-08-06T00:22:10.318064Z","submitted_at":"2018-12-03T21:59:41Z","title":"LEAF: A Benchmark for Federated Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01097","snapshot_observed_at":"2026-08-04T21:06:25.989416Z","title":"Caldas, P","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.989416Z"},"links":{"cited_paper":"/paper/1812.01097","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:3a54192833e859d8e2b21ff4c587021b970e4222b25429d9bc303eb3d30e749d","observation_id":"0fca57a2-aa20-4bf5-907f-e7e940bd904b","resolution":{"observed_at":"2026-08-04T21:06:25.989416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.993097Z","title":"Accelerated, optimal and parallel: Some results on model-based stochastic optimization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.993097Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f13d2b66f28738ba3a218283a6caff2fe4f0d70c21ed289f5857436d20b9ebc1","observation_id":"b2d30ffa-f1d3-4671-83db-96e93c74694f","resolution":{"observed_at":"2026-08-04T21:06:25.993097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.996031Z","title":"Chang and C.-J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.996031Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:99767affb50523e3cb845a1e9b5c12d273d086e2651d5b120dcc519b08379e2f","observation_id":"531ea234-a99f-4c3f-8f19-b1112c657563","resolution":{"observed_at":"2026-08-04T21:06:25.996031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:25.998911Z","title":"Broadening the scope of differential privacy using metrics","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:25.998911Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:1764f0eec54e7deb0e36df51ec6914158516cfec62fd620053e4cabf9d36c71c","observation_id":"8311271b-c34e-48fb-b32a-9936a9c7cc47","resolution":{"observed_at":"2026-08-04T21:06:25.998911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02776","last_updated":"2023-06-09T07:33:29Z","snapshot_observed_at":"2026-08-02T13:08:07.375150Z","submitted_at":"2023-05-04T12:21:34Z","title":"Efficient Personalized Federated Learning via Sparse Model-Adaptation","version":2},"cited_work":{"arxiv_id":"2305.02776","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.02776","snapshot_observed_at":"2026-08-04T21:06:27.817803Z","title":"Efficient Personalized Federated Learning via Sparse Model-Adaptation","venue":"cs.LG","work_id":"dd48731d-666c-4521-81a9-6726a7c01a7d","year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.001916Z"},"links":{"cited_paper":"/paper/2305.02776","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:72130fbf048862d21c0260710db2b8607fa7966f564983cc856e1076fb1999e3","observation_id":"6b709a45-698a-4302-866f-f5f34e0f8f01","resolution":{"observed_at":"2026-08-04T21:06:27.821261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.005385Z","title":"Visualgpt: Data-efficient adaptation of pretrained language models for image captioning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.005385Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:0add03ac2a2089ab4f7809cad52bfbaac4ef86c71babce7ca875b59219818672","observation_id":"e211d2c5-c3c1-4d11-a23b-539afff89d06","resolution":{"observed_at":"2026-08-04T21:06:26.005385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.008110Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.008110Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:33482bbe38ea94a00b9a791a8106202b389fe2f81c49e7c19471df902ae9b8cc","observation_id":"50cc01bf-961f-40b4-8c5c-d00782181959","resolution":{"observed_at":"2026-08-04T21:06:26.008110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.010921Z","title":"A comprehensive survey on model compression and acceleration","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.010921Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:129a6e269dac2dde9f4460182a39a1aacefbc2b9d82a57892f16791fbed5bc8a","observation_id":"95926125-b480-4881-98b2-fb5ea61b21b1","resolution":{"observed_at":"2026-08-04T21:06:26.010921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-04T21:06:26.013781Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.013781Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:e8792dbb97a0158a430ff0de35c45582065caa53be2e2e0b90134e2d0a93280b","observation_id":"d564ff37-a095-45b7-b93f-344682ad69c5","resolution":{"observed_at":"2026-08-04T21:06:26.013781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-04T21:06:26.016907Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.016907Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:73e69a00f0abfab7cfffe3799679717bf9826d46b20343b01168070405a87ad0","observation_id":"d5aa263f-6c80-4857-9626-d81636a10031","resolution":{"observed_at":"2026-08-04T21:06:26.016907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-04T21:06:26.020136Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.020136Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:4177c4245c1c520360dafe154b91e0563ea82698c636fbed957906d1355bee13","observation_id":"40cd5424-4585-49d8-b3f7-c30315aad821","resolution":{"observed_at":"2026-08-04T21:06:26.020136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.023200Z","title":"Emnist: Extending mnist to handwritten letters","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.023200Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:20008c24ccd53eeb239c4ac88489db12e90b34c0e36af324ebc19db2a4475b9d","observation_id":"0ea79937-65b3-4a62-9c0f-b8d832f076cf","resolution":{"observed_at":"2026-08-04T21:06:26.023200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.025929Z","title":"Condat and P","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.025929Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:9283de78fe01ffebe2606aa9010c6ae67f69e45fd97eee9f5ac83c8ae405af46","observation_id":"150ccc17-e4a1-4d10-bfe5-6023d11b7902","resolution":{"observed_at":"2026-08-04T21:06:26.025929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.028816Z","title":"Condat and P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.028816Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f3c2de905cc9423687adf36232f1d4893deb28d9a4bf4c6e6f805880d9a09108","observation_id":"bc5a028d-8b96-484a-a068-92983dd66ebe","resolution":{"observed_at":"2026-08-04T21:06:26.028816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.031675Z","title":"Condat, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.031675Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:52dae9d9d9c7ee6e256f51bb81319ada965bc71ce3dde716fc22b0ad90d58d9d","observation_id":"fb313082-bbe1-4213-9e9f-7170a39859dc","resolution":{"observed_at":"2026-08-04T21:06:26.031675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.034676Z","title":"Condat, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.034676Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:fdf56e08b4e3d62cc8f5fc713f09fbdbc2aa99b7c252baa0974c57e559a12142","observation_id":"2ea88f5d-b22b-48ac-a107-3958ea851a75","resolution":{"observed_at":"2026-08-04T21:06:26.034676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.037694Z","title":"Condat, G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.037694Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:457666e714e730a2b273d4a5ac6cf06ce28ca9d57884fddb914bb19cadcc58ea","observation_id":"6d15272b-5fee-43ca-bd0d-734079d21b95","resolution":{"observed_at":"2026-08-04T21:06:26.037694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09832","last_updated":"2026-06-07T11:57:20Z","snapshot_observed_at":"2026-08-06T00:24:21.396687Z","submitted_at":"2023-02-20T08:37:44Z","title":"TAMUNA: Doubly Accelerated Distributed Optimization under Partial Participation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09832","snapshot_observed_at":"2026-08-04T21:06:26.040610Z","title":"Condat, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.040610Z"},"links":{"cited_paper":"/paper/2302.09832","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:5787ff576b3b52a60d863b14448395a12b16b7adf4a0cb5e317f7d9eb949a1be","observation_id":"d827d321-2152-4d26-8718-d9ba291a11b2","resolution":{"observed_at":"2026-08-04T21:06:26.040610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.043964Z","title":"Only tails matter: Average-case universality and robustness in the convex regime","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.043964Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:e874166cad64f1ef5bc35eb1ff8beadeae45e3a9e06af0be7cb785c65b32e3ff","observation_id":"6ebb0322-3e3e-4e72-b7d5-d38cccd464b3","resolution":{"observed_at":"2026-08-04T21:06:26.043964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.046860Z","title":"Large scale distributed deep networks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.046860Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:5938c57426185350edd7c8e1318f4c1836f0685ccbbc8150b1a75143298f9575","observation_id":"2a773637-e11d-4c31-8d47-bfadcd72795d","resolution":{"observed_at":"2026-08-04T21:06:26.046860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.049622Z","title":"Heterofl: Computation and communication efficient federated learning for heterogeneous clients","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.049622Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:c596a6d1d8722dfe77d58b954c27d4c689f6e7a436eaca909f31660f95f53e47","observation_id":"152b8748-8f10-4dc3-9184-57495c9ba259","resolution":{"observed_at":"2026-08-04T21:06:26.049622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.052542Z","title":"Differentially private and communication efficient collaborative learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.052542Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:e99976413bd4ffb89469f8a9eee78f7342ab5b8415aea311aecadf46419d159f","observation_id":"70fc8974-0183-4327-9007-39049e275c6d","resolution":{"observed_at":"2026-08-04T21:06:26.052542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.055217Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.055217Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:3304a7f4b3f8622ce7bd8263818b21284c13ee208a1c1d970c19be048e9b59b7","observation_id":"e4f09b82-b2c4-4d75-86a2-0b2336f6828b","resolution":{"observed_at":"2026-08-04T21:06:26.055217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T21:06:26.057923Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.057923Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:eead65807040cc38100c7705b5af1c3f333006a48b3fea9ee79a4c977ca5a9e6","observation_id":"21b1bdf5-8dd5-48d6-a1d5-0a7ed5707ad2","resolution":{"observed_at":"2026-08-04T21:06:26.057923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.060850Z","title":"Resist: Layer-wise decomposition of resnets for distributed training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.060850Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:266ab215e77a2e84ffc58a1d00d7cafb786bb30e0ff2ab7edc8b51b5499aee05","observation_id":"d8fda87d-d6a6-4fb5-8420-5ec0b7686764","resolution":{"observed_at":"2026-08-04T21:06:26.060850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.063488Z","title":"Efficient and light-weight federated learning via asynchronous distributed dropout","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.063488Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:191bf99f5944209586fd8c0f8d5b220db1baec0878874aa272d5c0dd4b0a62eb","observation_id":"7dbdc770-363b-4f7c-99b5-c5d66b4ce1db","resolution":{"observed_at":"2026-08-04T21:06:26.063488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.066536Z","title":"Calibrating noise to sensitivity in private data analysis","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.066536Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:9cc819b230b5dc08fbfe05d909b5d36fe33bedcd6e88e57114f4c7dc0a5d1b89","observation_id":"0f923a2c-4e67-4563-9d35-ccd9829b2d98","resolution":{"observed_at":"2026-08-04T21:06:26.066536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.069408Z","title":"The algorithmic foundations of differential privacy","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.069408Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:94aac0e1b20208f4d73bdc73dab7f470c80bf92b2b5620ddca1646529173c36c","observation_id":"3cfc5ccd-82ab-4738-9c62-a93492d50837","resolution":{"observed_at":"2026-08-04T21:06:26.069408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.072118Z","title":"Extreme compression of large language models via additive quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.072118Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f74a217defeaf56a6f334457dd39d7c2c41bd36cad87937c31efd208469f8183","observation_id":"b6014bec-f5e8-48e7-9c0d-0922c49fbb36","resolution":{"observed_at":"2026-08-04T21:06:26.072118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.075570Z","title":"Cizsl++: Creativity inspired generative zero-shot learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.075570Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:74f64b4155fdfe39e1807f264d527e4bc5b81a939c69961626f5c4e3d38de9f0","observation_id":"f3279231-0346-4d78-b329-f8755d6160f4","resolution":{"observed_at":"2026-08-04T21:06:26.075570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.078348Z","title":"Rigging the lottery: Making all tickets winners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.078348Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:338b1fd286faca64e2aa17c65ed3b5a4e1a563c30334eb02f53d164916356f83","observation_id":"eb566989-f5e2-427b-83a6-3647179be9b0","resolution":{"observed_at":"2026-08-04T21:06:26.078348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.081047Z","title":"Personalized federated learning with theoretical guarantees: A model-agnostic meta-learning approach","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.081047Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:2f3bc936fb69155a4460f41173104651d41a84f5ff77e5bf454d38034b93f952","observation_id":"f992e22f-26c5-4cd4-ba27-0e9707929fb5","resolution":{"observed_at":"2026-08-04T21:06:26.081047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03294","last_updated":"2025-06-20T17:11:24Z","snapshot_observed_at":"2026-07-06T11:55:17.935458Z","submitted_at":"2021-10-07T09:29:14Z","title":"EF21 with Bells & Whistles: Six Algorithmic Extensions of Modern Error Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03294","snapshot_observed_at":"2026-08-04T21:06:26.083885Z","title":"Fatkhullin, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.083885Z"},"links":{"cited_paper":"/paper/2110.03294","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:83d08b50c1684e887a703c5ed6145a9d74b412e24bb3b9c3aca6655230a67a68","observation_id":"63a606b4-1f41-4eae-bfa6-7c8842051dfa","resolution":{"observed_at":"2026-08-04T21:06:26.083885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.087067Z","title":"Private stochastic convex optimization: optimal rates in linear time","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.087067Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:171b9bd5d3797eb3aefc8fc9eadb158a353a858115c90dae3aba43bb92c2a5d4","observation_id":"731a704a-c894-402c-bc98-bab481cad3b4","resolution":{"observed_at":"2026-08-04T21:06:26.087067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.090201Z","title":"Fletcher","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.090201Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:607e1de004ba05d1f407968d0bbb20fe8c7959d1635fba711af7b3807668b801","observation_id":"801cec88-0237-41b4-a797-130f410685ce","resolution":{"observed_at":"2026-08-04T21:06:26.090201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.093112Z","title":null,"venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.093112Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:0b947af5eb26e2bdee5914136cef829ca0e4ebffa529990d0c4f5b6ca745a86a","observation_id":"8529ed07-52dd-426e-ab6f-95d6ec5fb697","resolution":{"observed_at":"2026-08-04T21:06:26.093112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-04T21:06:26.095823Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.095823Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:603336b2b18b76bee2bafcd5ea349cbca1626d165ca02d377f156cdeea3e6ba4","observation_id":"9949f014-accf-4b20-8573-5fcb0ac1712c","resolution":{"observed_at":"2026-08-04T21:06:26.095823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.099016Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.099016Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:fada36b81162737a8722a7032cf3b9da872035aff94e731a3948ff6bf7aea2d9","observation_id":"8620d6de-b8ef-4aa0-b451-fd236f5cf49c","resolution":{"observed_at":"2026-08-04T21:06:26.099016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.102161Z","title":"OPTQ : Accurate quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.102161Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:fdb397e1107c57c5232a6e6278ad42356028883f033e2c8c997dea028706e019","observation_id":"2500c5f8-ef7b-4887-9b9f-48c78b9f0df0","resolution":{"observed_at":"2026-08-04T21:06:26.102161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.07971","last_updated":"2020-12-24T21:07:55Z","snapshot_observed_at":"2026-08-07T23:07:30.719576Z","submitted_at":"2019-11-18T21:48:01Z","title":"vqSGD: Vector Quantized Stochastic Gradient Descent","version":4},"cited_work":{"arxiv_id":"1911.07971","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.07971","snapshot_observed_at":"2026-08-04T21:06:27.722873Z","title":"vqSGD: Vector Quantized Stochastic Gradient Descent","venue":"cs.LG","work_id":"e9d0426a-2e37-4661-8093-64f009a24226","year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.105510Z"},"links":{"cited_paper":"/paper/1911.07971","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:69aa741c94dfdc8390633b5ba864bc646aec5ee9cd10116d8f9f2f6ab216d77a","observation_id":"94bf3572-a9d3-4d03-91ea-dc3fcdc26ade","resolution":{"observed_at":"2026-08-04T21:06:27.726535Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04505","last_updated":"2022-10-10T09:16:43Z","snapshot_observed_at":"2026-08-09T06:49:06.971138Z","submitted_at":"2022-10-10T09:16:43Z","title":"A Survey on Heterogeneous Federated Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04505","snapshot_observed_at":"2026-08-04T21:06:26.108866Z","title":"A survey on heterogeneous federated learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.108866Z"},"links":{"cited_paper":"/paper/2210.04505","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:9ffd64c2bcb7f554a0a4f522bddc38412570c7eaad0577142c0d76d52c8fcb05","observation_id":"87c05cd2-a57f-46d8-b0f8-14f59b1284dc","resolution":{"observed_at":"2026-08-04T21:06:26.108866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.111979Z","title":"A framework for few-shot language model evaluation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.111979Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:d746c11e9aab6aca7f3778c56c29da0a961c8a04ce924c8379f951ba779f1271","observation_id":"dc68e921-5d30-4738-b409-5c55f14a97a4","resolution":{"observed_at":"2026-08-04T21:06:26.111979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.115096Z","title":"Feddc: Federated learning with non-iid data via local drift decoupling and correction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.115096Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:8e7e367cc42811be2b7495fa00517ff87b138786836f665848d0ce3b129fefd8","observation_id":"3331b730-2617-4fde-9717-e45289267028","resolution":{"observed_at":"2026-08-04T21:06:26.115096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.117826Z","title":"Gasanov, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.117826Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:231a48c7bc76eef4672bd274b43f8f4de38f7cadd0f5631e783d07071adbfa5b","observation_id":"5e559d31-f313-487f-94f0-9b9f762e2547","resolution":{"observed_at":"2026-08-04T21:06:26.117826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.120669Z","title":"Stochastic first-and zeroth-order methods for nonconvex stochastic programming","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.120669Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:1703ff87a1ffb917ad8dc20828d48e4df678cddf413b3f3162b904025896cf7e","observation_id":"a02c1b59-33b6-44df-aff1-7817dd5da0a0","resolution":{"observed_at":"2026-08-04T21:06:26.120669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.123921Z","title":"An efficient framework for clustered federated learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.123921Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:d04b13a81bf06109cfd8736ccd54555518bfa44c4e98b092353f429d1e602abd","observation_id":"2198f2db-842f-418f-87f9-4c369b8cd581","resolution":{"observed_at":"2026-08-04T21:06:26.123921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.127136Z","title":"A family of variable-metric methods derived by variational means","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.127136Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:ab3b5833f324b98e430b8f023d48ab1f3485243d029a07f8ab5453723397fef2","observation_id":"f614129f-b01b-4e3f-9160-1c3396f10806","resolution":{"observed_at":"2026-08-04T21:06:26.127136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.129658Z","title":"Gorbunov, F","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.129658Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:7525a7d9b14050f4bfbd1e0032636b492256f478547a16b43daceace12a3d4da","observation_id":"4dbd6fde-ad32-4e91-9801-26f291ef720f","resolution":{"observed_at":"2026-08-04T21:06:26.129658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.132436Z","title":"Gorbunov, F","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.132436Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:38002f1d82335efa28cf4c8570166e967f1f87f0e012672c5debc20fbcd3e27a","observation_id":"e6f86908-5a52-47e6-9878-e609a2846db6","resolution":{"observed_at":"2026-08-04T21:06:26.132436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.135443Z","title":"Gorbunov, D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.135443Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:6e8a145273a65322f63a02e65460853765b2b159edee2936f0b3bb0f767d58a6","observation_id":"9e6aa27d-3bde-4518-a4af-26dc3d6d905b","resolution":{"observed_at":"2026-08-04T21:06:26.135443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.138842Z","title":"Super-acceleration with cyclical step-sizes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.138842Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:7bbc727c9690ec7fa1986d2c0b51e93659eb4afd5773d739bcb560fe2424c025","observation_id":"bb9c25a9-6476-4b24-9e9b-c11735de2df4","resolution":{"observed_at":"2026-08-04T21:06:26.138842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.141587Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.141587Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:93b46959a785e613b045cf1efa4e1db7023f5b20cf5b693b63a9b2991f9aad84","observation_id":"8bcfff3f-5d0a-41c2-a4d7-03887385866f","resolution":{"observed_at":"2026-08-04T21:06:26.141587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.144258Z","title":null,"venue":null,"work_id":null,"year":1968},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.144258Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f8bdc8f30e3e47caec39705024243f6f5fae49ae813b6161198e328f3b4d7892","observation_id":"79fd8edc-cb1e-4d55-af78-5f90ace76d97","resolution":{"observed_at":"2026-08-04T21:06:26.144258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.147033Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.147033Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:c030db713668399aad5fa918202009b860882c6bf58d9422a1264428e382e326","observation_id":"a6f09c3c-5eb4-4355-969c-fe0eccbebd89","resolution":{"observed_at":"2026-08-04T21:06:26.147033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.150133Z","title":"Sgd: General analysis and improved rates","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.150133Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:381df20eacdd51dc24030fdb350db996f3007d7cd1fe33b0fac264e19f482efe","observation_id":"cd6342d7-b916-4210-9277-9dca1c394293","resolution":{"observed_at":"2026-08-04T21:06:26.150133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.152825Z","title":"Grudzie \\'n , G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.152825Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:9b1186d04ec13982dff32ee6bbc29216b5db51180d009cde43884f8861a49759","observation_id":"418cc630-5796-46a1-861e-7280323fb38c","resolution":{"observed_at":"2026-08-04T21:06:26.152825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.14425","last_updated":"2019-12-06T21:16:41Z","snapshot_observed_at":"2026-07-30T21:49:53.494348Z","submitted_at":"2019-10-31T12:52:55Z","title":"On the Convergence of Local Descent Methods in Federated Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.14425","snapshot_observed_at":"2026-08-04T21:06:26.155651Z","title":"Haddadpour and M","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.155651Z"},"links":{"cited_paper":"/paper/1910.14425","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:ce6141cb5323488ba02e6d0d62db432437f6ef01b24c0c78faae66ff425d7450","observation_id":"26c6fc80-2ad1-4e19-b3cc-806255d538f9","resolution":{"observed_at":"2026-08-04T21:06:26.155651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.158675Z","title":"Learning both weights and connections for efficient neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.158675Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:022cde1677198b05b13982279db0857c58230d6eee2e475928f2edf8eff94b70","observation_id":"99477ec7-5f1c-43fb-905b-8c76a64e6c83","resolution":{"observed_at":"2026-08-04T21:06:26.158675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05516","last_updated":"2021-02-12T06:30:47Z","snapshot_observed_at":"2026-08-09T18:41:55.264563Z","submitted_at":"2020-02-10T09:17:08Z","title":"Federated Learning of a Mixture of Global and Local Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05516","snapshot_observed_at":"2026-08-04T21:06:26.161787Z","title":"Hanzely and P","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.161787Z"},"links":{"cited_paper":"/paper/2002.05516","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:266e2adb1d3eb0569c2f4fe3c79060697a1082fbbcddb56d1c12ec11d4212d67","observation_id":"ae8b9a34-5655-4794-b900-38f4d559d6a6","resolution":{"observed_at":"2026-08-04T21:06:26.161787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11266","last_updated":"2020-01-15T18:26:53Z","snapshot_observed_at":"2026-08-03T18:00:38.772000Z","submitted_at":"2019-05-27T14:31:44Z","title":"One Method to Rule Them All: Variance Reduction for Data, Parameters and Many New Methods","version":2},"cited_work":{"arxiv_id":"1905.11266","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.11266","snapshot_observed_at":"2026-08-04T21:06:27.680908Z","title":"One Method to Rule Them All: Variance Reduction for Data, Parameters and Many New Methods","venue":"math.OC","work_id":"c08b34b0-a524-46ee-89fa-f30c100e88dc","year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.164922Z"},"links":{"cited_paper":"/paper/1905.11266","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:3afa2d548c8da61f3a34a88df9dcb20c4dfc8242d9d18ea6fded19227100496c","observation_id":"6e8f2d80-10cf-48bd-b9fb-d1988f017a46","resolution":{"observed_at":"2026-08-04T21:06:27.684326Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09743","last_updated":"2023-05-26T19:05:44Z","snapshot_observed_at":"2026-07-06T10:42:44.947174Z","submitted_at":"2021-02-19T04:56:28Z","title":"Personalized Federated Learning: A Unified Framework and Universal Optimization Techniques","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09743","snapshot_observed_at":"2026-08-04T21:06:26.168118Z","title":"Personalized federated learning: A unified framework and universal optimization techniques","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.168118Z"},"links":{"cited_paper":"/paper/2102.09743","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:5fa1b5069491db081366dc83bfcea2d5220fdc0c167f3cc55abf783600a2e7a9","observation_id":"596f72c0-f3d2-44d1-8772-afd4358f6193","resolution":{"observed_at":"2026-08-04T21:06:26.168118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.171334Z","title":"A damped newton method achieves global o(1/k^2) and local quadratic convergence rate","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.171334Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:200f3ea4ee18dc8f8a176c5f29b3424a3349353d23250175db9e65ef7233e053","observation_id":"2090c18a-48dc-43f5-96eb-785bf454b5c1","resolution":{"observed_at":"2026-08-04T21:06:26.171334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.03604","last_updated":"2019-02-28T21:07:51Z","snapshot_observed_at":"2026-08-10T06:38:25.165407Z","submitted_at":"2018-11-08T18:37:03Z","title":"Federated Learning for Mobile Keyboard Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.03604","snapshot_observed_at":"2026-08-04T21:06:26.174193Z","title":"Federated learning for mobile keyboard prediction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.174193Z"},"links":{"cited_paper":"/paper/1811.03604","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:5c888a8d2c7b5dcd5aa35656371a5ce2ae7029e8630a30df4fb016cf32e00109","observation_id":"d2d21da7-1970-431d-ba69-395c5bc15b32","resolution":{"observed_at":"2026-08-04T21:06:26.174193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.177597Z","title":"Fednas: Federated deep learning via neural architecture search","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.177597Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:3d5da94d9efe8c1928edfcb4ca0559dfd144ef05a5972514586178fcc27f7335","observation_id":"87d92993-c546-459a-b7d9-bc0ff9f7af97","resolution":{"observed_at":"2026-08-04T21:06:26.177597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.180774Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.180774Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:e46a243ef0e4cb72f3af6222b119c0148916219a0e8a9e19a8f4026bab5a8133","observation_id":"da333333-2ed3-4d0a-9d45-69fad0ceff7d","resolution":{"observed_at":"2026-08-04T21:06:26.180774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.183587Z","title":"Methods of conjugate gradients for solving linear systems , volume 49","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.183587Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:30bc4c14fb880e55e85990eb437c927da6b7c4787cd25be8ef9043efa57de4e8","observation_id":"a3c2c357-9532-48a0-88bb-623703ec3ea3","resolution":{"observed_at":"2026-08-04T21:06:26.183587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.186903Z","title":"Sparsity in deep learning: Pruning and growth for efficient inference and training in neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.186903Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:0ef44248918da2a3f98c1a07e4aabdcb0b69d1e00dbea20dc950b863a3069bfb","observation_id":"0b64c5a6-5e73-4142-aa8a-ba86c7367e1e","resolution":{"observed_at":"2026-08-04T21:06:26.186903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.189637Z","title":"Horv\\'ath , D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.189637Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:fe875aee6c02869570e7ed418ce93ef55d19d3ceebed10fee1f3aead07cc2d85","observation_id":"dd7cdc69-2cda-42e2-badd-7dfa1465fcb9","resolution":{"observed_at":"2026-08-04T21:06:26.189637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10988","last_updated":"2022-09-05T07:41:31Z","snapshot_observed_at":"2026-08-02T10:42:02.474929Z","submitted_at":"2019-05-27T06:10:59Z","title":"Natural Compression for Distributed Deep Learning","version":3},"cited_work":{"arxiv_id":"1905.10988","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.10988","snapshot_observed_at":"2026-08-04T21:06:27.648687Z","title":"Natural Compression for Distributed Deep Learning","venue":"cs.LG","work_id":"ee87290d-ecdd-42bf-b259-fc64fa098d69","year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.192317Z"},"links":{"cited_paper":"/paper/1905.10988","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:bfea0957e7704a829ea7fc365847f5dc95ed452d47657404faed06e6368c8ec4","observation_id":"9e26ece1-4ab9-48e0-aa1a-e6a0775d539b","resolution":{"observed_at":"2026-08-04T21:06:27.652008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.195110Z","title":"Fjord: Fair and accurate federated learning under heterogeneous targets with ordered dropout","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.195110Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f41ba3a9feea4d43b1162cfd0e9e46d1962229d46067629fc70c3bbd3b67c39b","observation_id":"c1425405-6695-49d3-b7b5-2c4c7138473c","resolution":{"observed_at":"2026-08-04T21:06:26.195110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.01977","last_updated":"2023-07-11T13:09:37Z","snapshot_observed_at":"2026-08-10T04:39:14.531164Z","submitted_at":"2022-12-05T01:58:45Z","title":"Distributed Pruning Towards Tiny Neural Networks in Federated Learning","version":2},"cited_work":{"arxiv_id":"2212.01977","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.01977","snapshot_observed_at":"2026-08-04T21:06:27.634408Z","title":"Distributed Pruning Towards Tiny Neural Networks in Federated Learning","venue":"cs.LG","work_id":"ad8ff349-6f5a-412a-86e7-8ba618b3f77e","year":2022},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.197934Z"},"links":{"cited_paper":"/paper/2212.01977","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:2147eab66f72f164dce62171d838fe41e1188d5648f9b725e8c072aa19eb7a95","observation_id":"c8c527c3-bb92-48b9-b26c-0e183cc9e50d","resolution":{"observed_at":"2026-08-04T21:06:27.638110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.01876","last_updated":"2020-03-04T03:42:54Z","snapshot_observed_at":"2026-08-09T14:59:32.125310Z","submitted_at":"2020-03-04T03:42:54Z","title":"Privacy-preserving Learning via Deep Net Pruning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.01876","snapshot_observed_at":"2026-08-04T21:06:26.201232Z","title":"Privacy-preserving learning via deep net pruning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.201232Z"},"links":{"cited_paper":"/paper/2003.01876","citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:59aff9f63c63c591c9e0cfc42b944dfd80daba5cd2031e8debc9e3e24b00f4c5","observation_id":"505b1bc2-9360-4eb6-a49d-be658c8f986f","resolution":{"observed_at":"2026-08-04T21:06:26.201232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.204330Z","title":"Quantized neural networks: Training neural networks with low precision weights and activations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.204330Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:71b14bcafaf31d0ca46fa7e2cc5a9cea3864f18f336ad8e2c73e5347a2874a4a","observation_id":"a3a8bc76-06cb-42f2-979c-d5937ebca6cc","resolution":{"observed_at":"2026-08-04T21:06:26.204330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.207208Z","title":"Towards practical differentially private convex optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.207208Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:f975b0725454e35059483e5f075d18e94c172b77be7312ddddafb8c778c3a418","observation_id":"161b76c4-21ed-414e-9e30-9f4611e63253","resolution":{"observed_at":"2026-08-04T21:06:26.207208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:06:26.210255Z","title":"Communication-efficient distributed dual coordinate ascent","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-04T21:06:26.210255Z"},"links":{"citing_paper":"/paper/2509.08233"},"observation_digest":"sha256:0f04194cda89ed142b445d20fe2a3def859d6d1c16a7b73b11a603bffaf2e910","observation_id":"1bcc9a61-35bc-4444-b1a0-cc3c8d4b288c","resolution":{"observed_at":"2026-08-04T21:06:26.210255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08233","last_updated":"2025-09-10T02:19:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T06:55:03.018292Z","submitted_at":"2025-09-10T02:19:56Z","title":"Strategies for Improving Communication Efficiency in Distributed and Federated Learning: Compression, Local Training, and Personalization"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":92,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":254},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 254 outbound references and 0 inbound Pith citation observations for arXiv:2509.08233."}