{"as_of":"2026-08-07T11:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c81d6549f8eda81f8d1d3aab6aeeb20dc4abd8f1e417f2cffe52eb6f72e1f426","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:23:38.229914Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14731/citation-record","integrity":"/paper/2607.14731/integrity","json":"/paper/2607.14731/citation-record.json","paper":"/paper/2607.14731"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:29.801382Z","title":"Revisiting consensus error: A fine-grained analysis of local sgd under second-order data heterogeneity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:29.801382Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:26249710d3cbefe18209c41c4260f5db1edeb0e5fac64d0e14a7f974202692c2","observation_id":"5333c85c-15d2-480e-8d71-a1f24e0b6cf0","resolution":{"observed_at":"2026-08-02T01:23:29.801382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:29.911747Z","title":"Federated learning: Collaborative machine learn- ing without centralized training data, Apr 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:29.911747Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:d342508a0d1e5a7e7576dea81e983aa9b672728d15ea0cd947699a1ff2069661","observation_id":"fe37dacc-1cc5-4c4b-9443-d2d9a4e3d7cd","resolution":{"observed_at":"2026-08-02T01:23:29.911747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08105","last_updated":"2024-09-23T10:41:27Z","snapshot_observed_at":"2026-08-04T10:53:01.395272Z","submitted_at":"2023-11-14T12:05:45Z","title":"DiLoCo: Distributed Low-Communication Training of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08105","snapshot_observed_at":"2026-08-02T01:23:30.172502Z","title":"Diloco: Distributed low- communication training of language models.arXiv preprint arXiv:2311.08105, 2023.(Cited on pages 2, 3, and 5)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.172502Z"},"links":{"cited_paper":"/paper/2311.08105","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:1a6ea84b43777eb54ee92826ee39f97ae5b96d1ac5da8a843b507035cdfe7c6c","observation_id":"2148f948-01ab-44ea-bc42-d3748978e21f","resolution":{"observed_at":"2026-08-02T01:23:30.172502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:30.283353Z","title":"Imagenet classification with deep convolutional neural networks.Advances in neural information processing systems, 25, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.283353Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:b2177068549c8b53b82663d9751cf057c14691f9dfc54ef1831e60187342d0a8","observation_id":"207b0d2b-e4a1-48e8-a4aa-56a43eda292a","resolution":{"observed_at":"2026-08-02T01:23:30.283353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.05629","last_updated":"2023-01-26T22:54:08Z","snapshot_observed_at":"2026-08-01T18:04:48.083997Z","submitted_at":"2016-02-17T23:40:56Z","title":"Communication-Efficient Learning of Deep Networks from Decentralized Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.05629","snapshot_observed_at":"2026-08-02T01:23:30.427304Z","title":"Federated learning of deep networks using model averaging.arXiv preprint arXiv:1602.05629, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.427304Z"},"links":{"cited_paper":"/paper/1602.05629","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:9f3ba49cc3e2d3e4d3729c58ce6187f750e556eea204f893d5a06a536efddaa6","observation_id":"7f934804-aacf-4bde-965e-8c355ad5e9ac","resolution":{"observed_at":"2026-08-02T01:23:30.427304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:30.554670Z","title":"Graph oracle models, lower bounds, and gaps for parallel stochastic optimization.Advances in neural information processing systems, 31, 2018.(Cited on pages 2 and 3)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.554670Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:0a1f285caa6c492608ed2c8bc291b9c2194de476fed30591238d63273382debe","observation_id":"1e4d267e-c7e5-4bae-9513-aab695b485fb","resolution":{"observed_at":"2026-08-02T01:23:30.554670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.04977","last_updated":"2021-03-09T03:03:49Z","snapshot_observed_at":"2026-08-06T02:25:34.414976Z","submitted_at":"2019-12-10T20:55:41Z","title":"Advances and Open Problems in Federated Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.04977","snapshot_observed_at":"2026-08-02T01:23:30.669742Z","title":"Advances and open problems in federated learning","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.669742Z"},"links":{"cited_paper":"/paper/1912.04977","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:f0de9ee420bcdabe843fc5a40f7d2ba5ee7d773b46db57607720c1a26a6573af","observation_id":"0344b03b-56c0-45ae-9f90-c0f295747a33","resolution":{"observed_at":"2026-08-02T01:23:30.669742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06917","last_updated":"2021-07-14T18:09:08Z","snapshot_observed_at":"2026-07-31T18:13:22.254060Z","submitted_at":"2021-07-14T18:09:08Z","title":"A Field Guide to Federated Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06917","snapshot_observed_at":"2026-08-02T01:23:30.815693Z","title":"A field guide to federated optimization.arXiv preprint arXiv:2107.06917, 2021.(Cited on page 2)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.815693Z"},"links":{"cited_paper":"/paper/2107.06917","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:643a5bb842c3e0ec42a112b2278f4eeade45ee2ce56d99cb476cb47bbd4b9fc1","observation_id":"2e0a2dd5-aac2-4227-a3b7-2a8d284aa987","resolution":{"observed_at":"2026-08-02T01:23:30.815693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:30.935131Z","title":"Scaffold: Stochastic controlled averaging for federated learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:30.935131Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:3bacf85dbbfdf2f281805030fe736c07618e80c32ec1650adeacf161867431fd","observation_id":"19b565ad-fe32-4295-abc8-50d32e290356","resolution":{"observed_at":"2026-08-02T01:23:30.935131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.053408Z","title":"A stochastic newton algorithm for distributed convex optimization.Advances in Neural Informa- tion Processing Systems, 34, 2021.(Cited on page 2)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.053408Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:4d2b7d0da3ad836bb9f0cb36f1cb66c32104cf674da5599bffcc6573668797d2","observation_id":"6e33e83d-e2f1-4d37-a159-2cbcd2c7db36","resolution":{"observed_at":"2026-08-02T01:23:31.053408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.161062Z","title":"To- wards optimal communication complexity in distributed non-convex optimization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.161062Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:5d120589d8650b6ffd40905cee55f4e313156cfb232d9ba7a6e35c77b2b827c0","observation_id":"25fcec20-b498-4928-aca8-c9d154b4fdc7","resolution":{"observed_at":"2026-08-02T01:23:31.161062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.259764Z","title":"Proxskip: Yes! local gradient steps provably lead to communication acceleration! finally! InInternational Conference on Machine Learning, pages 15750–15769","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.259764Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:aa3100c77b99f4449b7207129801fcca8e2bbe19f72319ee031c02600cf441d8","observation_id":"b265dfbc-634f-4eb3-b339-625f06273690","resolution":{"observed_at":"2026-08-02T01:23:31.259764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.347294Z","title":"Fedsplit: An algorithmic framework for fast federated optimization.Advances in neural information processing systems, 33:7057–7066, 2020.(Cited on page 2) 59","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.347294Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:cb516fb09a965568b20008bccb5672224be3ddacbc3958215910cf6d8a82598e","observation_id":"b8fc6ab5-0b26-402b-b370-e4e120330335","resolution":{"observed_at":"2026-08-02T01:23:31.347294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.425227Z","title":"Efficient large-scale distributed training of conditional maximum entropy models.Advances in neural information processing systems, 22, 2009.(Cited on pages 2 and 3)","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.425227Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:1463f59ac07d8d63e24b9aeacf0f27b1d5c9631a85cf78646d6e1bc23925686a","observation_id":"dad2f54b-edcd-4f6a-aa87-2ac8eed99f70","resolution":{"observed_at":"2026-08-02T01:23:31.425227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.527905Z","title":"Optimal distributed online prediction using mini-batches.Journal of Machine Learning Research, 13(1), 2012.(Cited on page 2)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.527905Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:038a56da22fd5416ed7b764306de8e7b180772f19b57d37b93234bfb29a2e10b","observation_id":"0756debe-2d47-40df-ad33-e0802b91ecdd","resolution":{"observed_at":"2026-08-02T01:23:31.527905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09767","last_updated":"2019-05-03T12:58:04Z","snapshot_observed_at":"2026-07-06T06:41:03.009337Z","submitted_at":"2018-05-24T16:38:51Z","title":"Local SGD Converges Fast and Communicates Little","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09767","snapshot_observed_at":"2026-08-02T01:23:31.636978Z","title":"Local sgd converges fast and communicates little.arXiv preprint arXiv:1805.09767, 2018.(Cited on pages 2, 3, 6, and 9)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.636978Z"},"links":{"cited_paper":"/paper/1805.09767","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:79193c01563702163e2f4cc1f0ce1db760904ea4940e47fc33c8d5ecb0bb038a","observation_id":"7a06bcfd-7e34-4d99-91c8-3d5019906aef","resolution":{"observed_at":"2026-08-02T01:23:31.636978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.745281Z","title":"Is local sgd better than minibatch sgd? In International Conference on Machine Learning, pages 10334–10343","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.745281Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:34c53099295e6ba72335950b9ec95acc8a72aaab21ba20a7e708baf0e7a9486d","observation_id":"14996d1a-09e4-4e59-b2ee-ec1062246cec","resolution":{"observed_at":"2026-08-02T01:23:31.745281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:31.916332Z","title":"Communication-efficient distributed optimization using an approximate newton-type method","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:31.916332Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:75d245b37a4e8c219ffd5a1482e62ef8c8373c498a9ff14ae20a7f29d8eb786a","observation_id":"2b4e8741-eae6-49d8-a965-23ec119f669b","resolution":{"observed_at":"2026-08-02T01:23:31.916332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:32.049631Z","title":"Distributed optimization based on gradient tracking revisited: Enhancing convergence rate via surrogation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.049631Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:1b06d35a90e105cba92ad28dae2a2c6af7a9c24e63c9ae4bc7e9c413ca9514e7","observation_id":"8557a0fb-60e2-476d-8e54-28046de04be3","resolution":{"observed_at":"2026-08-02T01:23:32.049631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:32.195231Z","title":"Optimal gradient sliding and its application to optimal distributed optimization under similarity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.195231Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:be0f551e6765ab6a1f99eaf32ea85ae13d4104abad78a1528e33868f5ca72caa","observation_id":"a7d2cbdc-c4cf-4957-94a3-19bd0905c516","resolution":{"observed_at":"2026-08-02T01:23:32.195231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03606","last_updated":"2021-06-08T08:14:57Z","snapshot_observed_at":"2026-08-06T06:23:51.750062Z","submitted_at":"2020-08-08T21:55:07Z","title":"Mime: Mimicking Centralized Stochastic Algorithms in Federated Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.03606","snapshot_observed_at":"2026-08-02T01:23:32.303301Z","title":"Mime: Mimicking centralized stochastic algorithms in federated learning.arXiv preprint arXiv:2008.03606, 2020.(Cited on page 3)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.303301Z"},"links":{"cited_paper":"/paper/2008.03606","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:0060cdeb30bc7eb67594b8135dc14d4c12e6b17a28522bdf1e5d550404fe8bef","observation_id":"0e4881f0-f920-4e79-adce-d56fb15177c2","resolution":{"observed_at":"2026-08-02T01:23:32.303301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03198","last_updated":"2021-06-14T00:04:39Z","snapshot_observed_at":"2026-07-06T10:38:49.449496Z","submitted_at":"2021-02-05T14:32:28Z","title":"Bias-Variance Reduced Local SGD for Less Heterogeneous Federated Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03198","snapshot_observed_at":"2026-08-02T01:23:32.455654Z","title":"Bias-variance reduced local sgd for less heterogeneous federated learning.arXiv preprint arXiv:2102.03198, 2021.(Cited on pages 3 and 5)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.455654Z"},"links":{"cited_paper":"/paper/2102.03198","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:6e7d2adf09c49477c910a7497ec4d7e229e007093788bfe9f51fb9f0b41d573c","observation_id":"9b3d5ac0-bf3d-4774-a6d2-2969b9a37b45","resolution":{"observed_at":"2026-08-02T01:23:32.455654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:32.585018Z","title":"Federated optimization with doubly regularized drift correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.585018Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:067fa665bab445eb57d140a937789fb0cb527505087495651ae8690da3fbd0aa","observation_id":"7c5c9a13-a042-458c-a165-4de668db525d","resolution":{"observed_at":"2026-08-02T01:23:32.585018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:32.673629Z","title":"Stabilized proximal-point methods for federated optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.673629Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:eb1ce3e6f4de14d183a2e3366638dd523fbbcfaa5be37da0141d7886b02cc7d5","observation_id":"593f9e9e-abfb-4581-97bd-81e0f1364a00","resolution":{"observed_at":"2026-08-02T01:23:32.673629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:32.768382Z","title":"The limits and potentials of local sgd for distributed heterogeneous learning with intermittent communication","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.768382Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:6fea0afae3bd979cfec73768107a35ad321041de41d589f25eaf53780fb71ee5","observation_id":"e901d9c5-fe22-4e8b-8c52-c582257449ef","resolution":{"observed_at":"2026-08-02T01:23:32.768382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:32.905043Z","title":"Parallelized stochastic gradient descent.Advances in neural information processing systems, 23, 2010.(Cited on page 3)","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:32.905043Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:e5b9e01e62f7099e7e8ec6848d540372a7990c66f1ed38ad4b0a44504742d4e1","observation_id":"6c69e06c-a653-44cb-9e62-babcaa48bc77","resolution":{"observed_at":"2026-08-02T01:23:32.905043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07365","last_updated":"2016-06-23T16:23:35Z","snapshot_observed_at":"2026-08-07T07:42:15.183155Z","submitted_at":"2016-06-23T16:23:35Z","title":"Parallel SGD: When does averaging help?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.07365","snapshot_observed_at":"2026-08-02T01:23:33.058355Z","title":"Parallel sgd: When does averaging help?arXiv preprint arXiv:1606.07365, 2016.(Cited on page 3)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.058355Z"},"links":{"cited_paper":"/paper/1606.07365","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:23a4c18b31cdcf9b0ea8ee0e400071f36aca56f51c396ed3f8442b8ab53df180","observation_id":"2cc8deab-3d8a-4477-bba5-725b02071f76","resolution":{"observed_at":"2026-08-02T01:23:33.058355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:33.183436Z","title":"Communication trade-offs for local-sgd with large step size.Advances in Neural Information Processing Systems, 32, 2019.(Cited on page 3)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.183436Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:f3a44b507db8ff7cd188c36a1e7e5b754df51cc8b24e327f4cb9cbe3a66f8d6a","observation_id":"a21721e3-94c2-4571-b6d4-8e85301388e5","resolution":{"observed_at":"2026-08-02T01:23:33.183436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:33.297384Z","title":"Tighter theory for local sgd on identical and heterogeneous data","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.297384Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:85d7808e846b080f69a6e17cf78ec4ae4dc6c93daf37aca30058334c82f8584b","observation_id":"981d2a50-16ff-4a7e-a6cf-8b828a669bec","resolution":{"observed_at":"2026-08-02T01:23:33.297384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:33.409165Z","title":"A unified theory of decentralized sgd with changing topology and local updates","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.409165Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:d60ff09bfc6ebbf0c871b8409af71a56f4d8cfd101170d2209eb0d9e990e4de0","observation_id":"fc461de2-3810-4784-b3fa-078a6f1f349f","resolution":{"observed_at":"2026-08-02T01:23:33.409165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:33.518436Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.518436Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:f727850dd2f2b59adeccc462014de5f5cb0d1872cda9ade718d54f9b25385a6a","observation_id":"ec4b2f0b-f933-4668-84f7-f1fba4f2e131","resolution":{"observed_at":"2026-08-02T01:23:33.518436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:33.608093Z","title":"Federated accelerated stochastic gradient descent.Advances in Neural Information Processing Systems, 33:5332–5344, 2020.(Cited on page 3)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.608093Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:76422c0076563e461c8f0e3612bb62f84cade302e97e6766b40d4df44e867699","observation_id":"ee988099-68cd-4909-9d77-4d8bec448418","resolution":{"observed_at":"2026-08-02T01:23:33.608093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:33.764309Z","title":"The min-max complexity of distributed stochastic convex optimization with intermittent communication","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.764309Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:da2d50df1963577c199d602f0d1abc22c2cf95a47615c30b80e25e3cf59b0391","observation_id":"078753aa-ddef-4710-84b1-48f0416c7b6c","resolution":{"observed_at":"2026-08-02T01:23:33.764309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00534","last_updated":"2021-09-01T15:18:33Z","snapshot_observed_at":"2026-07-06T11:43:28.084184Z","submitted_at":"2021-09-01T15:18:33Z","title":"The Minimax Complexity of Distributed Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00534","snapshot_observed_at":"2026-08-02T01:23:33.887318Z","title":"The minimax complexity of distributed optimization.arXiv preprint arXiv:2109.00534, 2021.(Cited on pages 3 and 34)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:33.887318Z"},"links":{"cited_paper":"/paper/2109.00534","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:53b4c789377f2ebb820644829ef90f92a3ca17e136caea3dd6f7d7811f83d1ca","observation_id":"1045e958-2ddc-4e31-b309-b5cea591628d","resolution":{"observed_at":"2026-08-02T01:23:33.887318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:34.003071Z","title":"Sharp bounds for federated averaging (local sgd) and continuous perspective","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.003071Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:76b60b50ec40675d97b8052d039d7fc6999d90ff675642e367db8aad19e7e6b5","observation_id":"174e4db0-e822-4372-933b-cac6219dbe89","resolution":{"observed_at":"2026-08-02T01:23:34.003071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04723","last_updated":"2022-06-09T18:25:25Z","snapshot_observed_at":"2026-08-06T18:33:38.685868Z","submitted_at":"2022-06-09T18:25:25Z","title":"On the Unreasonable Effectiveness of Federated Averaging with Heterogeneous Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04723","snapshot_observed_at":"2026-08-02T01:23:34.128102Z","title":"On the unreasonable effectiveness of federated averaging with heterogeneous data.arXiv preprint arXiv:2206.04723, 2022.(Cited on page 3)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.128102Z"},"links":{"cited_paper":"/paper/2206.04723","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:0774e92014edfa45d605f673208a8cb5276c6b2d7c7820e9883bb1a1c09860b0","observation_id":"94606414-ef0b-4efa-a469-a8b6a066f6a1","resolution":{"observed_at":"2026-08-02T01:23:34.128102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:34.290366Z","title":"Federated online and bandit convex optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.290366Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:ffa07eabc7d312d55ef6b070ac8141ceb00bece4b657ded729b536b209717fd9","observation_id":"adf91b17-ae8f-405a-9d3a-9e686902fec1","resolution":{"observed_at":"2026-08-02T01:23:34.290366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:34.412226Z","title":"On the still unreasonable effectiveness of federated averaging for heterogeneous distributed learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.412226Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:83fe306f2efecb294d72be040cd973b54d8a75abfb146877e9ead70acaaf590f","observation_id":"bf303262-c5b1-4468-865c-b258ff32112f","resolution":{"observed_at":"2026-08-02T01:23:34.412226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:34.536439Z","title":"Refined analysis of constant step size federated averaging and federated richardson- romberg extrapolation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.536439Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:ba68555b499b38aadacd0cb47a396a566241cda7d12badced00b0ffd89295263","observation_id":"e61088c8-7efe-4cdf-b947-aaaca15d607b","resolution":{"observed_at":"2026-08-02T01:23:34.536439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00195","last_updated":"2025-06-30T19:06:02Z","snapshot_observed_at":"2026-08-06T21:19:32.997766Z","submitted_at":"2025-06-30T19:06:02Z","title":"What Makes Local Updates Effective: The Role of Data Heterogeneity and Smoothness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00195","snapshot_observed_at":"2026-08-02T01:23:34.666750Z","title":"What makes local updates effective: The role of data heterogeneity and smoothness.arXiv preprint arXiv:2507.00195, 2025.(Cited on pages 3 and 34)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.666750Z"},"links":{"cited_paper":"/paper/2507.00195","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:8bff28d58276a728c3e54ac882979f8bdbf922c35e79d2ee01f01789d9f42259","observation_id":"ec1363b4-437c-4472-83a7-f59a4de47b90","resolution":{"observed_at":"2026-08-02T01:23:34.666750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04443","last_updated":"2025-02-24T08:50:58Z","snapshot_observed_at":"2026-08-04T06:31:45.520148Z","submitted_at":"2025-01-08T11:52:43Z","title":"Revisiting LocalSGD and SCAFFOLD: Improved Rates and Missing Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04443","snapshot_observed_at":"2026-08-02T01:23:34.793452Z","title":"Revisiting localsgd and scaffold: Improved rates and missing analysis.arXiv preprint arXiv:2501.04443, 2025.(Cited on pages 3, 6, 7, 9, 11, 16, 18, 19, 21, and 22)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.793452Z"},"links":{"cited_paper":"/paper/2501.04443","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:53f58730de4bb57650d2c5e092bd81c99ba98d6c9bb793a74fb80fda68717949","observation_id":"580c4612-1c30-4bb8-bd24-dbeb03aa1177","resolution":{"observed_at":"2026-08-02T01:23:34.793452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:34.902190Z","title":"Understanding outer optimizers in local sgd: Learning rates, momentum, and acceleration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:34.902190Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:d9aa7e8f766d10382310204e87ad1c0083a22dd0c014cf741cd8b98c6314a651","observation_id":"d78ea2bf-f976-4365-8086-664496b4677d","resolution":{"observed_at":"2026-08-02T01:23:34.902190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09799","last_updated":"2025-03-12T20:04:38Z","snapshot_observed_at":"2026-07-06T20:51:36.789173Z","submitted_at":"2025-03-12T20:04:38Z","title":"Communication-Efficient Language Model Training Scales Reliably and Robustly: Scaling Laws for DiLoCo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09799","snapshot_observed_at":"2026-08-02T01:23:35.023489Z","title":"Communication-efficient language model training scales reliably and robustly: Scaling laws for diloco.arXiv preprint arXiv:2503.09799, 2025.(Cited on pages 3 and 5)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.023489Z"},"links":{"cited_paper":"/paper/2503.09799","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:560693950ce69d17898fd73c39a0c179aa29f61df842a81c22ac07c1a555823e","observation_id":"6811ed37-4c4c-4afc-a87e-a9ada013e3fe","resolution":{"observed_at":"2026-08-02T01:23:35.023489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23725","last_updated":"2026-06-02T01:19:21Z","snapshot_observed_at":"2026-08-05T10:16:46.501308Z","submitted_at":"2025-05-29T17:55:37Z","title":"MuLoCo: Muon is a practical inner optimizer for DiLoCo","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23725","snapshot_observed_at":"2026-08-02T01:23:35.139882Z","title":"Muloco: Muon is a practical inner optimizer for diloco.arXiv preprint arXiv:2505.23725, 2025.(Cited on page 3)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.139882Z"},"links":{"cited_paper":"/paper/2505.23725","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:7e8dda28544a0e67510a25104f3666a3a8b6a34e4b2fc68442959c8d548b88a9","observation_id":"921a40a5-c45f-412b-be36-dcf97bb0c60b","resolution":{"observed_at":"2026-08-02T01:23:35.139882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:35.251915Z","title":"Sparsified sgd with memory","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.251915Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:333c8cc08dde65f4cb0709b398076b8f1457e7e974443baeaa18cff105ef5139","observation_id":"be95cc7f-8847-40b2-a9c4-a108dad60c63","resolution":{"observed_at":"2026-08-02T01:23:35.251915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:35.410514Z","title":"Error feedback fixes signsgd and other gradient compression schemes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.410514Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:6bc71d3c0d1a1a9c8f2e2f64e821250c6bb5b29ef3716f27683a9042e5f94a1b","observation_id":"3b4ff6c2-3fdb-4752-b842-a2c29a0cd660","resolution":{"observed_at":"2026-08-02T01:23:35.410514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:35.553559Z","title":"EControl: Fast distributed optimization with compression and error control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.553559Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:ad12615a5a498cf8d8167319ec4e6437e28340d7165a284fc30768374c54adc0","observation_id":"691d8c5f-66d3-446e-b4b6-5555961b6e9a","resolution":{"observed_at":"2026-08-02T01:23:35.553559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:35.689926Z","title":"Federated learning with partial model personalization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.689926Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:442ec0193bfb7564c2b987d40f17e4582c69c79203f52b8a29958349f4dce7f4","observation_id":"7dbcb4da-4a0d-4434-9921-f4044207936d","resolution":{"observed_at":"2026-08-02T01:23:35.689926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:35.878690Z","title":"Partially personalized federated learning: Breaking the curse of data heterogeneity.Transactions on Machine Learning Research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.878690Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:58d24bbf72c00e1a340a6b1939ec9446f522665ec23b005da43f12aa9f5e0177","observation_id":"393942da-e835-4fe6-aebd-28ab3573fe7a","resolution":{"observed_at":"2026-08-02T01:23:35.878690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:35.979529Z","title":"The convergence of sparsified gradient methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:35.979529Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:3ac1958750a391f155e6d5719c81ba9e71b92636bb1ca28e815582df5bad0b34","observation_id":"9c82f1c9-7782-40ce-ba79-ce7255b56c2c","resolution":{"observed_at":"2026-08-02T01:23:35.979529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.089958Z","title":"On maintaining linear con- vergence of distributed learning and optimization under limited communication","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.089958Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:4b3aa098a379513ca86c9ddb6f059342eee109d5abdbf2aaf332afce3f675481","observation_id":"5879b3de-5128-4280-a70e-1ba2c87c49bb","resolution":{"observed_at":"2026-08-02T01:23:36.089958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.189427Z","title":"Communication-computation efficient gradient coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.189427Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:2e597895030416ad59d3dea9db9f0fc6cf8295bcf29a1960447c8adf9cfde8bf","observation_id":"47fd1cef-baf1-451c-a22e-8abaf26c5ea6","resolution":{"observed_at":"2026-08-02T01:23:36.189427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.331291Z","title":"The error-feedback framework: Better rates for sgd with delayed gradients and compressed updates.Journal of Machine Learning Research, 2020.(Cited on page 3)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.331291Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:fbc437f9a49ad53114e0a80af09f670673099f1ec0d7e8eebbe50c8d1ca54f4f","observation_id":"236027ff-6a7b-45ec-975e-888553c6a9e0","resolution":{"observed_at":"2026-08-02T01:23:36.331291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.453567Z","title":"Asgrad: A sharp unified analysis of asynchronous-sgd algorithms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.453567Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:b75967d33f7c74a2692429c495de064cfc21d0a2e68986a479cfc2a049552be8","observation_id":"62d35fd1-569c-4db5-81f2-8ba7722aae2b","resolution":{"observed_at":"2026-08-02T01:23:36.453567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.502435Z","title":"Federated learning with differential privacy: Algorithms and performance analysis.IEEE transactions on information forensics and security, 15:3454–3469, 2020.(Cited on page 3)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.502435Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:3d27505290828dcd184782d98ce88c8a27e8cab5739dc127df82966b25a2a9a1","observation_id":"5eb5423e-55fd-44c7-a728-b1ffef3404e3","resolution":{"observed_at":"2026-08-02T01:23:36.502435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.562785Z","title":"Shuffled model of differential privacy in federated learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.562785Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:6e8fedf805e0cefdd0582f1e2a3764a765721e18de8755e0682f4e7d024e2a0e","observation_id":"2dfd85cd-3956-4288-a460-65c2e2d79b52","resolution":{"observed_at":"2026-08-02T01:23:36.562785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.703911Z","title":"Private non-convex federated learning without a trusted server","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.703911Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:f08dc886eb5f348b8639f727cbfb7092841b4e39e1ef85359c7220361e7ce879","observation_id":"d0e10e10-6a80-4a6b-b4cb-8eae72300761","resolution":{"observed_at":"2026-08-02T01:23:36.703911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.864249Z","title":"Diff2: Differential private optimization via gradient differ- ences for nonconvex distributed learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.864249Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:7171bb01ca1b884acbae0e5f813a2f27a4642d59fe93c3ec1ae59621f746137a","observation_id":"129b7927-40d8-4a85-a41b-78fe2a9efe82","resolution":{"observed_at":"2026-08-02T01:23:36.864249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.936692Z","title":"Efficient private federated non-convex optimization with shuffled model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.936692Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:847525b652089377c6815bb10eed26bae0d67a8a199a78262d3881e056218b2d","observation_id":"3b19f9dd-1792-425a-8c37-462286ff828e","resolution":{"observed_at":"2026-08-02T01:23:36.936692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:36.996395Z","title":"Double momentum and error feedback for clipping with fast rates and differential privacy.arXiv preprint arXiv:2502.11682, 2025.(Cited on page 3) 62","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:36.996395Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:66674383f0d1f10191228ca65d180f1212b22e2c2cf76f5384e7dd706219ada8","observation_id":"c5b17f8e-762c-4ae2-8128-1a30c17cb166","resolution":{"observed_at":"2026-08-02T01:23:36.996395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13482","last_updated":"2025-02-19T07:10:32Z","snapshot_observed_at":"2026-07-06T20:39:02.049006Z","submitted_at":"2025-02-19T07:10:32Z","title":"Smoothed Normalization for Efficient Distributed Private Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13482","snapshot_observed_at":"2026-08-02T01:23:37.113173Z","title":"Smoothed normalization for efficient dis- tributed private optimization.arXiv preprint arXiv:2502.13482, 2025.(Cited on page 3)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.113173Z"},"links":{"cited_paper":"/paper/2502.13482","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:34cdd9fc71860c93d4bebda98887a5acdc27aec571f34b17988516c8c9894d7a","observation_id":"b46527ca-41a9-4d39-8be8-2e9dd294e0b9","resolution":{"observed_at":"2026-08-02T01:23:37.113173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:37.207654Z","title":"Byzantine stochastic gradient descent.Advances in neural information processing systems, 31, 2018.(Cited on page 3)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.207654Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:e270b14a49dc3c339ad8bb0140dfcc7bbb687d8666d1154774ad036f6d06d793","observation_id":"2ade7067-c53e-4fec-bdac-84ae4241bb1f","resolution":{"observed_at":"2026-08-02T01:23:37.207654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:37.249182Z","title":"Learning from history for byzantine robust optimization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.249182Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:833fec1cbf369ab4b2881f11ad7f20673a08baaf94d012e4a75d24431e0e2edf","observation_id":"e03a5f9e-2c6d-420c-8295-bee7f8012e39","resolution":{"observed_at":"2026-08-02T01:23:37.249182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:37.326765Z","title":"Byzantine-robust and differentially private federated optimization under weaker assumptions","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.326765Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:10ed008acd0c1dfa502a94a44868b4dd2b4ba714d486e52eb17e5622518cb0ff","observation_id":"82c03000-1081-49f1-958b-5f24e42a8649","resolution":{"observed_at":"2026-08-02T01:23:37.326765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00878","last_updated":"2020-07-02T04:45:55Z","snapshot_observed_at":"2026-07-06T09:34:39.590117Z","submitted_at":"2020-07-02T04:45:55Z","title":"On the Outsized Importance of Learning Rates in Local Update Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00878","snapshot_observed_at":"2026-08-02T01:23:37.433836Z","title":"On the outsized importance of learning rates in local update methods.arXiv preprint arXiv:2007.00878, 2020.(Cited on page 5)","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.433836Z"},"links":{"cited_paper":"/paper/2007.00878","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:7af1500b268baafba722b52202f4a281d65c82236ec8fe8b9156a1571d87774a","observation_id":"b561a93c-3057-4cf1-a937-6c61e1e04077","resolution":{"observed_at":"2026-08-02T01:23:37.433836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.07217","last_updated":"2020-02-17T11:42:10Z","snapshot_observed_at":"2026-07-06T06:56:49.530908Z","submitted_at":"2018-08-22T04:50:55Z","title":"Don't Use Large Mini-Batches, Use Local SGD","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.07217","snapshot_observed_at":"2026-08-02T01:23:37.539772Z","title":"Don’t use large mini-batches, use local sgd.arXiv preprint arXiv:1808.07217, 2018.(Cited on page 5)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.539772Z"},"links":{"cited_paper":"/paper/1808.07217","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:eb9f9b37882eadce32d61faec6dd1a060763e3a03b0c495aaefd39b5dcb538eb","observation_id":"a2dfdf7c-993d-4feb-9638-8a239feb9719","resolution":{"observed_at":"2026-08-02T01:23:37.539772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-07-06T05:46:07.424788Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-02T01:23:37.653772Z","title":"Accurate, large minibatch sgd: Training imagenet in 1 hour.arXiv preprint arXiv:1706.02677, 2017.(Cited on page 5)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.653772Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:aa48518351b8836038d778f213142d327eb73c97ea4cd2bc44e8ad20ff027651","observation_id":"0d80bc5a-f943-4357-8b2b-f078ca758424","resolution":{"observed_at":"2026-08-02T01:23:37.653772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:37.767708Z","title":"Collaborative pac learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.767708Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:8cc6e867699306b8f65d36c94b23f3d1a592cdf8165ba9712a6b05ccc281e32a","observation_id":"6a12d866-3385-412c-a97a-027761c28e97","resolution":{"observed_at":"2026-08-02T01:23:37.767708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16459","last_updated":"2023-11-28T03:34:22Z","snapshot_observed_at":"2026-08-05T01:04:12.456359Z","submitted_at":"2023-11-28T03:34:22Z","title":"On the Effect of Defections in Federated Learning and How to Prevent Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16459","snapshot_observed_at":"2026-08-02T01:23:37.851410Z","title":"On the effect of defections in federated learning and how to prevent them.arXiv preprint arXiv:2311.16459, 2023.(Cited on page 7)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:37.851410Z"},"links":{"cited_paper":"/paper/2311.16459","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:d0e8bbf8d47f5087b4d359c355023f177bbcf84a66b3a5b45ae004c8a089ec5a","observation_id":"b1eee434-dff8-41e9-aeb3-415144cee9d1","resolution":{"observed_at":"2026-08-02T01:23:37.851410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06869","last_updated":"2023-04-16T16:53:18Z","snapshot_observed_at":"2026-08-04T12:42:35.759626Z","submitted_at":"2021-08-16T02:57:06Z","title":"FedChain: Chained Algorithms for Near-Optimal Communication Cost in Federated Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.06869","snapshot_observed_at":"2026-08-02T01:23:38.000279Z","title":"Fedchain: Chained algorithms for near-optimal communication cost in federated learning.arXiv preprint arXiv:2108.06869, 2021.(Cited on page 13)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:38.000279Z"},"links":{"cited_paper":"/paper/2108.06869","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:9bbbb5045831e381261bedbd07f678397e53637e5449f8a601af3d5b0eecdccc","observation_id":"c539fe00-4a7c-441c-9992-d8e19325b983","resolution":{"observed_at":"2026-08-02T01:23:38.000279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:23:38.120742Z","title":"Quelques propriétés des opérateurs angle-bornés et n-cycliquement monotones.Israel Journal of Mathematics, 26(2):137–150, 1977.(Cited on page 19)","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:38.120742Z"},"links":{"citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:d70d504f74c66ab0873fc0a425fac954c7f67838fb57e66ac6f4950ec3476dac","observation_id":"fd1d70dc-5aae-43d4-b7c7-bd2c59aaefd1","resolution":{"observed_at":"2026-08-02T01:23:38.120742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0906.0807","last_updated":"2009-12-22T20:07:37Z","snapshot_observed_at":"2026-08-04T10:46:05.118056Z","submitted_at":"2009-06-04T01:11:22Z","title":"The Baillon-Haddad Theorem Revisited","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0906.0807","snapshot_observed_at":"2026-08-02T01:23:38.229914Z","title":"The baillon-haddad theorem revisited.arXiv preprint arXiv:0906.0807, 2009.(Cited on page 19) 63","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T01:23:38.229914Z"},"links":{"cited_paper":"/paper/0906.0807","citing_paper":"/paper/2607.14731"},"observation_digest":"sha256:48cf29e7e29bc915d947bd765b04b23c3a9c3da412ed38c1f24e5be89ea84e64","observation_id":"44ab9637-fda4-4941-823d-fa4eef0d28cc","resolution":{"observed_at":"2026-08-02T01:23:38.229914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14731","last_updated":"2026-07-16T08:56:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T18:32:12.673941Z","submitted_at":"2026-07-16T08:56:45Z","title":"What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2607.14731."}