{"as_of":"2026-08-09T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8bec39a7f1ef3f70c5f4a94974f8f8bd89c81601390b660c5dcb439b06b54bf7","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:35:15.809725Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05508/citation-record","integrity":"/paper/2507.05508/integrity","json":"/paper/2507.05508/citation-record.json","paper":"/paper/2507.05508"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:16.261167Z","title":null,"venue":null,"work_id":"38016c79-e0d0-49b2-b936-81949a3f530d","year":2024},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.629410Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:25c954c281174164df324cd18baadd43aa59c5848fe352fdeb1ba2dfd82030cd","observation_id":"fdd19bdc-73b6-4a7a-b02b-f8199f46c394","resolution":{"observed_at":"2026-08-06T19:35:16.334086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02527","last_updated":"2016-10-08T13:25:15Z","snapshot_observed_at":"2026-07-06T05:13:51.685562Z","submitted_at":"2016-10-08T13:25:15Z","title":"Federated Optimization: Distributed Machine Learning for On-Device Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02527","snapshot_observed_at":"2026-08-06T19:35:15.249355Z","title":"B., Ramage, D., and Richt´arik, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.249355Z"},"links":{"cited_paper":"/paper/1610.02527","citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:5235e911eb0d0a6e9c141ed2aad70938a8776b9f47233f41159d5b9c9695857b","observation_id":"a31e98e1-287f-4f60-a5b5-0cdd689c7d0c","resolution":{"observed_at":"2026-08-06T19:35:15.249355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.09269","last_updated":"2023-12-28T11:46:43Z","snapshot_observed_at":"2026-07-06T07:29:14.938525Z","submitted_at":"2019-01-26T19:50:45Z","title":"Distributed Learning with Compressed Gradient Differences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.09269","snapshot_observed_at":"2026-08-06T19:35:15.337111Z","title":"Recht, B., R´e, C., Wright, S","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.337111Z"},"links":{"cited_paper":"/paper/1901.09269","citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:79445d89b08763f314257374082471939062be2c6e0c244e6877ddce7957335f","observation_id":"9d4e5667-3ad4-45e2-b4c5-4edfee898bad","resolution":{"observed_at":"2026-08-06T19:35:15.337111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-06T19:35:15.408085Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.408085Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:6bc950c54f05fa85c3eec2de820132b03af63f9ab29fefdec8de2ae8173fd551","observation_id":"5a9fb2f5-c614-4460-9173-bf165094de05","resolution":{"observed_at":"2026-08-06T19:35:15.408085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06917","last_updated":"2021-07-14T18:09:08Z","snapshot_observed_at":"2026-07-31T18:13:22.254060Z","submitted_at":"2021-07-14T18:09:08Z","title":"A Field Guide to Federated Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06917","snapshot_observed_at":"2026-08-06T19:35:15.489941Z","title":"12 A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.489941Z"},"links":{"cited_paper":"/paper/2107.06917","citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:9722f4beac2498d36dbfc26991b0cc21e04656e7ada9b06bb8fc29fd457bb212","observation_id":"01bb538a-bccc-4c5e-a20d-945250b145f2","resolution":{"observed_at":"2026-08-06T19:35:15.489941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:16.109873Z","title":"(2023), nonconvex case): 1 T TX t=1 E ∥∇f (xt)∥2 ∈ O ∆1L αT + ∆1Lσ1/2 α1/2T 3/4 + ∆1Lσ√ M T (101) Let us consider our bounds in Eq","venue":null,"work_id":"30423b34-a700-4191-9f71-d4c1f4446eca","year":2023},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.708703Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:cc81065cb6880d0c4665c11f6bb9ddb6f65ddbb7aa00d1d7ef2f5763cf213ef5","observation_id":"66dc3bcc-70cf-4192-adf7-f60c028f2283","resolution":{"observed_at":"2026-08-06T19:35:16.188514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:15.953166Z","title":"The proof follows very similarly to the one for the convex case","venue":null,"work_id":"3cc2c257-e352-4be0-9fdc-a03b18d7a493","year":2024},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.809725Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:8043917112446380992cbe6301870a14a9295e91fd290460a41550bde3ea9cef","observation_id":"baefb806-fc69-4015-9a35-ea6e6dd315e6","resolution":{"observed_at":"2026-08-06T19:35:16.022191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:16.440498Z","title":"1 (pl t,i)2 (∆l t,i)2 # (47) amd by writing the expectation w.r.t pl explicitly, we have: E[∥˜gt,i∥2] = LX l=1","venue":null,"work_id":"38d030d4-219c-4acf-ae45-28088f55f7bf","year":2026},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.557161Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:6d6ec51c290f4fb3a3c05a13c58f4d0415c15f3966756511ed28862163b04d1e","observation_id":"97af8c16-bcfd-4333-92c4-b785e9f810a8","resolution":{"observed_at":"2026-08-06T19:35:16.513489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T19:35:14.765383Z","title":"Devlin, J., Chang, M., Lee, K., and Toutanova, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.765383Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:dd99acba4841aa74d124dddecd783fa44adb5d11a8da6afbd67869a7218f297b","observation_id":"c2078293-d6a0-440c-820a-837ce74930d0","resolution":{"observed_at":"2026-08-06T19:35:14.765383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05115","last_updated":"2019-04-10T11:34:43Z","snapshot_observed_at":"2026-07-06T07:45:10.078720Z","submitted_at":"2019-04-10T11:34:43Z","title":"Stochastic Distributed Learning with Gradient Quantization and Variance Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05115","snapshot_observed_at":"2026-08-06T19:35:15.015767Z","title":"Jain, P., Netrapalli, P., Kakade, S","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.015767Z"},"links":{"cited_paper":"/paper/1904.05115","citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:202c3f782721c9f296e826de0e3625d50f1eb79f0c969a5a06e731cf1ae03751","observation_id":"1e0bbb86-cd5a-447d-8553-60052f67dadf","resolution":{"observed_at":"2026-08-06T19:35:15.015767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:16.601174Z","title":"Karimireddy, S","venue":null,"work_id":"af5483a3-8fe1-4fb7-95b1-5fc298e150a4","year":1935},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.118449Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:4f59df72be5c7a6b48276ea8922e915fc4dc4e3cf04969d1b1883f2049eee123","observation_id":"a14271f9-654c-4f39-9cf2-80403eb1a4c4","resolution":{"observed_at":"2026-08-06T19:35:16.671440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:16.774693Z","title":"Han, P., Wang, S., and Leung, K","venue":null,"work_id":"3f77688b-c2c8-4d78-b28a-cd4407d44a97","year":2020},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.899018Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:264f6d19add37840ba391ca26cc012ce59827d09d547686561f96f9c61a64668","observation_id":"2097dbd6-d6ae-425e-a7b4-a91d9ef7ebf4","resolution":{"observed_at":"2026-08-06T19:35:16.847903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:16.944074Z","title":"A., and Van Essen, B","venue":null,"work_id":"53e8ae20-d685-464b-9eac-90709f2cae01","year":2016},"citing_paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.828549Z"},"links":{"citing_paper":"/paper/2507.05508"},"observation_digest":"sha256:8d03780d598e90b6d95fd202da921a746d09f585f486c89274b018e394709c0b","observation_id":"93909637-2a09-48dc-80f2-7a1f3e95fa10","resolution":{"observed_at":"2026-08-06T19:35:17.015304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05508","last_updated":"2025-07-07T22:06:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T16:45:33.843592Z","submitted_at":"2025-07-07T22:06:04Z","title":"Beyond Communication Overhead: A Multilevel Monte Carlo Approach for Mitigating Compression Bias in Distributed Learning"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2507.05508."}