{"as_of":"2026-08-09T13:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86fcb811cc4b6c917e68de146d6d312e24921717de523d5b4d8a629f4ece6af6","coverage":[{"denominator":101,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:43:13.296512Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14371/citation-record","integrity":"/paper/2505.14371/integrity","json":"/paper/2505.14371/citation-record.json","paper":"/paper/2505.14371"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:01.910819Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:01.910819Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:780403cd0bc058ccb5d41c50bb1560a90fa04226829b70babc952b9294a521cc","observation_id":"99af8598-f2c6-4600-b70a-86a4dab376bb","resolution":{"observed_at":"2026-08-07T15:43:01.910819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.028908Z","title":"https://developer.nvidia.com/nccl, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.028908Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f8bcfb882c200f4e15ae3bb0d47900707f616743b1ae86c2e41576be95b1345a","observation_id":"e2990d4d-069e-46c6-be57-ab9572b3f385","resolution":{"observed_at":"2026-08-07T15:43:02.028908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.155148Z","title":"https://www.open-mpi.org/, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.155148Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:9e18c1126cc2189e8e53a8b2174244843363e3e84ce4240ab5dbcfee423ada80","observation_id":"dae022bb-9370-4fa2-aae6-d41d5a95a416","resolution":{"observed_at":"2026-08-07T15:43:02.155148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.255634Z","title":"Adaptive gradient communication via critical learning regime identification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.255634Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:7076dd068415132e236ff5b0024f9bb4cd6c80ec527b5012d3f3f5d289227e5f","observation_id":"10e4eb10-889c-4764-bbf2-f3c782b1d7a6","resolution":{"observed_at":"2026-08-07T15:43:02.255634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.405303Z","title":"QSGD : Communication-efficient SGD via gradient quantization and encoding","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.405303Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:8261c0c8346df7e6ed780c5f88c1407175f134cd2aa09a5e2f18ffd28d22374a","observation_id":"b8974dd5-fec8-4e56-9ddd-57f8114a4a81","resolution":{"observed_at":"2026-08-07T15:43:02.405303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.533247Z","title":"An adaptive mirror-prox method for variational inequalities with singular operators","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.533247Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:4db4dc4077f460e1f9f4149b2679255ea81c4ec968bc11eb85bffac7db56b19a","observation_id":"77bf7afe-6429-4bdb-a631-245e215af6e2","resolution":{"observed_at":"2026-08-07T15:43:02.533247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.702793Z","title":"Sifting through the noise: Universal first-order methods for stochastic variational inequalities","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.702793Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:9515dd955c99123ec7f5a3336d1ca86b73014115e98793f2830d53d4a2a7a8c7","observation_id":"dad8cd02-f690-41fe-8094-cb8459b7bc32","resolution":{"observed_at":"2026-08-07T15:43:02.702793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:02.817315Z","title":"Wasserstein generative adversarial networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.817315Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:0fee4ca7b14c97b054442b115a205cba62c1a7966b866a4f503afce3fffcd7d3","observation_id":"885b981a-d659-490a-a47a-11868a3604eb","resolution":{"observed_at":"2026-08-07T15:43:02.817315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11038","last_updated":"2024-11-17T11:06:36Z","snapshot_observed_at":"2026-08-06T02:49:40.575590Z","submitted_at":"2024-11-17T11:06:36Z","title":"EfQAT: An Efficient Framework for Quantization-Aware Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11038","snapshot_observed_at":"2026-08-07T15:43:02.930476Z","title":"Efqat: An efficient framework for quantization-aware training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.930476Z"},"links":{"cited_paper":"/paper/2411.11038","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:88e9da48125e8eaae3ba84b0499f6ac838cd3c016cc47ea8c571a679da9c4b18","observation_id":"8ee2f8ee-5d9a-4f9b-81fb-163df8b26359","resolution":{"observed_at":"2026-08-07T15:43:02.930476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.051545Z","title":"Adaptive and self-confident on-line learning algorithms","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.051545Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:6b8faae4c528efc5dd9184eb69b24f502ca8d3b28f3317ac81a3c213321a0db7","observation_id":"f629568b-0a79-44a6-9419-a7df04870ba7","resolution":{"observed_at":"2026-08-07T15:43:03.051545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.123721Z","title":"and Levy, K","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.123721Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f9a54a6d558c214e74226ee2700ec0dc104353cfb54443478af9e9574b58fe66","observation_id":"7261e5b5-0f62-44cb-abb6-17011798ac6d","resolution":{"observed_at":"2026-08-07T15:43:03.123721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.179060Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.179060Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:0de62e4ef748d779fa2d68c9e436ed2f389a830299137c29457215ad51d8b7dc","observation_id":"4e8567e3-8d99-4847-a3e3-fc6346aa5dfc","resolution":{"observed_at":"2026-08-07T15:43:03.179060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.275883Z","title":"Distributed methods with compressed communication for solving variational inequalities, with theoretical guarantees","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.275883Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:9ffb570f86e660e2e88082b0a9acf5a45ed762bb1e8817f6849e8f7a622612b1","observation_id":"bab555b6-5250-474a-a240-5cebd36c3eb9","resolution":{"observed_at":"2026-08-07T15:43:03.275883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.353995Z","title":"Bregman proximal method for efficient communications under similarity, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.353995Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:6f99b3381478875ce3c638bd9c4728c000cf4fde88528f1647890f77c3b300d6","observation_id":"1bb9bf10-228e-44e7-85e2-dec20e146798","resolution":{"observed_at":"2026-08-07T15:43:03.353995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.454669Z","title":"Stochastic gradient descent-ascent: Unified theory and new efficient methods","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.454669Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:927c9f58dbc46231a2c01a6802a59b686e7d071a5e9b6b2451022cfb4b151e36","observation_id":"61255909-3752-45e2-a2d4-878095a3904c","resolution":{"observed_at":"2026-08-07T15:43:03.454669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.516593Z","title":"and Pock, T","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.516593Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:1d2c56e3e3a9be9e6e0c8812e35dbd181b1c772ff2a239a18f944ea19e37af7b","observation_id":"1f76a932-4ff5-4deb-9434-43333ba62256","resolution":{"observed_at":"2026-08-07T15:43:03.516593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.689654Z","title":"Reducing noise in gan training with variance reduced extragradient","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.689654Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:96aa67afc7fa65401ffd8a477aee9f21d9a07113b5497e4d7b67e165239d873e","observation_id":"e4fbad1b-f542-440d-835c-580090659729","resolution":{"observed_at":"2026-08-07T15:43:03.689654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.806463Z","title":"Online optimization with gradual variations","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.806463Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:cab767f476b318e9b2527bb950e8c3b975a4a1504b597958d2645b781312e414","observation_id":"32e5aa7b-e7a3-43a9-abcf-7b355b9e4500","resolution":{"observed_at":"2026-08-07T15:43:03.806463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.907803Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.907803Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f825600e4779adbb9ec791b245cf119a8de7e98930c5868bb57c482b1b0e4680","observation_id":"a709230c-054b-4a5c-ab90-d2dc550689fc","resolution":{"observed_at":"2026-08-07T15:43:03.907803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:03.961656Z","title":"and Shanbhag, U","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:03.961656Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:251a9155ed2eaa67df47539a993791644a606b866bc157520a8cfe763bcfcf15","observation_id":"fe680cb5-ae38-4b1a-aceb-f1c9a2dab787","resolution":{"observed_at":"2026-08-07T15:43:03.961656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00141","last_updated":"2018-02-13T16:33:55Z","snapshot_observed_at":"2026-07-06T06:07:09.962753Z","submitted_at":"2017-10-31T23:09:08Z","title":"Training GANs with Optimism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00141","snapshot_observed_at":"2026-08-07T15:43:04.091042Z","title":"Training gans with optimism","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.091042Z"},"links":{"cited_paper":"/paper/1711.00141","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:e8bb1068354652153310a7950ba05a41abd5ac3ae14121e4becd4000898ed365","observation_id":"c2a9324c-1991-4221-a0dd-d34c129b306e","resolution":{"observed_at":"2026-08-07T15:43:04.091042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:04.214334Z","title":"Training GANs with optimism","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.214334Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:d170b5afccb897764f11ba3c0683db3e924bf3c85772db539dc47b8d3892cab9","observation_id":"ab2c41b2-eb68-4286-91d7-f128dea0748c","resolution":{"observed_at":"2026-08-07T15:43:04.214334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:04.264279Z","title":"New bounds for distributed mean estimation and variance reduction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.264279Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:7a3ed911e7456581e35f5502e3a6d251740a8fa62515d78dc117956c69ba6f7e","observation_id":"710542b4-301c-46e3-9a8f-ea6172eb6642","resolution":{"observed_at":"2026-08-07T15:43:04.264279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.787168Z","title":"S., Monga, R., Chen, K., Devin, M., Mao, M","venue":null,"work_id":"0bb6d493-f3a1-4204-bbd1-19968ba5269d","year":2012},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.336251Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:745351c680847380b59a68f5bec3eabe1b250a741f8e48ee78e429682f9d0bee","observation_id":"22402975-b741-4e9c-a8c8-184dc28cb1f3","resolution":{"observed_at":"2026-08-07T15:43:32.937322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.560301Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"5ee6df88-ab78-4880-8ab9-92d6d76328b6","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.427713Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:cf3bd60407c50a42750de6137438ffb36108437bcca4c340b786526aaece6c10","observation_id":"967f88cb-456a-4a0c-b313-02804cc44b3c","resolution":{"observed_at":"2026-08-07T15:43:32.672988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.358885Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":"e5f2415a-877f-4097-938f-fdd18c8a48e2","year":2011},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.527843Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:29becf46e909cbbddd8d33617f32571337ca3347cb4e6f92c1297a21a3cff998","observation_id":"52f94582-d077-434c-8ae4-5d6d4f1e3088","resolution":{"observed_at":"2026-08-07T15:43:32.438468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.120046Z","title":"H., Abdelmoniem, A","venue":null,"work_id":"9aa3f626-6f62-4e7f-a41d-6a8f53a80e02","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.608388Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:fd1c973b1a7141b79d168dbaca7ceb88fc8d05b960d7ecc25eec0faf1d05a0fe","observation_id":"bed699e8-bc77-440f-b5ca-274ce2e3dc9d","resolution":{"observed_at":"2026-08-07T15:43:32.241448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1975.10553","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:15.316607Z","title":"Universal codeword sets and representations of the integers","venue":null,"work_id":"e7cbc91d-fd43-4315-b019-8f90acd14b8e","year":1975},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.766778Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:269aa0b8a91a68e6d76695f3e6686b02199fa4b07cac153c9b6d4dfc07bdc1e9","observation_id":"0ab9a798-9d14-42e0-a640-dda8da4a4b1f","resolution":{"observed_at":"2026-08-07T15:43:15.453503Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.910703Z","title":"and Le Nguyen, H","venue":null,"work_id":"9fec6bee-caa7-4e51-833d-1ff069a6d8f2","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.877700Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:78e16fbcfb304588687d56d31ac5538e018227282159a2b890cf8f122f6b9a4a","observation_id":"4eff3904-8e8c-4a05-a7c7-9615a105aaa9","resolution":{"observed_at":"2026-08-07T15:43:31.972180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.755042Z","title":"and Pang, J.-S","venue":null,"work_id":"304250fe-7459-41a6-9b33-09478ca728bd","year":2003},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:04.969150Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:ce8bbbb891e3d7e1811576f7cfe3d1651f624ffbc973f0db5f2bdbd986b7e645","observation_id":"266d6a2d-2f57-4d8f-aee0-f98061d7b9ee","resolution":{"observed_at":"2026-08-07T15:43:31.830434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.600007Z","title":"M., and Ramezani-Kebrya, A","venue":null,"work_id":"3b294460-a314-422f-bb32-ff9eab3ed257","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.086290Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:1902457304bf4580e39ce68924758fba3edbbe0cbfa8847b6cc2b509092f76dd","observation_id":"719211c2-b7ee-45cb-80e2-ec28f8da027a","resolution":{"observed_at":"2026-08-07T15:43:31.643926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:05.228080Z","title":"OPTQ : Accurate quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.228080Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:3d4e71e54975c53fcdf0e5b4869764582a0a7300825b7ffcd2d34eb33b047b1b","observation_id":"5bc36ca0-9a46-4c0c-afaf-cd3c310e0798","resolution":{"observed_at":"2026-08-07T15:43:05.228080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.10551","last_updated":"2020-08-28T20:51:28Z","snapshot_observed_at":"2026-07-06T06:25:54.451916Z","submitted_at":"2018-02-28T17:40:05Z","title":"A Variational Inequality Perspective on Generative Adversarial Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.10551","snapshot_observed_at":"2026-08-07T15:43:05.374415Z","title":"A variational inequality perspective on generative adversarial networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.374415Z"},"links":{"cited_paper":"/paper/1802.10551","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:3da3e3d2b5ec8167cf130d3a574707c6d9b29e41246fdbad597c4da823b9aee2","observation_id":"319369f3-063f-4e99-8367-056c2fecdf45","resolution":{"observed_at":"2026-08-07T15:43:05.374415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.382000Z","title":"A variational inequality perspective on generative adversarial networks","venue":null,"work_id":"f667a8dd-bc32-4033-bef6-108960a7d6b4","year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.458184Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:b03e7f23a412b8286792e522b6609f5885f36c57001aac24bd42999cbc20f4a2","observation_id":"bf035ff8-e59a-47b6-8c1a-2db0b7408c43","resolution":{"observed_at":"2026-08-07T15:43:31.482269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.148534Z","title":"Generative adversarial nets","venue":null,"work_id":"05bb7f27-fbcc-44dd-8a67-ed55747e955e","year":2014},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.543464Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f911ad99d607adb923eb744d2134276b1ab622a87945818ed737329c6cfb043e","observation_id":"a5984b5a-5681-4beb-a707-c0a8f271ae87","resolution":{"observed_at":"2026-08-07T15:43:31.253983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.895738Z","title":"Accelerating distributed deep learning by adaptive gradient quantization","venue":null,"work_id":"d9d84f19-8931-490a-bb45-22d0ef6bd0df","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.690100Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:5bc0512b71bd6e7aec4a434afa0ed978f7791a697d86f2eb635761b4db886a46","observation_id":"05721bd5-f0a2-4338-825c-fcb5b1a21ca1","resolution":{"observed_at":"2026-08-07T15:43:30.994758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:05.918144Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:05.918144Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:ab19de8f93fbb76d82cc08ef0f392c1d88ced742ea91ffbff4d19e83c627a94e","observation_id":"be71d469-7abc-4af5-9e67-7466d0b3c9df","resolution":{"observed_at":"2026-08-07T15:43:05.918144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.710554Z","title":"Stochastic distributed learning with gradient quantization and double-variance reduction","venue":null,"work_id":"9afed433-73d7-487a-a436-9e5fcc7200cd","year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.057259Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:8aba8930f0f93cb0cf6ffa66c3aceb931f14ab170bfb5617e97dfd4c53b6d110","observation_id":"d4bc6531-3bf1-48ca-872c-2ecca1e79c73","resolution":{"observed_at":"2026-08-07T15:43:30.781032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.484053Z","title":"Explore aggressively, update conservatively: Stochastic extragradient methods with variable stepsize scaling","venue":null,"work_id":"ff4e45f4-5ca2-4950-b13c-dc9d5495fa84","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.239863Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:07b99e7b572e43fd70f5bbbc86574abc791179a7a1d602fdd21fac626f2c845f","observation_id":"6d113eca-06d9-4b46-874e-68e20aa9341c","resolution":{"observed_at":"2026-08-07T15:43:30.548351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.230824Z","title":"Adaptive learning in continuous games: Optimal regret bounds and convergence to nash equilibrium","venue":null,"work_id":"0d89171f-5a06-4ea4-9b5f-c1df433222c3","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.341198Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:cc0372d9e2f647676744e90f5bc3c67c10b5ef2ed4bd5aeba8f324e8728339d2","observation_id":"e29dde7d-89b6-4a8d-bc43-ec072809397b","resolution":{"observed_at":"2026-08-07T15:43:30.350292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:26.017935Z","title":"No-regret learning in games with noisy feedback: Faster rates and adaptivity via learning rate separation","venue":null,"work_id":"5f3fa621-5dae-4b7d-9497-c947fcdb4dff","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.550626Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:cbfb5fbbd012da04053e763de43d02ba97404ed05d57c616b364d2d14340df7e","observation_id":"f1bf06d3-0675-4bf5-9b3e-d29cd3117649","resolution":{"observed_at":"2026-08-07T15:43:27.046442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:06.726274Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.726274Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f63df19ab5ea6b9c10595067bcde6959fef7ce7698375fb898e3eac6bc6d0bd0","observation_id":"b0949b2b-5af3-4fbb-817a-ae0df3746771","resolution":{"observed_at":"2026-08-07T15:43:06.726274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.748050Z","title":"N., Jofr \\'e , A., Oliveira, R","venue":null,"work_id":"3472cccc-4679-434e-8199-ed3cf28aed11","year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.863506Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:6273dd772598e82f7e1cc3769163fa5aaee3e5a12e299ad3b19cfdb8b47c644a","observation_id":"d89be226-4937-4841-854a-cdf97a977294","resolution":{"observed_at":"2026-08-07T15:43:25.851144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.554752Z","title":"and Sidford, A","venue":null,"work_id":"453efbfe-2842-401c-911d-2e020b09ed11","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:06.983131Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:5b486d8abea116acee69abb1fb17e262e34c33c800a60b7192fa57839d280da9","observation_id":"72a685f9-10e7-4029-8005-3d74f7440150","resolution":{"observed_at":"2026-08-07T15:43:25.623104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.287363Z","title":"Solving variational inequalities with stochastic mirror-prox algorithm","venue":null,"work_id":"5c7a6681-7ba6-49d6-aadb-8ada352bc743","year":2011},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.126876Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:55f6bb90930e55bbc2f14c0d1fabf439a9f5cf08201ac3b0d378b19ab9f1a3a8","observation_id":"70701d06-933e-43a9-90ad-7cfd1235b017","resolution":{"observed_at":"2026-08-07T15:43:25.393669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:24.932432Z","title":"B., Avent, B., Bellet, A., Bennis, M., Bhagoji, A","venue":null,"work_id":"7c2f8394-8399-41da-9505-a624fafa32af","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.279900Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:68c0bf80d1dade6f66fb4198826b3957aab522fc3ba5ffc805ac5cb1147f5ea8","observation_id":"92d09cd2-2ee9-48f3-88b7-452282b0a702","resolution":{"observed_at":"2026-08-07T15:43:25.043889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:24.684182Z","title":"Robust reinforcement learning via adversarial training with langevin dynamics","venue":null,"work_id":"ff12bd54-5cf3-4dd3-b5d7-d8e386942abc","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.397791Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:483cde4e21e32c33b7dea13c23187e79e44666ed7043f7fb7e4f5de612316fb9","observation_id":"6930d33c-9765-46ec-a45e-751c872521af","resolution":{"observed_at":"2026-08-07T15:43:24.775001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:24.334761Z","title":"and Shanbhag, U","venue":null,"work_id":"011019e0-332a-4005-8562-b3648c1b918b","year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.555378Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:fc781bf3d0efd8e6a8be34e502670d200c72e9ec11f419d0030f31e2e0c2b464","observation_id":"7f874994-1d51-4b40-aeaf-90cad10fcd8d","resolution":{"observed_at":"2026-08-07T15:43:24.563687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.912809Z","title":null,"venue":null,"work_id":"60d0228b-e405-47e8-8361-bfa4488f9606","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.652661Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:a640d081be0c1e4c2170cfc57ca7642b759d86e75e206152ec9faba0155273c8","observation_id":"173570c5-310d-4d8a-9b9b-91d7abd5bd22","resolution":{"observed_at":"2026-08-07T15:43:24.095079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:07.765577Z","title":null,"venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.765577Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:a76e197a461ea5f911e2fc087ab30e5a981efc5a53049473804496d131b8318f","observation_id":"5a8868cb-6a96-4665-97c2-598fbe382eda","resolution":{"observed_at":"2026-08-07T15:43:07.765577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.696257Z","title":"Optimal algorithms for decentralized stochastic variational inequalities","venue":null,"work_id":"78052a42-267b-409c-af5a-ac6da0d055dd","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.858372Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:1af5a0ba769dee93a67ce1280cdfcdb1e7358d093df240f15874364faa6c2389","observation_id":"f2ae1acc-3078-4140-a492-790d5f35db1c","resolution":{"observed_at":"2026-08-07T15:43:23.764482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:07.990694Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:07.990694Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:0844752d563ab5ea14ca44bf840ec4f006b332468cb444c3f0a7e1d10d498023","observation_id":"89eb0717-5671-4c99-b8e4-febb2b1f1df7","resolution":{"observed_at":"2026-08-07T15:43:07.990694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.455621Z","title":"Y., Yurtsever, A., and Cevher, V","venue":null,"work_id":"3cc689db-035f-4216-9709-295a5bb4c607","year":2018},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.065270Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:a6d6ae828740c6a6c2d7c6074de2033da51d2445f04a719c019acfac6a1f8a72","observation_id":"27d98848-0d24-403a-bfbc-184e69e22fc2","resolution":{"observed_at":"2026-08-07T15:43:23.528593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.222835Z","title":"Det-cgd: Compressed gradient descent with matrix stepsizes for non-convex optimization","venue":null,"work_id":"0d5e50cf-d8c8-44ee-bdd5-e4b1fde34c34","year":2024},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.197476Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:5deb0f846c5714316cf1e7232320fb22f186076cae17082a29b9c6b813ac62e0","observation_id":"84640e9d-f05b-41f9-93f0-6c5c208256a6","resolution":{"observed_at":"2026-08-07T15:43:23.315228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:08.298615Z","title":"K., Talwalkar, A., and Smith, V","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.298615Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:20726caefe4033955c345e4e2712729f485d5c98821110dfd20c7c697432c829","observation_id":"817b80e0-5392-4d44-a328-dd2dfcd2200e","resolution":{"observed_at":"2026-08-07T15:43:08.298615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.022604Z","title":"Finite-time last-iterate convergence for multi-agent learning in games","venue":null,"work_id":"9de98955-31d7-4488-9faf-9fc5cd25276a","year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.447558Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:c5188b5974441ab82d2328717082c7b3c26191be5ba04e51073f7d78a65dc61e","observation_id":"c8ef3562-1486-42ae-be43-7df71c3a1b24","resolution":{"observed_at":"2026-08-07T15:43:23.122366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00188","last_updated":"2022-10-31T23:09:01Z","snapshot_observed_at":"2026-07-06T14:12:49.553124Z","submitted_at":"2022-10-31T23:09:01Z","title":"Adaptive Compression for Communication-Efficient Distributed Training","version":1},"cited_work":{"arxiv_id":"2211.00188","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.00188","snapshot_observed_at":"2026-08-07T15:43:14.963493Z","title":"Adaptive Compression for Communication-Efficient Distributed Training","venue":"cs.LG","work_id":"5b0680c6-7dec-41bf-bf8c-244ae9b9d798","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.529344Z"},"links":{"cited_paper":"/paper/2211.00188","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:09627728978f2c9d6a4a22d03a0c73020434272597882a7b4ddd89cd39a51e89","observation_id":"679d918a-0fc5-45d8-ba28-2dcb482b61e4","resolution":{"observed_at":"2026-08-07T15:43:15.018902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.825440Z","title":"Projected reflected gradient methods for monotone variational inequalities","venue":null,"work_id":"f22ab183-6e76-41ee-8992-68f1889bec33","year":2015},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.637605Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:15505a4c83008974da4710ae7ae19b4345c385a107bb613058eca059379ae2a8","observation_id":"ec6a53ad-7b0c-4676-8a4a-07059ef52b4e","resolution":{"observed_at":"2026-08-07T15:43:22.934854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.633981Z","title":"Golden ratio algorithms for variational inequalities","venue":null,"work_id":"2b9b23da-22ff-42d1-a94e-c122276e1682","year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.727760Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:d955cab5b5acd37d45b5a6310b731488d91d1c5cbc94e0c8c4ab9520a8c4213d","observation_id":"bd7781e7-f631-40fb-bd57-edaf8f296bb9","resolution":{"observed_at":"2026-08-07T15:43:22.703758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.444249Z","title":"Cgx: adaptive system support for communication-efficient deep learning","venue":null,"work_id":"bbac1528-2414-4506-8c2d-169dc7d8268e","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.823460Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:cb1e494655a62d6e1fc054f6f0cbd85268bf26d85c09024b179406c75f4a59e5","observation_id":"86288cc2-73b2-4829-bfa1-64b4e1f7d790","resolution":{"observed_at":"2026-08-07T15:43:22.530413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.235312Z","title":"L-greco: Layerwise-adaptive gradient compression for efficient data-parallel deep learning","venue":null,"work_id":"41b73d72-b315-4141-9c8e-c0e5fe7c3d0d","year":2024},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:08.964833Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:de31dd95be3ffe879dd94568a703bc3ec01160f7f71f10cb0069dadd3802ae4c","observation_id":"9b0335c0-f150-449b-bdd8-7b00667940ad","resolution":{"observed_at":"2026-08-07T15:43:22.312236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:09.115269Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.115269Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:2ab5976b44575d175b7a34ddcfd1947f8ef2eb19750e28d3f747af561bebcf3b","observation_id":"dfe37ab8-21dc-4dba-91e4-ed849a7ba4cc","resolution":{"observed_at":"2026-08-07T15:43:09.115269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1002.4908","last_updated":"2010-07-07T19:07:16Z","snapshot_observed_at":"2026-07-06T02:04:37.023313Z","submitted_at":"2010-02-26T01:36:34Z","title":"Adaptive Bound Optimization for Online Convex Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1002.4908","snapshot_observed_at":"2026-08-07T15:43:09.208938Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.208938Z"},"links":{"cited_paper":"/paper/1002.4908","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:af6154547ad5410752bf24a83399b3b714eabd38be09a8ed60150581027aa527","observation_id":"ac5b9f13-810a-460d-ab42-e95ee75c071f","resolution":{"observed_at":"2026-08-07T15:43:09.208938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02629","last_updated":"2018-10-01T23:11:31Z","snapshot_observed_at":"2026-08-09T08:14:41.854103Z","submitted_at":"2018-07-07T08:08:33Z","title":"Optimistic mirror descent in saddle-point problems: Going the extra (gradient) mile","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02629","snapshot_observed_at":"2026-08-07T15:43:09.283738Z","title":"Optimistic mirror descent in saddle-point problems: Going the extra (gradient) mile","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.283738Z"},"links":{"cited_paper":"/paper/1807.02629","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:09b7b4f18980f92310805208ad2eeb0dfe9ba13c30d31493fc66f02d087b4b66","observation_id":"563fac6f-470a-49ad-ac05-2764683bcd32","resolution":{"observed_at":"2026-08-07T15:43:09.283738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.988186Z","title":"Intsgd: Adaptive floatless compression of stochastic gradients","venue":null,"work_id":"d1dbec2f-71ff-4222-b7cc-8641d2ba5de7","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.411499Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:bfa8d9c26cf32cd74487a61ca11a7fc50b82694036355bd0ed4ab18b9c1886ce","observation_id":"03a86cd5-4450-4b8d-9527-b4e3b52e859c","resolution":{"observed_at":"2026-08-07T15:43:22.044751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.767956Z","title":"Distributed learning with compressed gradient differences","venue":null,"work_id":"a3e158b4-56e9-44b4-b48b-8a36768a11f1","year":2024},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.534796Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:156af317570b80f8afb0a3da84b2a96347fa9df9bbdb16a7971d9f7131ea742f","observation_id":"8396f1ff-a0d8-4ea3-a9b4-2b32175b678d","resolution":{"observed_at":"2026-08-07T15:43:21.903346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08511","last_updated":"2019-09-05T16:19:23Z","snapshot_observed_at":"2026-08-09T11:55:34.336270Z","submitted_at":"2019-01-24T17:09:10Z","title":"A Unified Analysis of Extra-gradient and Optimistic Gradient Methods for Saddle Point Problems: Proximal Point Approach","version":4},"cited_work":{"arxiv_id":"1901.08511","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.08511","snapshot_observed_at":"2026-08-07T15:43:14.692977Z","title":"A Unified Analysis of Extra-gradient and Optimistic Gradient Methods for Saddle Point Problems: Proximal Point Approach","venue":"math.OC","work_id":"176e63bd-871a-4351-93f9-b005cfd3a57d","year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.714739Z"},"links":{"cited_paper":"/paper/1901.08511","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:6c03f00aeadf9f935d151cb8dfc1eb7d94c22c3bd4c21bff911ece08d5c2e300","observation_id":"d8b6a7ac-b63d-4eec-8530-e3ded17bd7a5","resolution":{"observed_at":"2026-08-07T15:43:14.822487Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01115","last_updated":"2020-09-29T17:43:22Z","snapshot_observed_at":"2026-07-06T07:57:40.237841Z","submitted_at":"2019-06-03T22:54:41Z","title":"Convergence Rate of $\\mathcal{O}(1/k)$ for Optimistic Gradient and Extra-gradient Methods in Smooth Convex-Concave Saddle Point Problems","version":3},"cited_work":{"arxiv_id":"1906.01115","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.01115","snapshot_observed_at":"2026-08-07T15:43:14.505536Z","title":"Convergence Rate of $\\mathcal{O}(1/k)$ for Optimistic Gradient and Extra-gradient Methods in Smooth Convex-Concave Saddle Point Problems","venue":"math.OC","work_id":"f0797499-7fde-430d-bd95-fef827d3e7d2","year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.797622Z"},"links":{"cited_paper":"/paper/1906.01115","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:88915f669d471865166ee47eafc07fb4ba75dde9c1f2e12a6cf3e7137f560636","observation_id":"b8b69285-041e-4f06-b101-ad7e7d7aee2d","resolution":{"observed_at":"2026-08-07T15:43:14.596502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.587788Z","title":"Prox-method with rate of convergence o(1/t) for variational inequalities with lipschitz continuous monotone operators and smooth convex-concave saddle point problems","venue":null,"work_id":"c9489bac-dbaf-47b5-bba7-522841b92537","year":2004},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:09.891634Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:9469d52481e99e971eff9878dd210a0b6705d45c542d724e81aada1e1867e440","observation_id":"f874265f-2a4f-4b40-a9af-65d09ce3d5fa","resolution":{"observed_at":"2026-08-07T15:43:21.650281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:10.002753Z","title":"Robust stochastic approximation approach to stochastic programming","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.002753Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:6330ef7661e081e29b23d79529ff14e46dc9272fe2c2300d4db403f36eb0fadf","observation_id":"a6cafcba-d9a3-4548-8794-478514bfbf45","resolution":{"observed_at":"2026-08-07T15:43:10.002753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.294369Z","title":"Introductory Lectures on Convex Optimization: A Basic Course","venue":null,"work_id":"6a6d6987-b6da-40c4-ae7f-f7d982e679bd","year":2004},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.079913Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:29f5dcc43d9a39b3309943e5b744dee67be28f95bdea9543a303be93d11501a2","observation_id":"718f3028-35ad-46b8-8f6f-616af40f320f","resolution":{"observed_at":"2026-08-07T15:43:21.403892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.038855Z","title":"Dual extrapolation and its applications to solving variational inequalities and related problems","venue":null,"work_id":"60c42c5c-7c7a-4218-b5ce-a5d1a0a6db41","year":2007},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.173067Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:148dde7e599e75fda0ddf4feac8318fc52ed16f65bf5b7dc673b1d4c3f798a05","observation_id":"be174f62-2a91-4269-917b-69e3dec80519","resolution":{"observed_at":"2026-08-07T15:43:21.176062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:20.763566Z","title":"Primal-dual subgradient methods for convex problems","venue":null,"work_id":"dda812bd-e8ce-4af2-85ee-431a8fbefee8","year":2009},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.306518Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:b7686e98051f0ae2818d3f903f665645fb30bfaa0878600ead06de0dca308631","observation_id":"64937844-11c0-4cc3-8ed6-704897adbd53","resolution":{"observed_at":"2026-08-07T15:43:20.933831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:20.605816Z","title":"P., and Vian, J","venue":null,"work_id":"393b6949-9ae0-47e8-a849-7ef186d324b2","year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.407705Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:fc7fcb857c5b1c8401d8744882af25a40dcfae751597e175ff71a81373f19aaa","observation_id":"4ed56d01-4117-4f51-8b05-abeb8660b244","resolution":{"observed_at":"2026-08-07T15:43:20.676144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:10.574048Z","title":"and Soltanolkotabi, M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.574048Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:b9c6d9fa8ab1b06171861b4f3ae1c0eab1628926aad69c5af95bbeb5de49dc42","observation_id":"ee935c71-e16f-44e0-9170-956515b9529b","resolution":{"observed_at":"2026-08-07T15:43:10.574048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08949","last_updated":"2019-02-24T14:03:21Z","snapshot_observed_at":"2026-07-06T07:35:02.046018Z","submitted_at":"2019-02-24T14:03:21Z","title":"Training GANs with Centripetal Acceleration","version":1},"cited_work":{"arxiv_id":"1902.08949","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.08949","snapshot_observed_at":"2026-08-07T15:43:14.168306Z","title":"Training GANs with Centripetal Acceleration","venue":"cs.LG","work_id":"fff014cf-41ae-443a-947d-c7dc9ed80d8a","year":2019},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.728720Z"},"links":{"cited_paper":"/paper/1902.08949","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:61a3061a48506c70ba4c5fbfb342aa5e357b7d51a6173fb70d99e5213e53bf50","observation_id":"6c37b09d-373c-4f86-86ef-53eee291e73c","resolution":{"observed_at":"2026-08-07T15:43:14.308019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:20.340763Z","title":null,"venue":null,"work_id":"072a1c1e-11df-4fec-a928-4f44832e5c87","year":1987},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.834473Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f4cdd32e989a11eda3842b2935a3d35f2f3be7db02eff44a6ae0b2ab92ec093d","observation_id":"ac913823-8ccc-402e-b701-4b80d8eef385","resolution":{"observed_at":"2026-08-07T15:43:20.465765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:20.048600Z","title":null,"venue":null,"work_id":"dad1d3f4-9051-495a-9fbb-1edf6565e4ba","year":1980},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:10.996488Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:8dd504904317cdc2cfbf71192eabad0f821d0b0f006da00c0df2690bec52d5eb","observation_id":"622ea920-5af3-41f8-92a3-f8e2bfa301ef","resolution":{"observed_at":"2026-08-07T15:43:20.154546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.816450Z","title":null,"venue":null,"work_id":"dd5ff08f-3029-461e-87e7-1dc7e98eb029","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.126294Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:ba03d003de6e5bc771c4a20bafeccc13b0719b306698389693763d73c39ab020","observation_id":"9207e963-4c25-4189-be86-c0a7a07670e0","resolution":{"observed_at":"2026-08-07T15:43:19.888901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.526426Z","title":"Mixtailor: Mixed gradient aggregation for robust learning against tailored attacks","venue":null,"work_id":"4705727f-b900-4c69-9015-73a95f0d4ad0","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.237727Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:1a3bbfde5f3d14b9cb6c4457143821d9c57d5ed2f03ff3020820edfcecaef972","observation_id":"e63ac9d0-ec28-4c84-9dfb-27e02831a853","resolution":{"observed_at":"2026-08-07T15:43:19.654986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.254955Z","title":"Distributed extra-gradient with optimal complexity and communication guarantees","venue":null,"work_id":"bfb36055-b86e-413c-bf24-469411d8c8f6","year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.377916Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:e35d5ba24dd6343897bb3a2a59d00b723eeac4ca95b9b420b5448cf8d5bcc067","observation_id":"7c3bc914-4d3c-4b61-af4c-2f131eb7ec56","resolution":{"observed_at":"2026-08-07T15:43:19.367968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.019324Z","title":"Adversarially robust generalization requires more data","venue":null,"work_id":"4f5bd132-790a-4ac4-afe1-2722f9f44dea","year":2018},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.496246Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:a06a4e67fa41c13e51191530e030eb9fb28ed994f4f5ba2632b44f7eed1880fc","observation_id":"61a4f09c-e666-4da6-b747-76f7801ea6fa","resolution":{"observed_at":"2026-08-07T15:43:19.109312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:18.747729Z","title":"Scalable distributed DNN training using commodity GPU cloud computing","venue":null,"work_id":"c7327b17-39e5-4946-a8ac-68dd4dbdd5aa","year":2015},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.598185Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:13c453eb60bc5decb93325ed3305fbc06680389afcb87ca7694e6dfdc4382297","observation_id":"30847bc3-2da2-493d-ad5f-476810a26007","resolution":{"observed_at":"2026-08-07T15:43:18.862111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:18.523657Z","title":null,"venue":null,"work_id":"184fe9d7-cb00-4d7a-91b1-595f87aebac9","year":2015},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.723353Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:f14fe14d72394227880f9fda04d63986b4210843532a695496da390ae8c4dee5","observation_id":"0a73608f-6dcd-44b2-be56-50ba7315f390","resolution":{"observed_at":"2026-08-07T15:43:18.632188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:18.351018Z","title":null,"venue":null,"work_id":"954eaeb5-c239-4f66-94aa-52c53b34e92f","year":2012},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:11.902379Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:4fed6870573e019196e0b73da76619204d69dc77b87350440c676e88798e4668","observation_id":"37aa223e-64f9-4bdd-8eee-65ae1bbc0c4f","resolution":{"observed_at":"2026-08-07T15:43:18.403526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:18.080753Z","title":null,"venue":null,"work_id":"c462ce10-2116-4eb3-9120-810f6ffb2789","year":1987},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.009485Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:e35bf7fe5b8f731d5839043da38c4613b887f5f287ba49a0af2f3d079f16cce3","observation_id":"ff5fbdd6-bf07-4887-8d2d-ae476ac35091","resolution":{"observed_at":"2026-08-07T15:43:18.182723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:17.877395Z","title":"J., Wu, Y., Takac, M., Nandakumar, K., Horv \\'a th, S., and Gorbunov, E","venue":null,"work_id":"66ae2371-e0ca-4bd9-8531-3b991bb52830","year":2024},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.134309Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:4973d869738bd152e5044f3123dcf5ce58cb4666fd61efee36d92697dd205e01","observation_id":"71010c99-57e4-434d-b844-f4db42d91522","resolution":{"observed_at":"2026-08-07T15:43:17.976108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:17.714460Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":"2be969f7-7b56-4786-946f-28369e3dabd7","year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.217688Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:db3a81fe4f96a1d0e9c1483850cdc7159a6add717f3f5fd270cb7c6ddd56aa29","observation_id":"76988e9f-92f5-435e-86e6-eb7b0cea34e1","resolution":{"observed_at":"2026-08-07T15:43:17.777565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1991.15287","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:13.884953Z","title":"Delay jitter control for real-time communication in a packet switching network","venue":null,"work_id":"c16135a3-25f1-4c36-a3d6-2e1a4099b40c","year":1991},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.347533Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:5918589abb2cba9e65c5c5dbb2c9828ee7fea91924322e8051c5e8c4660f2a04","observation_id":"d9f84d80-1e66-4e50-9ce7-fafbabcb4d22","resolution":{"observed_at":"2026-08-07T15:43:14.027735Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:17.457881Z","title":"Theoretically better and numerically faster distributed optimization with smoothness-aware quantization techniques","venue":null,"work_id":"0a374513-fe5f-4dd4-aa74-8aaa6e1ccd74","year":2022},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.466923Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:532b241991f371e47f8731708055719a87b251cb1b150dc6d353a1892194ec90","observation_id":"4a0b54fc-c5c3-4e5d-8f47-bcf18ac3611a","resolution":{"observed_at":"2026-08-07T15:43:17.601636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:17.139765Z","title":"Atomo: Communication-efficient learning via atomic sparsification","venue":null,"work_id":"c45da465-eb61-411b-aed5-ce757c50890e","year":2018},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.574647Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:c8320472a54ca2c339ce3af7a546f54c817f53b6d3a2907e5fc9a3c6ca324729","observation_id":"cca203ec-4551-4432-a41b-b23067525c50","resolution":{"observed_at":"2026-08-07T15:43:17.284463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:16.907550Z","title":"TernGrad : Ternary gradients to reduce communication in distributed deep learning","venue":null,"work_id":"84ddf87e-e2fe-4f3d-bb00-fc69df3e7066","year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.670158Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:23e72921cbac896f8ff947191708c7bb2eee15f6247c461a0b89a1ab5db24750","observation_id":"ea5e5166-b618-4891-af95-36d9e5da89a9","resolution":{"observed_at":"2026-08-07T15:43:17.025567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:16.566962Z","title":"E., Bullins, B., Shamir, O., and Srebro, N","venue":null,"work_id":"136b3403-7966-48dd-bce0-9d5f8a16eb78","year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.773203Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:d50b1fef59de5cfef0b1cbb39cdfa4c8ba2280765f1a10f146dddd0a5ba398ef","observation_id":"eb5de229-bfdf-4a4d-8ea9-33112ddd8d17","resolution":{"observed_at":"2026-08-07T15:43:16.707106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:16.425752Z","title":"Mixed nash for robust federated learning","venue":null,"work_id":"b544ab03-d253-4459-b549-036929440a5f","year":2024},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.826677Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:4b9284824ad5e6006c1fa355a17cf8e9b5ca097d41ffaebf7ad1506718efc3ba","observation_id":"7c723383-0876-4df6-84d5-89e3f876f678","resolution":{"observed_at":"2026-08-07T15:43:16.478937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0048.36301","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:13.650227Z","title":"Kimad: Adaptive gradient compression with bandwidth awareness","venue":null,"work_id":"277dbd2e-7cb1-42a6-b32c-8eb92d998a2b","year":2023},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.910056Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:b1be70a041718cc463805947f96a0dec371b273855a903df4a1cd0f9a57a4f35","observation_id":"d2c99ca3-953c-499c-a075-de948e352c1a","resolution":{"observed_at":"2026-08-07T15:43:13.718731Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.04822","last_updated":"2018-04-23T09:45:02Z","snapshot_observed_at":"2026-07-06T05:51:15.659938Z","submitted_at":"2017-07-16T04:47:22Z","title":"Block-Normalized Gradient Method: An Empirical Study for Training Deep Neural Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.04822","snapshot_observed_at":"2026-08-07T15:43:12.951097Z","title":"W., Huang, L., Lin, Q., Salakhutdinov, R., and Carbonell, J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:12.951097Z"},"links":{"cited_paper":"/paper/1707.04822","citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:efbeb35327ad2fceb5a63a5a96012b6c4b0ef5174bbe046f648c2a769b7e6249","observation_id":"7e2eb9d5-bf51-4950-bce0-d761299755a5","resolution":{"observed_at":"2026-08-07T15:43:12.951097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:16.204076Z","title":"Distributed dual averaging method for multi-agent optimization with quantized communication","venue":null,"work_id":"0fbfe4c5-947f-492a-aef5-c05ef79662ba","year":2012},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:13.052843Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:6378096acf5944422f92d5b17c02de8cbf46ecb04b0f8bea16780e919b2e1953","observation_id":"5f045445-e606-4512-bc09-5b4ba8b90d4d","resolution":{"observed_at":"2026-08-07T15:43:16.276048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:13.145080Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:13.145080Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:8c10915c264b19e7a259633e4678540cfe7381da5c606b68342378f4bdb28912","observation_id":"2ac9c2f7-17dc-41c8-833d-6bdfc4f3f85a","resolution":{"observed_at":"2026-08-07T15:43:13.145080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:13.226800Z","title":"Understanding deep learning (still) requires rethinking generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:13.226800Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:4679a4ffb64dfce80350175aa3354bf56ebe82817f4611dd9e8396d3036f8ece","observation_id":"18fa1f5b-c047-4bf3-b6d0-db2b1393db3c","resolution":{"observed_at":"2026-08-07T15:43:13.226800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:15.934247Z","title":"ZipML : Training linear models with end-to-end low precision, and a little bit of deep learning","venue":null,"work_id":"8b6af2f1-7ae4-4b56-85d6-2bc7da09ff7a","year":2017},"citing_paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:13.296512Z"},"links":{"citing_paper":"/paper/2505.14371"},"observation_digest":"sha256:41738151cd1a04aaf0a49c1141356ebaf237439eaeff59b0daf4c0a9a5b351d8","observation_id":"b777c825-a9e3-49bc-911c-fa53e21f9b12","resolution":{"observed_at":"2026-08-07T15:43:16.069577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14371","last_updated":"2025-05-20T13:53:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T15:33:13.461487Z","submitted_at":"2025-05-20T13:53:58Z","title":"Layer-wise Quantization for Quantized Optimistic Dual Averaging"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":45,"verified_exact":4,"verified_fuzzy":48},"total_outbound_references":101},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 101 outbound references and 0 inbound Pith citation observations for arXiv:2505.14371."}