{"as_of":"2026-08-08T05:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:66171988d771c7a32b6af3dae322edceac7ebac098ca43442a7f7ba867395492","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:36:50.562805Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:34:48.903774Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T16:34:48.928876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.18182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.18182","snapshot_observed_at":"2026-08-05T16:34:48.928876Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","venue":"cs.LG","work_id":"afd54600-c7a0-422c-b76e-84666e19f61d","year":2025},"citing_paper":{"arxiv_id":"2508.18181","last_updated":"2025-08-25T16:35:07Z","snapshot_observed_at":"2026-08-05T16:34:36.377149Z","submitted_at":"2025-08-25T16:35:07Z","title":"What is digital about abstraction?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T16:34:48.903774Z"},"links":{"cited_paper":"/paper/2508.18182","citing_paper":"/paper/2508.18181"},"observation_digest":"sha256:f95e06de58bf772deea8623190af8e5abc7fea1f852e91dcd6a2c6d700320f7c","observation_id":"b6c6a4f1-e616-49e0-8f72-f3d0dca0b319","resolution":{"observed_at":"2026-08-05T16:34:48.933802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.18182/citation-record","integrity":"/paper/2508.18182/integrity","json":"/paper/2508.18182/citation-record.json","paper":"/paper/2508.18182"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1710.11258","last_updated":"2017-10-30T22:01:56Z","snapshot_observed_at":"2026-07-06T06:06:54.331476Z","submitted_at":"2017-10-30T22:01:56Z","title":"Adaptive Sampling Strategies for Stochastic Optimization","version":1},"cited_work":{"arxiv_id":"1710.11258","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.11258","snapshot_observed_at":"2026-08-05T16:36:50.824857Z","title":"Adaptive Sampling Strategies for Stochastic Optimization","venue":"math.OC","work_id":"372f31bf-4f45-446c-bb7b-29720b6e7944","year":2017},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.489347Z"},"links":{"cited_paper":"/paper/1710.11258","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:63f5b4ec74a353b872680ecca4f50da2239fb90726c2efca4d984500c8cab146","observation_id":"9a9cfdc2-1215-45c2-89a2-0b9529789fc4","resolution":{"observed_at":"2026-08-05T16:36:50.830712Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.940026Z","title":"Byrd, Gillian M","venue":null,"work_id":"85eaca41-64fa-4da9-b589-914a400b51ac","year":2012},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.496519Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:665bc51a36a669875a80125454c6ebe936cefb05aa6a8267062c36c423541937","observation_id":"0dedbaec-4bce-41b4-bc00-a316b222f390","resolution":{"observed_at":"2026-08-05T16:36:50.949350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08105","last_updated":"2024-09-23T10:41:27Z","snapshot_observed_at":"2026-08-04T10:53:01.395272Z","submitted_at":"2023-11-14T12:05:45Z","title":"DiLoCo: Distributed Low-Communication Training of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08105","snapshot_observed_at":"2026-08-05T16:36:50.502069Z","title":"Rusu, Rachita Chhaparia, Yani Donchev, Adhiguna Kuncoro, Marc'Aurelio Ranzato, Arthur Szlam, and Jiajun Shen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.502069Z"},"links":{"cited_paper":"/paper/2311.08105","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:dbb89748efdbb181915a6b5ee8a8fa1007a9429315fd5a79cc32683960384e25","observation_id":"d20fa830-0265-4a0b-8cef-3700bff4f7c1","resolution":{"observed_at":"2026-08-05T16:36:50.502069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.910657Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":"fe1962a4-1940-4f27-9438-5e2c4cd784b3","year":2011},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.510950Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:2538e64744be4e21a88cd2f856b9427c7ab5a9d4f339c9a4dc3beeb71a7a0c0c","observation_id":"c2240402-f84f-4bff-bf6b-e03ee30bc0a8","resolution":{"observed_at":"2026-08-05T16:36:50.919427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13936","last_updated":"2024-11-06T04:53:36Z","snapshot_observed_at":"2026-07-06T18:33:58.846757Z","submitted_at":"2024-06-20T02:08:50Z","title":"Communication-Efficient Adaptive Batch Size Strategies for Distributed Local Gradient Methods","version":2},"cited_work":{"arxiv_id":"2406.13936","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13936","snapshot_observed_at":"2026-08-05T16:36:50.766291Z","title":"Communication-Efficient Adaptive Batch Size Strategies for Distributed Local Gradient Methods","venue":"stat.ML","work_id":"0b4c497e-a631-497b-aba4-06bc6b0e1e78","year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.517083Z"},"links":{"cited_paper":"/paper/2406.13936","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:07484de2a47cad089102c18092b93bdb5cbfe3d9d208bceb1a9353fc38a38145","observation_id":"f3fb0a2d-5752-45f3-9c02-a9c011bdbc33","resolution":{"observed_at":"2026-08-05T16:36:50.775729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11215","last_updated":"2024-05-28T05:40:38Z","snapshot_observed_at":"2026-08-04T06:40:34.301575Z","submitted_at":"2024-02-17T07:49:50Z","title":"AdAdaGrad: Adaptive Batch Size Schemes for Adaptive Gradient Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11215","snapshot_observed_at":"2026-08-05T16:36:50.522929Z","title":"Adadagrad: Adaptive batch size schemes for adaptive gradient methods, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.522929Z"},"links":{"cited_paper":"/paper/2402.11215","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:e4eb11c0749898f56d499295b8e2415f51b8a550e62e9d077aa281a9215c420d","observation_id":"d73c9710-d506-4114-b18f-8aad88581f0c","resolution":{"observed_at":"2026-08-05T16:36:50.522929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09767","last_updated":"2019-05-03T12:58:04Z","snapshot_observed_at":"2026-07-06T06:41:03.009337Z","submitted_at":"2018-05-24T16:38:51Z","title":"Local SGD Converges Fast and Communicates Little","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09767","snapshot_observed_at":"2026-08-05T16:36:50.529584Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.529584Z"},"links":{"cited_paper":"/paper/1805.09767","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:e730b92ab57cc799b063ad2119be0294a0974d75c29d38cae72d025c6b41680f","observation_id":"d83783d3-33d3-4d47-a3f5-abf2197918f1","resolution":{"observed_at":"2026-08-05T16:36:50.529584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.888954Z","title":"Microllama: A 300m-parameter language model trained from scratch","venue":null,"work_id":"4c118e9f-8122-4962-a09e-1b07e81369c9","year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.535734Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:526313b0d3c82392cbeac53be13e6d3b3087c8b4b51b47a85c437ca0fb629c49","observation_id":"34121115-5456-4696-b72b-d4227cc888ed","resolution":{"observed_at":"2026-08-05T16:36:50.895404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.540026Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.540026Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:4581fa604f3fde9f4ab7dbc6da5b360ad22674f9fc0e877bd9d70200bc74d76a","observation_id":"adfcd00d-5c64-48d2-aabc-d841230d7e95","resolution":{"observed_at":"2026-08-05T16:36:50.540026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.548224Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.548224Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:b9f2a5eb43ff8dc751d63fd16446a8187863b403b185c7c8b30ddac22c52f1c2","observation_id":"e49ff0ef-618d-4131-afdd-51cb07683ae7","resolution":{"observed_at":"2026-08-05T16:36:50.548224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.556449Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.556449Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:d29d81bee8f3f3ed7ad651d1246e54978e525c0046638eb6e346e9b8af287355","observation_id":"b8ab24f6-bb8d-4714-b057-87857e9d4efd","resolution":{"observed_at":"2026-08-05T16:36:50.556449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.562805Z","title":"7 x4f [ @w떆d bQ̪̺;Y̬7","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.562805Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:452a811e9ca96c5b74eb9ddd30186e08c5707ae41496622d34b2a96cdd51ff04","observation_id":"8c0c3f3f-decd-42c1-9808-1e904f37d80c","resolution":{"observed_at":"2026-08-05T16:36:50.562805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2508.18182."}