{"as_of":"2026-08-08T04:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e1312c78ce500a7efc1c6cd7ab7ee2b0c0170e9ab7b29c45b8e4fe87d46a94c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:04:35.283217Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":16,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2408.00929","last_updated":"2026-04-21T23:34:26Z","snapshot_observed_at":"2026-07-06T18:55:49.577776Z","submitted_at":"2024-08-01T21:37:10Z","title":"Verification of Machine Unlearning is Fragile","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-23T22:23:43.259499Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2408.00929"},"observation_digest":"sha256:f40409986b2a31243d15e8dcfe2addeba6e24c6be47616b093fcf2d6ae578953","observation_id":"73ecdd2d-78b4-4ff4-8022-25482c219537","resolution":{"observed_at":"2026-05-23T22:25:50.536454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-07T06:04:35.283217Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.06606","last_updated":"2025-06-07T00:47:07Z","snapshot_observed_at":"2026-08-08T00:08:47.523981Z","submitted_at":"2025-06-07T00:47:07Z","title":"Stacey: Promoting Stochastic Steepest Descent via Accelerated $\\ell_p$-Smooth Nonconvex Optimization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T06:04:35.283217Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2506.06606"},"observation_digest":"sha256:e95a00e130d404e1f120fcc4bcdc7ca8b0a8f0e681f253ec2137a0ff57f035f2","observation_id":"6e0e1739-bfa8-4629-b538-6d058bbd41d2","resolution":{"observed_at":"2026-08-07T06:04:35.283217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-07T05:20:07.917254Z","title":"and Stich, S","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.08558","last_updated":"2025-06-11T06:46:49Z","snapshot_observed_at":"2026-08-07T05:04:57.822407Z","submitted_at":"2025-06-10T08:27:01Z","title":"Optimization over Sparse Support-Preserving Sets: Two-Step Projection with Global Optimality Guarantees","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:07.917254Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2506.08558"},"observation_digest":"sha256:a4a823c27a66a026cae0b891b76bba39d097c38fd3f0daf70856a49fd633b68d","observation_id":"dfd23108-f78d-4794-86c6-2cd50b394b1b","resolution":{"observed_at":"2026-08-07T05:20:07.917254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-06T10:19:08.874670Z","title":", Stich , S.U","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.00267","last_updated":"2025-08-01T02:22:03Z","snapshot_observed_at":"2026-08-07T21:10:13.769334Z","submitted_at":"2025-08-01T02:22:03Z","title":"Neighbor-Sampling Based Momentum Stochastic Methods for Training Graph Neural Networks","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T10:19:08.874670Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2508.00267"},"observation_digest":"sha256:9b440e5b32c022f2f5bf170ca56aa3a6f3295555d36a59d5b5891ab20e232b53","observation_id":"67f6aa36-8aab-41fc-bc17-6767fa0759bb","resolution":{"observed_at":"2026-08-06T10:19:08.874670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-06T11:48:10.570043Z","title":"On the con- vergence of sgd with biased gradients","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.00922","last_updated":"2025-07-30T07:00:56Z","snapshot_observed_at":"2026-08-06T11:48:09.030082Z","submitted_at":"2025-07-30T07:00:56Z","title":"CaliMatch: Adaptive Calibration for Improving Safe Semi-supervised Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:48:10.570043Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2508.00922"},"observation_digest":"sha256:eb180e0ab77121b64d3fa7313ed4d4053b4f093657cf4a14a1426804724def09","observation_id":"711c965d-bef1-4183-9ddc-9ba52b79653f","resolution":{"observed_at":"2026-08-06T11:48:10.570043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-04T10:22:58.326295Z","title":"On the convergence of sgd with biased gradients","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.10854","last_updated":"2026-06-20T00:16:54Z","snapshot_observed_at":"2026-08-06T05:30:13.768584Z","submitted_at":"2025-10-12T23:33:46Z","title":"Discrete State Diffusion Models: A Sample Complexity Perspective","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:22:58.326295Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2510.10854"},"observation_digest":"sha256:6f89be1a5897085e986a5f8ac854f285531c9f90cf8bae5e435b11d628611791","observation_id":"25cf8e08-6015-46cf-89ba-dcf3c5b27c71","resolution":{"observed_at":"2026-08-04T10:22:58.326295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2604.15416","last_updated":"2026-04-16T17:55:36Z","snapshot_observed_at":"2026-07-06T23:02:58.361418Z","submitted_at":"2026-04-16T17:55:36Z","title":"StoSignSGD: Unbiased Structural Stochasticity Fixes SignSGD for Training Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T12:10:44.802059Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2604.15416"},"observation_digest":"sha256:5da53b8efd841e5597dc37c86fd5bc45d57862a657197377addb89078d7d55e0","observation_id":"9b4c3a94-5ba3-4c21-ac2e-9e7efd16f57b","resolution":{"observed_at":"2026-05-10T12:15:22.255624Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.05710","last_updated":"2026-05-07T05:55:10Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:55:10Z","title":"On the Blessing of Pre-training in Weak-to-Strong Generalization","version":1},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-05-08T14:59:19.883399Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.05710"},"observation_digest":"sha256:5fd582bdefde0fe64c59fcd6b446a70c502d6e7f1e04ddad7558e2fe3dd3fcdc","observation_id":"4f5cf886-a636-4217-bebb-29844a380db0","resolution":{"observed_at":"2026-05-11T18:36:08.560133Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.13434","last_updated":"2026-05-13T12:27:22Z","snapshot_observed_at":"2026-07-06T23:25:01.951546Z","submitted_at":"2026-05-13T12:27:22Z","title":"Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity","version":1},"reference_index":217,"source":"arxiv_source","source_observed_at":"2026-05-14T19:31:12.149482Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.13434"},"observation_digest":"sha256:a80cc20371bc2d5426e8271004db50ac87cd1351c59b85ddba9f786f33294bfd","observation_id":"8ceee93d-0ad8-47b1-abff-523ec59e9f39","resolution":{"observed_at":"2026-05-14T19:32:52.147043Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.16520","last_updated":"2026-05-15T18:14:38Z","snapshot_observed_at":"2026-08-02T14:37:22.154242Z","submitted_at":"2026-05-15T18:14:38Z","title":"Global Convergence of Sampling-Based Nonconvex Optimization through Diffusion-Style Smoothing","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T20:15:44.030714Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16520"},"observation_digest":"sha256:68a0ed3e03052ff7b9815245de49076f951aa145764fd0f9bd5f33c654e5695b","observation_id":"796735df-e8c1-493c-b227-b00dfd44dc5d","resolution":{"observed_at":"2026-05-20T20:18:59.256024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.16690","last_updated":"2026-05-15T23:06:59Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:06:59Z","title":"UB-SMoE: Universally Balanced Sparse Mixture-of-Experts for Resource-adaptive Federated Fine-tuning of Foundation Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-20T19:06:08.951475Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16690"},"observation_digest":"sha256:690328092af37357f7870f1bac16761278361b8f34b3a05c3c0c8b779b856808","observation_id":"a58217d0-0695-421a-92ab-0f69610fc47d","resolution":{"observed_at":"2026-05-20T19:08:54.375386Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.16875","last_updated":"2026-07-08T09:40:22Z","snapshot_observed_at":"2026-08-03T04:07:31.916506Z","submitted_at":"2026-05-16T08:36:29Z","title":"Stochastic Optimization and Data Science","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-19T21:08:29.524132Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16875"},"observation_digest":"sha256:e7f4e79cd3e8e75985a6d82ef39d7e3abaf05655d5babb272f30386003168290","observation_id":"843f7646-f85f-4356-8961-45b019d135fe","resolution":{"observed_at":"2026-05-19T21:12:47.227680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-07-12T16:40:49.519929Z","title":"Robbins and S","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2605.16875","last_updated":"2026-07-08T09:40:22Z","snapshot_observed_at":"2026-08-03T04:07:31.916506Z","submitted_at":"2026-05-16T08:36:29Z","title":"Stochastic Optimization and Data Science","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T16:40:49.519929Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16875"},"observation_digest":"sha256:e45055ed2e00481775173cb336c66573371d1c1a583edaf798bd144808f346e1","observation_id":"c5a8bdf2-af6e-408a-a38e-6fd17556d123","resolution":{"observed_at":"2026-07-12T16:40:49.519929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2606.18463","last_updated":"2026-06-16T20:14:34Z","snapshot_observed_at":"2026-07-06T23:53:54.600341Z","submitted_at":"2026-06-16T20:14:34Z","title":"Mixed-Precision Communication-Avoiding SGD for Generalized Linear Models on GPUs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T22:21:58.012861Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2606.18463"},"observation_digest":"sha256:284f7bf339cf059e5f711be16c085171d824f0b92682fb01d8098fa5da9af458","observation_id":"f28ef943-bea4-46e6-9944-8d42086d75aa","resolution":{"observed_at":"2026-07-03T23:29:02.055139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2606.20606","last_updated":"2026-05-21T21:32:19Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-21T21:32:19Z","title":"Distributed Quantum Learning over Near-term Devices: Convergence Analysis and Security Design","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T15:57:55.491466Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2606.20606"},"observation_digest":"sha256:6cb1f01f714f0ac51249d3cb877f3c4c972efcbb1fd5213a328cb3fbfeca35bd","observation_id":"abf2c709-16ec-4e16-af25-96b0a78bf770","resolution":{"observed_at":"2026-06-30T16:04:53.055841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-07-11T23:22:05.432957Z","title":"On the convergence of SGD with biased gradients.arXiv preprint arXiv:2008.00051,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.03871","last_updated":"2026-07-04T13:26:21Z","snapshot_observed_at":"2026-08-07T08:15:01.395392Z","submitted_at":"2026-07-04T13:26:21Z","title":"A Gradient Flow Perspective on Minimum MMD Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T23:22:05.432957Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2607.03871"},"observation_digest":"sha256:20a47f5cde956e22d0631b68b83ca25d2f19705068a9c58e14fe0979237353ef","observation_id":"2630799a-6d2d-4d12-833c-6656ad805507","resolution":{"observed_at":"2026-07-11T23:22:05.432957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2008.00051/citation-record","integrity":"/paper/2008.00051/integrity","json":"/paper/2008.00051/citation-record.json","paper":"/paper/2008.00051"},"outbound":[],"paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2008.00051."}