{"as_of":"2026-08-12T06:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b4e92052da40d2de4d8da1fcbf5eec06be822e0a1a9fba40847ccf3cda6862e","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:43:14.326705Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T17:31:02.850791Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T17:37:13.925711Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"cited_work":{"arxiv_id":"2510.14074","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.14074","snapshot_observed_at":"2026-07-14T03:22:45.605646Z","title":"Exact dynamics of multi-class stochastic gradient descent, 2025","venue":null,"work_id":"3b592ade-c45b-48ff-bb5f-f13030748a5c","year":2025},"citing_paper":{"arxiv_id":"2607.00207","last_updated":"2026-06-30T21:38:10Z","snapshot_observed_at":"2026-08-07T07:17:58.817162Z","submitted_at":"2026-06-30T21:38:10Z","title":"Homogenization of $\\ell_2$-Adversarial Training in High-Dimensions: Exact Dynamics under Stochastic Gradient Descent","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-02T17:31:02.850791Z"},"links":{"cited_paper":"/paper/2510.14074","citing_paper":"/paper/2607.00207"},"observation_digest":"sha256:2dc75c77a1b72c1e188caaf585486f31f89a880e3828160259b72fa3655119c7","observation_id":"21607f55-cac6-4e44-b83d-2fe74efa4909","resolution":{"observed_at":"2026-07-14T03:22:45.605646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.14074/citation-record","integrity":"/paper/2510.14074/integrity","json":"/paper/2510.14074/citation-record.json","paper":"/paper/2510.14074"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:08.662758Z","title":"Escaping mediocrity: how two-layer networks learn hard single-index models with SGD.CoRR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:08.662758Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:7c675c134ad31ee417cfbae25b219a8daa30b51ff250a1555c52ac1524e1e017","observation_id":"a07eb370-ec60-491e-956b-b025dfccb3b9","resolution":{"observed_at":"2026-08-04T09:43:08.662758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:08.759247Z","title":"From high-dimensional & mean-field dynamics to dimensionless ODEs: A unifying approach to SGD in two-layers networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:08.759247Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:4937570093ae4b6435c94fee2dc1e34f3fa37976f7ee9b817deba5558b7a1785","observation_id":"98e44c79-1ebd-4d77-b12c-2766efc8ece1","resolution":{"observed_at":"2026-08-04T09:43:08.759247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:08.934177Z","title":"Minimax theory for high-dimensional gaussian mixtures with sparse mean separation.Advances in Neural Information Processing Systems, 26, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:08.934177Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:65e1838cad0ba23c808369f3ccc6124d0a70fe0a53dcafa00dfd1daef4bf9bde","observation_id":"72a2f395-59a8-4157-8cf2-12836040937b","resolution":{"observed_at":"2026-08-04T09:43:08.934177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00707","last_updated":"2024-04-03T18:44:32Z","snapshot_observed_at":"2026-08-11T15:52:32.998618Z","submitted_at":"2023-04-03T03:50:00Z","title":"High-dimensional scaling limits and fluctuations of online least-squares SGD with smooth covariance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00707","snapshot_observed_at":"2026-08-04T09:43:09.084449Z","title":"High-dimensional scaling limits and fluctuations of online least-squares SGD with smooth covariance.arXiv preprint arXiv:2304.00707, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.084449Z"},"links":{"cited_paper":"/paper/2304.00707","citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:c416ef6c32f87a9cc8387886e5ad1043c944701dd0744bacc20cb3d04cc8edac","observation_id":"18c8ed93-829a-479d-85a1-07b97bd8be7c","resolution":{"observed_at":"2026-08-04T09:43:09.084449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.225286Z","title":"Spectrally-normalized margin bounds for neural networks.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.225286Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:ca251b6890a57281b11e7f2e0c98ca9d52eef51ec1c348db54bb5ccf94054c1c","observation_id":"0beadbd3-0bb5-49e5-9407-9e5cde07a855","resolution":{"observed_at":"2026-08-04T09:43:09.225286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.374734Z","title":"Local geometry of high-dimensional mixture models: Effective spectral theory and dynamical transitions.arXiv preprint arXiv:2502.15655, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.374734Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b802216a5a23fd518904a1f73bcf7efe947f78023fe84341d24f5b5cdbd1e150","observation_id":"2cdc4722-4599-4f3e-808f-a2b1b33ba480","resolution":{"observed_at":"2026-08-04T09:43:09.374734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.508327Z","title":"Online stochastic gradient descent on non- convex losses from high-dimensional inference.The Journal of Machine Learning Research, 22(1):4788– 4838, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.508327Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:79ff3751226955bdd5060d32e93413e04540f06c54f1ad0903e8394f312b3def","observation_id":"d458c512-1236-46e6-ab75-f3dbefd2298e","resolution":{"observed_at":"2026-08-04T09:43:09.508327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.689739Z","title":"High-dimensional limit theorems for SGD: Effective dynamics and critical scaling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.689739Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:c0bc9c0568b83592826b894ab6c22cefadc6dd1b70afacdc6b46aa489e0e8f79","observation_id":"7c4ee186-ed31-44c2-a7a0-65d68e331b73","resolution":{"observed_at":"2026-08-04T09:43:09.689739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.820533Z","title":"On-line learning with a perceptron.Europhysics Letters, 28(7):525, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.820533Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:a0309c08723bcb6dfbf7da0888fe649b3ef8011f8fe9c0fdc81e40e9ff5697dd","observation_id":"592d777b-d2b0-4249-a33a-0d0d9ac6677a","resolution":{"observed_at":"2026-08-04T09:43:09.820533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.941129Z","title":"Learning by on-line gradient descent","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.941129Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:0cfb7d3109e5aa7d425f2737324d86932f06729b3f4358360f5d649709c1f40d","observation_id":"ae175791-8f25-4d48-9804-25b7baae7430","resolution":{"observed_at":"2026-08-04T09:43:09.941129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.059555Z","title":"Learning curves for sgd on structured features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.059555Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:cb3052f28b9d83a05d7470f5c3224159610127767efa7797ce3ac473093b6dd7","observation_id":"911930c8-2506-470c-a881-4429791750c4","resolution":{"observed_at":"2026-08-04T09:43:10.059555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07572","last_updated":"2026-04-18T03:31:29Z","snapshot_observed_at":"2026-07-06T12:18:42.245356Z","submitted_at":"2021-12-14T17:29:32Z","title":"The high-dimensional asymptotics of first order methods with random data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.07572","snapshot_observed_at":"2026-08-04T09:43:10.183758Z","title":"The high-dimensional asymptotics of first order methods with random data.arXiv preprint arXiv:2112.07572, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.183758Z"},"links":{"cited_paper":"/paper/2112.07572","citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:842cd602f9ed04161dee98da94a47c3a43fd00f5ffb7a1a5f12eaade37082973","observation_id":"0b35ee0d-7fa7-405b-b2e8-ec3fcdda8a1d","resolution":{"observed_at":"2026-08-04T09:43:10.183758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.322964Z","title":"Sharp global convergence guarantees for iterative nonconvex optimization with random data.Ann","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.322964Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:83f581ea634563af6c17b24c9b2badf022eb4f15f35f4491952f019c003e4c0c","observation_id":"d7af9c46-eba3-4cfe-b74a-62b2e4f45cda","resolution":{"observed_at":"2026-08-04T09:43:10.322964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.489704Z","title":"Achieving optimal clustering in gaussian mixture models with anisotropic covariance structures","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.489704Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:fb88a7fa45a7179bb34bcd512c0a19c9bb7eab2ea377ef777eaa3c08588bf2ec","observation_id":"63db4703-0472-4232-87da-2088ce0fb78c","resolution":{"observed_at":"2026-08-04T09:43:10.489704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.616862Z","title":"Hitting the high- dimensional notes: An ode for sgd learning dynamics on glms and multi-index models.Information and Inference: A Journal of the IMA, 13(4):iaae028, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.616862Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:6e9bc1939f29bd7500a66aab23b87cf9bd3ad216c01ff4a9803a78d83183c0a4","observation_id":"9733b769-f2e7-4184-965f-10bd638991bb","resolution":{"observed_at":"2026-08-04T09:43:10.616862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.795167Z","title":"High-dimensional limit of one-pass SGD on least squares","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.795167Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:f22cfc17de2270bc785047ce8e2c6d1d2097aa2e2b54469bbbac68b8500d88af","observation_id":"0d2a9513-7772-4d20-9b5c-1b463757b0af","resolution":{"observed_at":"2026-08-04T09:43:10.795167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.920521Z","title":"Smoothing the landscape boosts the signal for sgd: Optimal sample complexity for learning single index models.Advances in Neural Information Processing Systems, 36:752–784, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.920521Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:aee658ee416622a25853d22912ef7cf84e2b5286f0753ef053eec5219b0b8966","observation_id":"57f81619-5ad7-4279-9022-3b437ceea752","resolution":{"observed_at":"2026-08-04T09:43:10.920521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.046787Z","title":"Universality laws for gaussian mixtures in generalized linear models.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.046787Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:a1c3f018f4a0c43495585ac50b134a616176c4a965c088ddf844d108711e2fc7","observation_id":"ca8ada67-5ec5-4a6e-abcc-8087aa093570","resolution":{"observed_at":"2026-08-04T09:43:11.046787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.142071Z","title":"The benefits of reusing batches for gradient descent in two-layer networks: Breaking the curse of information and leap exponents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.142071Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:917e108f5063b56e79ca891dceae79b8ed217540b87fc038fc44c79eea3eb964","observation_id":"79d8822b-e7d6-4a7b-963f-72e8ef0f720a","resolution":{"observed_at":"2026-08-04T09:43:11.142071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.291923Z","title":"High-dimensional asymptotics of prediction: Ridge regression and classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.291923Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:87e516da5d7818dac2d655dd4f29edee568cc6cd6b9bb12606d8a26e7fe3c9c8","observation_id":"3cac6827-63f8-4bac-9b6e-2246a7db3ada","resolution":{"observed_at":"2026-08-04T09:43:11.291923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.411374Z","title":"Rigorous dynamical mean-field theory for stochastic gradient descent methods","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.411374Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:5272f1b1aa55db5cdc70bdf3802df0d3ca4710d6de9cc62d62310dfe39d02fe9","observation_id":"32f67fba-4131-4916-80df-010cb57c48fb","resolution":{"observed_at":"2026-08-04T09:43:11.411374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.557818Z","title":"Dynamics of stochastic gradient descent for two-layer neural networks in the teacher-student setup.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.557818Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:4b77706eb31209bfeb7d8e81b5266eff209420a92da2b3d3942f57724ba32c1f","observation_id":"06024813-f1f2-4a30-99df-92033055e1a7","resolution":{"observed_at":"2026-08-04T09:43:11.557818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.680596Z","title":"The gaussian equivalence of generative models for learning with shallow neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.680596Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:60273daf718a2f2fef886c618cbf0a0fae934b2c403796b43f62113b112a9b55","observation_id":"c914d719-70ce-4d17-98a2-000d0d772ebe","resolution":{"observed_at":"2026-08-04T09:43:11.680596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.824766Z","title":"Modeling the influence of data structure on learning in neural networks: The hidden manifold model.Physical Review X, 10(4):041044, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.824766Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:fa229718554d9d75c6e0ced4441d600d6d0c415ade56fb69db0cb238d3bc1340","observation_id":"ebe60c50-00fb-467d-97f1-a9c1a4b1fb3b","resolution":{"observed_at":"2026-08-04T09:43:11.824766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.001956Z","title":"Minimax-optimal covariance projected spectral clustering for high- dimensional nonspherical mixtures.arXiv preprint arXiv:2502.02580, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.001956Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:630b3dea2890e8f79ad1837ad642f5050071cc5cec2c144fc27f086cc0fa9f93","observation_id":"c8fafa65-3eec-46e0-80d4-2054cc3e4fa4","resolution":{"observed_at":"2026-08-04T09:43:12.001956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.170682Z","title":"Fast margin maximization via dual acceleration","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.170682Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:3313f60bcdaad15fe7e7e915337a528e06dacc8b7f03584ca837be9b35dac2bb","observation_id":"d5dee034-428e-42b1-af0b-a078d524f833","resolution":{"observed_at":"2026-08-04T09:43:12.170682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.350658Z","title":"Characterizing the implicit bias via a primal-dual analysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.350658Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:68759d7f6eb636e0c9659da4e70b7e53d885493f07cbc55004dad72b52e2c747","observation_id":"23e8dfae-b4d7-48fe-913f-740e913dd6aa","resolution":{"observed_at":"2026-08-04T09:43:12.350658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.479518Z","title":"Trajectory of mini-batch momentum: batch size saturation and convergence in high dimensions.Advances in Neural Information Processing Systems, 35:36944–36957, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.479518Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b1f3da216f6adde1719789013c5291003f3f95cacf7cfc0e080179ff44794807","observation_id":"225d8dd0-1a8d-46ae-af0f-116d5d8e0ea7","resolution":{"observed_at":"2026-08-04T09:43:12.479518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.607058Z","title":"Phase transitions and optimal algorithms in high-dimensional gaussian mixture clustering","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.607058Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:5b13a03b41242073a5f47f31a87e10eebc8123fa9822c431910500a5db52dbd0","observation_id":"f6398622-2e8f-4bcd-90c5-c1fd43371e18","resolution":{"observed_at":"2026-08-04T09:43:12.607058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.723229Z","title":"Optimality of spectral clustering in the gaussian mixture model.The Annals of Statistics, 49(5):2506–2530, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.723229Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:c2dff69e36c4e9af7b786bf3dd814d0544c2930fdb3a104ec69c64dee510759e","observation_id":"7e71a636-828d-4233-b751-052319f99cae","resolution":{"observed_at":"2026-08-04T09:43:12.723229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.822188Z","title":"Learning curves of generic features maps for realistic datasets with a teacher-student model","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.822188Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:ae88bcb53ddd2c46302b7cdfeadf178ecf015e29d7af9433f1db8053235ceae2","observation_id":"edd76747-7d6b-432f-a13e-91284c25cfb3","resolution":{"observed_at":"2026-08-04T09:43:12.822188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.932987Z","title":"Learning gaussian mixtures with generalized linear models: Precise asymptotics in high- dimensions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.932987Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:66d26cb0b9c514c56269fb1783c37231308fc3041e668fb8b39236e3200b8f60","observation_id":"0b0923cf-3f23-402d-97f9-d8ee74acd3c6","resolution":{"observed_at":"2026-08-04T09:43:12.932987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.108461Z","title":"High dimensional classification via regularized and unregularized empirical risk minimization: Precise error and optimal loss.stat, 1050:25, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.108461Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b94e40187dcd044549035e68c6407a63d26f2acb33a848cdd2758379cea16c94","observation_id":"0ef4e9f0-f1d2-40cf-bfbf-b4f6e456a810","resolution":{"observed_at":"2026-08-04T09:43:13.108461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.248060Z","title":"Dynamical mean- field theory for stochastic gradient descent in gaussian mixture classification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.248060Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b0286d90427e17661556ba9818852d2e738038464c6b80ce59f74c95b42ddcd4","observation_id":"94a02753-fd48-422c-b009-0b2c9279c068","resolution":{"observed_at":"2026-08-04T09:43:13.248060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.365838Z","title":"Convergence of gradient descent on separable data","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.365838Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:9cdd0b9ecb3bdb80ff61e79601f87e4141c6d44f4185508b30d922d9611088a4","observation_id":"5fc4034c-9c7f-46c7-a8a4-fc16225d5a0b","resolution":{"observed_at":"2026-08-04T09:43:13.365838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.415028Z","title":"The full spectrum of deepnet hessians at scale: Dynamics with SGD training and sample size","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.415028Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:734964839a514a28a17321fe6664448fe1e3c1c5006fa12ca85c4d6d2567f65a","observation_id":"94acbf43-863a-41c0-8ade-931efa361d56","resolution":{"observed_at":"2026-08-04T09:43:13.415028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.525208Z","title":"Homogenization of SGD in high-dimensions: Exact dynamics and generalization properties.Mathematical Programming, pages 1–90, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.525208Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:7e7c6f916ae0aaf94e203c5c684cff3631560afd1c8c6a49bdd2f6b6ef9b798b","observation_id":"5106c7c0-c783-4452-9c28-74467aafc06b","resolution":{"observed_at":"2026-08-04T09:43:13.525208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.637708Z","title":"Classifying high-dimensional gaussian mixtures: Where kernel methods fail and neural networks succeed","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.637708Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:a56778ea6bf98ffeb860d98f311219d7bce3d19ba069270f104b6bd510c1ba64","observation_id":"b3c8c4f7-e21b-4323-a5d8-9169e8675505","resolution":{"observed_at":"2026-08-04T09:43:13.637708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.730146Z","title":"Dynamics of on-line gradient descent learning for multilayer neural networks","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.730146Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:a4056892596d3a81978b5125c5626621d81e1b53b23c9246603c33916c7d343a","observation_id":"6f17a1bd-6c00-4098-bbba-d05b57cd5784","resolution":{"observed_at":"2026-08-04T09:43:13.730146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.817228Z","title":"Exact solution for on-line learning in multilayer neural networks.Physical Review Letters, 74(21):4337, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.817228Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:cbae6084b148fb63927a4c38c95244e726292236f548f508769a25df3cb8f165","observation_id":"6a9f716a-6a39-40f6-b100-620b1cecb8c5","resolution":{"observed_at":"2026-08-04T09:43:13.817228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.927373Z","title":"Random matrix theory proves that deep learning representations of gan-data behave as gaussian mixtures","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.927373Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:d8a587f2469f838c59a364ad7eb9e747945537a5d04da512f481a5a400987c31","observation_id":"1d808604-d48f-49d5-b3b7-56d3760c80d1","resolution":{"observed_at":"2026-08-04T09:43:13.927373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.996903Z","title":"The implicit bias of gradient descent on separable data.Journal of Machine Learning Research, 19(70):1–57, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.996903Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:edabac1b7144253c51376d0d0475acdc8a325e2c8c4daa917fca79dbcc356f7f","observation_id":"c2c46541-cdc7-4cbd-b22a-4d2ac218a089","resolution":{"observed_at":"2026-08-04T09:43:13.996903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.080787Z","title":"Theoretical insights into multiclass classification: A high-dimensional asymptotic view.Advancesin Neural Information Processing Systems, 33:8907–8920, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.080787Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:8820a52e9edb41f58bfedcd8d76dc38abeedd67db5de7132acfaf99cf109a965","observation_id":"2bfc8f03-f74c-426f-b1dd-38207e5af8e4","resolution":{"observed_at":"2026-08-04T09:43:14.080787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.145212Z","title":"High-dimensional probability, volume 47 of Cambridge Series in Statistical and Probabilistic Mathematics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.145212Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:363026fdd1e71cdea62e8aaaac4db5329cb136ff5b4f268691a070b6bbe0c972","observation_id":"308282da-29b1-498b-9f11-00bc0abb34d7","resolution":{"observed_at":"2026-08-04T09:43:14.145212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.251094Z","title":"A solvable high-dimensional model of GAN.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.251094Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:aa9ad05c52be612b003c563483af201ac89cb88876fd3f22a4542bfbbb0d422a","observation_id":"beecbc06-f7e0-41f5-8703-868135500140","resolution":{"observed_at":"2026-08-04T09:43:14.251094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.326705Z","title":"Data-dependence of plateau phenomenon in learning with neural network—statistical mechanical analysis.Advancesin Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.326705Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:210c6e9b3c16b9220d194fb8539aacbce0a9595125dde871cd23006c5facd68c","observation_id":"3f4f2410-360e-4d5b-83c9-ba29d89f0567","resolution":{"observed_at":"2026-08-04T09:43:14.326705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-04T09:43:03.756565Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2510.14074."}