{"as_of":"2026-08-08T21:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35b56302edd3dfdb317999f16d9f6a15e0cddb0e9fe66227e1aedd750d9caf68","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:56:21.101169Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23012/citation-record","integrity":"/paper/2607.23012/integrity","json":"/paper/2607.23012/citation-record.json","paper":"/paper/2607.23012"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.937376Z","title":"Towards understanding sharpness-aware minimization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.937376Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:48dd9d16c6957ae42a0565e16a78697d7eb3e07bdc7e17add635c40749a36fdf","observation_id":"e6a54760-2fd8-4f60-887a-0868b284635a","resolution":{"observed_at":"2026-08-01T03:56:20.937376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.942544Z","title":"Bartlett, Philip M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.942544Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:f74dac515c01ddcedbe68f9f0018bbc361305af51eff041c9a20503ab039c504","observation_id":"00dc9a5f-8fe0-45b7-ae4b-21cb38430a9b","resolution":{"observed_at":"2026-08-01T03:56:20.942544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.946983Z","title":"Gradient descent on neural networks typically occurs at the edge of stability","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.946983Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:b57279eea2986cd699e7c5c765b4d835767ce9b6b777ea1e5a9956f073c678fb","observation_id":"80216976-5913-4641-ae20-3dc87737dd85","resolution":{"observed_at":"2026-08-01T03:56:20.946983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.951072Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.951072Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:816c6386e3fbbecc2fab36cac74abda5ee20b4729b1037179dd91a559055f8df","observation_id":"794c4eba-f0fa-4eed-8475-b2f183f1d103","resolution":{"observed_at":"2026-08-01T03:56:20.951072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15594","last_updated":"2023-04-10T22:32:40Z","snapshot_observed_at":"2026-07-31T04:44:56.354172Z","submitted_at":"2022-09-30T17:15:12Z","title":"Self-Stabilization: The Implicit Bias of Gradient Descent at the Edge of Stability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15594","snapshot_observed_at":"2026-08-01T03:56:20.955662Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.955662Z"},"links":{"cited_paper":"/paper/2209.15594","citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:bb4127f2333fcd3c6eeca30c10eb4e56fd7ad3346c14e469306a1a284bf0b836","observation_id":"8f139322-272b-4ed7-8ee9-0d94c53d1198","resolution":{"observed_at":"2026-08-01T03:56:20.955662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11789","last_updated":"2026-05-07T17:10:40Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-16T21:32:48Z","title":"Suspicious Alignment of SGD: A Fine-Grained Step Size Condition Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11789","snapshot_observed_at":"2026-08-01T03:56:20.960427Z","title":"Suspicious alignment of sgd: A fine-grained step size condition analysis, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.960427Z"},"links":{"cited_paper":"/paper/2601.11789","citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:3d885ac98827f82b41b7998cd5cd0c212dc314dac73f1cf263e9e434ebf7ef8f","observation_id":"7d713f7b-6673-4995-8b38-6aec87266368","resolution":{"observed_at":"2026-08-01T03:56:20.960427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.965338Z","title":"Sharp minima can gen- eralize for deep nets","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.965338Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:c534733209bc84928af1cf940c8b2fafc08f2d99ac5117705c05aaf455e08a68","observation_id":"bb696665-4b3c-4114-9a6c-f18d35b4d4b6","resolution":{"observed_at":"2026-08-01T03:56:20.965338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.969237Z","title":"Sharpness-aware min- imization for efficiently improving generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.969237Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:3fb9c3288d8c696fd8bcdd8a5d55e9e66dd06e98806ed762e71860e42911558e","observation_id":"d9f384e0-8c0b-42ac-ba37-022641a01b79","resolution":{"observed_at":"2026-08-01T03:56:20.969237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.973078Z","title":"An investigation into neural net opti- mization via hessian eigenvalue density","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.973078Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:2ebf2a827f6f27f87fee232ff82ffd0293c24b885d6fa2b8d3c2d5b3e2fc2e8b","observation_id":"358d7975-eef5-4b2f-bf53-ff4d3281cd66","resolution":{"observed_at":"2026-08-01T03:56:20.973078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.977117Z","title":"Roberts, and Ethan Dyer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.977117Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:b277a974bdb50ce31bcff5f68f443ccd89523354febfe5cdf9de693525406706","observation_id":"9eff9356-2b97-4acc-92d7-ecc7247bfa88","resolution":{"observed_at":"2026-08-01T03:56:20.977117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.985616Z","title":"Flat minima.Neural Computation, 9(1):1–42, 01","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.985616Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:8f2cc638e04c3bfc855123a68ff866856188b2eee3c6fa078ee0f86be8ca0840","observation_id":"8ac95b17-1ce6-499a-9c01-0da65f79b6e8","resolution":{"observed_at":"2026-08-01T03:56:20.985616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.993643Z","title":"Three factors influencing minima in SGD, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.993643Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:3bc7f42eea55041cc5b814970e2b5771a4ec82e63e74cba4e8606297a612fbd8","observation_id":"727ec6b2-84fa-4766-8046-0713230dbd68","resolution":{"observed_at":"2026-08-01T03:56:20.993643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.997564Z","title":"Fan- tasticgeneralizationmeasuresandwheretofindthem","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.997564Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:77bbfb2452ad40744ae68ee2e0a66695c4b65926c76aa52ff2a69598bb1b3430","observation_id":"79ab3069-a99d-44b5-8fda-1fd5395f5375","resolution":{"observed_at":"2026-08-01T03:56:20.997564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.001422Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.001422Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:d6b4007228f716c87fc5f45f897379c935700c1569ba516f27b8587337288ee7","observation_id":"cd13ec03-0a45-4fe1-a497-d74257330f1b","resolution":{"observed_at":"2026-08-01T03:56:21.001422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.005396Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.005396Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:f0a382d5b3651e13931f706b1cc22f44ebcf1a34a22fee2788cbe3e97e253b84","observation_id":"2b87547c-adc5-4d60-bd83-bfcd2af19e44","resolution":{"observed_at":"2026-08-01T03:56:21.005396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.009492Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.009492Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:3f1a7552a7acf1df390886fdd33475266fb4ccaab3c465732330e3e9d4a34c5d","observation_id":"25082619-2eff-4d82-99bf-ee8205f3dd01","resolution":{"observed_at":"2026-08-01T03:56:21.009492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.013661Z","title":"Asam: Adaptivesharpness- aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.013661Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:ccd4ad7a3721886a8eaae0e97c964846d6e71c810e184b566d241b654aca60de","observation_id":"36d34437-dfc4-479f-92ef-bd9abb3ac232","resolution":{"observed_at":"2026-08-01T03:56:21.013661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.017871Z","title":"Lecun, L","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.017871Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:dddff7bbc5acda078d82b2d15a149e34a1819f63fa18f4a585f39bc92afe27dc","observation_id":"7ca47f84-a909-4f7e-aeb1-fd46fa5a1db1","resolution":{"observed_at":"2026-08-01T03:56:21.017871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.022405Z","title":"Stochastic modified equations and adaptive stochastic gradient algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.022405Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:292d67cdd3ae412f43f9a3532535dcb13b899b287cd8571009eba989de25680a","observation_id":"38e76fd0-8364-486a-a51b-b66b3dc3df7a","resolution":{"observed_at":"2026-08-01T03:56:21.022405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.026443Z","title":"Stochasticmodifiedequationsanddynamicsofstochas- tic gradient algorithms i: Mathematical foundations.Journal of Machine Learning Research , 20(40):1–47, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.026443Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:0c27f24337ef286d3f639efba9f8a1baee4f7647d62f04ff7dd0031ec5477004","observation_id":"46b0244f-9475-43f5-a707-93ee353018bd","resolution":{"observed_at":"2026-08-01T03:56:21.026443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.030380Z","title":"On the validity of modeling SGD with stochastic differential equations (SDEs)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.030380Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:2dac32a4408bb3b4c1a5675b70ddaf185889f871df579a4a2b091773deaf4e53","observation_id":"962b2d77-eafe-40a3-a4e0-f460957ce3a5","resolution":{"observed_at":"2026-08-01T03:56:21.030380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.034414Z","title":"What happens after SGD reaches zero loss? –a mathematical framework","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.034414Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:a8f7ce0c20f947fe91f750eb2236c7e3beb3cd170a96ac1eb6371fabbc5ba9be","observation_id":"b7f61dfa-60bf-4c53-988f-b029ac7ed03a","resolution":{"observed_at":"2026-08-01T03:56:21.034414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04289","last_updated":"2018-01-19T21:07:09Z","snapshot_observed_at":"2026-07-06T05:37:49.239583Z","submitted_at":"2017-04-13T22:17:30Z","title":"Stochastic Gradient Descent as Approximate Bayesian Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04289","snapshot_observed_at":"2026-08-01T03:56:21.038704Z","title":"Hoffman, and David M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.038704Z"},"links":{"cited_paper":"/paper/1704.04289","citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:eec4c1c4fae9dc95ef08bd7178b5f5a9ad9159ee3e3101d4c35ea725f72ad6ba","observation_id":"399407d2-f447-42e5-bb95-9e52b0d5162b","resolution":{"observed_at":"2026-08-01T03:56:21.038704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.043039Z","title":"Measurements of three-level hierarchical structure in the outliers in the spectrum of deepnet hessians","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.043039Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:8f1c8f4f18f8729c629bef5ae63e7811b7c41257d3bc99619bedb9f7db60061f","observation_id":"cfe945f2-6d5f-4f6d-aa45-90c2f51429b6","resolution":{"observed_at":"2026-08-01T03:56:21.043039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.046854Z","title":"Traces of class/cross-class structure pervade deep learning spectra.Journal of Machine Learning Research, 21(252):1–64, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.046854Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:ec07064e4adc38df3d8d63fccd13bb148939fdf935c1d95cff33f97e391a3b84","observation_id":"c6d56244-7aa9-41b3-8c2a-9c8697993535","resolution":{"observed_at":"2026-08-01T03:56:21.046854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.051348Z","title":"Eigenvalues of the hessian in deep learning: Singularity and beyond, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.051348Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:33e7aff8ca3745131b683fac5079abf18add2c455c7471e745967b08c887a5f1","observation_id":"ecac1e84-7ce8-4868-827d-c0af2227ff87","resolution":{"observed_at":"2026-08-01T03:56:21.051348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.04454","last_updated":"2018-05-07T15:43:39Z","snapshot_observed_at":"2026-07-30T23:08:51.956017Z","submitted_at":"2017-06-14T12:50:00Z","title":"Empirical Analysis of the Hessian of Over-Parametrized Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.04454","snapshot_observed_at":"2026-08-01T03:56:21.055749Z","title":"Ugur Güney, Yann N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.055749Z"},"links":{"cited_paper":"/paper/1706.04454","citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:e6c31b34ebd84e5e59598d59cca1c4a0b0bec1ba79b05f3a90b49591b383da99","observation_id":"d0089145-997f-477d-a883-d3e85131e0b8","resolution":{"observed_at":"2026-08-01T03:56:21.055749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.060100Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.060100Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:5e1aeabd00b45b285f4c0061859e170c66b507424157570fb8f8c82813bbbb97","observation_id":"2cdfa333-88f4-49a4-a66e-f185a3cde465","resolution":{"observed_at":"2026-08-01T03:56:21.060100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.064023Z","title":"Does SGD really happen in tiny subspaces? In The Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.064023Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:05bdc73ba7631b9915d29cb1b28feb7e87aa665684311791babc41b4a444ac29","observation_id":"2ae352d6-072b-42f5-8195-8c51d635ffae","resolution":{"observed_at":"2026-08-01T03:56:21.064023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.068102Z","title":"On the interplay between noise and curvature and its effect on optimizationandgeneralization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.068102Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:31b3c4857df39c92ece6a083ae3e4912b364c9df1b7f8b52958fd02303707cb8","observation_id":"76768f3f-b143-420e-91f0-135823a0ec9a","resolution":{"observed_at":"2026-08-01T03:56:21.068102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.072271Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.072271Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:cc7a275cfa220c1c28e1e3ca014e94ea497fcbbf280e44c0dddf5a23be8f7c12","observation_id":"9ae13432-9f98-4b71-88ce-d1e7cedcfc16","resolution":{"observed_at":"2026-08-01T03:56:21.072271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.076146Z","title":"How sharpness-aware minimization minimizes sharpness? In The Eleventh International Conference on Learning Representations , 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.076146Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:08b4daaf96b8942c52901d2c805d61ac96908081d099d82de8be433775c6e110","observation_id":"9ae7dc9c-fd0f-4fa7-b760-1e5ddeccfdba","resolution":{"observed_at":"2026-08-01T03:56:21.076146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.080365Z","title":"Wang, David Leo Wright Hall, Percy Liang, and Tengyu Ma","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.080365Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:72c51c984a3accb7a20b2a3bd0285a4ba2d0f946147c7d80d707e94a3b72012f","observation_id":"85d8ff69-aa71-445a-a3df-0eb8223bb20a","resolution":{"observed_at":"2026-08-01T03:56:21.080365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.084304Z","title":"An empirical study of stochastic gradient descent with structured covariance noise","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.084304Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:b1149fc55304efa491863d5c975c8740e498c622583cdf84970bd64ba6590f31","observation_id":"8d6761e1-0b5e-46e8-bc38-b3241870c9f5","resolution":{"observed_at":"2026-08-01T03:56:21.084304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.088605Z","title":"The alignment property of sgd noise and how it helps select flat minima: A stability analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.088605Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:2949de819115a317e4c0c8aa0dcd8056cc57258ca3742d14f3d4ee31dff4081e","observation_id":"fd690176-46b7-4816-90ca-1fbe6961a6a4","resolution":{"observed_at":"2026-08-01T03:56:21.088605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11972","last_updated":"2025-05-17T12:13:05Z","snapshot_observed_at":"2026-08-07T15:43:53.139005Z","submitted_at":"2025-05-17T12:13:05Z","title":"Accelerating Neural Network Training Along Sharp and Flat Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11972","snapshot_observed_at":"2026-08-01T03:56:21.097021Z","title":"Accelerating neural network training along sharp and flat directions, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.097021Z"},"links":{"cited_paper":"/paper/2505.11972","citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:0431c913b3b2afeb9f06b5426e164caa3418d08d799817f5af5e528e4bad7cdc","observation_id":"6331ab85-7296-4fc1-a736-cc87f644a625","resolution":{"observed_at":"2026-08-01T03:56:21.097021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.101169Z","title":"The anisotropic noise in stochastic gradient descent: Its behavior of escaping from sharp minima and regularization effects","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.101169Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:9d8fad0f516457d618bf3e16871b7de26bcb5d6fb1c9bf14a895211d69e578e5","observation_id":"32497467-9038-4bcb-a46f-4f7bdfc75819","resolution":{"observed_at":"2026-08-01T03:56:21.101169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:20.989626Z","title":"doi: 10.1162/neco.1997.9.1.1","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.989626Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:d510330f1407003706fa22938e4a28b9e10598b57c633ecfacc429acf1405581","observation_id":"7ce4f9c9-d53b-4f12-b028-6c1bb844a25c","resolution":{"observed_at":"2026-08-01T03:56:20.989626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.04754","last_updated":"2018-12-12T00:36:17Z","snapshot_observed_at":"2026-07-06T07:20:39.525340Z","submitted_at":"2018-12-12T00:36:17Z","title":"Gradient Descent Happens in a Tiny Subspace","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.04754","snapshot_observed_at":"2026-08-01T03:56:20.981177Z","title":"6 DOMINANT FLUCTUATIONS LOWER SHARPNESS","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:20.981177Z"},"links":{"cited_paper":"/paper/1812.04754","citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:ee2599038172283fd08e6de92fc3024c3807bb6c265028b9411142f71cc143a5","observation_id":"8247d14c-3594-4cde-99e8-6dbca3715b36","resolution":{"observed_at":"2026-08-01T03:56:20.981177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:56:21.092960Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T03:56:21.092960Z"},"links":{"citing_paper":"/paper/2607.23012"},"observation_digest":"sha256:f6b69e845892ec7a18a83ee0dd88125056eb4c24c3ac884400fedae7a68b5482","observation_id":"091cb805-a52a-4254-9433-df516d8049e2","resolution":{"observed_at":"2026-08-01T03:56:21.092960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23012","last_updated":"2026-07-25T03:06:30Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T11:19:36.989473Z","submitted_at":"2026-07-25T03:06:30Z","title":"Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2607.23012."}