{"as_of":"2026-08-11T14:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b55a802a336bc42125adc2d877b24104f0e1160aaa384862b5330aff66714aa","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:03:54.945060Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:21:20.602760Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-09T12:21:20.649779Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"cited_work":{"arxiv_id":"2501.06603","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.06603","snapshot_observed_at":"2026-08-09T12:21:20.649779Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","venue":"cs.LG","work_id":"7eb114e9-ea37-44e1-ac17-ebdc3769bfff","year":2025},"citing_paper":{"arxiv_id":"2502.02407","last_updated":"2025-02-04T15:25:47Z","snapshot_observed_at":"2026-08-09T16:18:00.285516Z","submitted_at":"2025-02-04T15:25:47Z","title":"Avoiding spurious sharpness minimization broadens applicability of SAM","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T12:21:20.602760Z"},"links":{"cited_paper":"/paper/2501.06603","citing_paper":"/paper/2502.02407"},"observation_digest":"sha256:8dbd328f76eecf5bb125b09ad356af4a2e6039427c48db140138b4ee80125d47","observation_id":"5d80aa7d-64bc-480a-bd88-74774ea4ce44","resolution":{"observed_at":"2026-08-09T12:21:20.656668Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.06603/citation-record","integrity":"/paper/2501.06603/integrity","json":"/paper/2501.06603/citation-record.json","paper":"/paper/2501.06603"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T21:03:54.251388Z","title":"Bert: Pre- training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.251388Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:7e6853e2aab953775c758410918124c47f501213b1754c6407df72b9050be6f4","observation_id":"cd564273-d512-4c53-b88f-ced01750a168","resolution":{"observed_at":"2026-08-10T21:03:54.251388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01778","last_updated":"2021-07-08T20:16:28Z","snapshot_observed_at":"2026-08-08T11:33:21.735489Z","submitted_at":"2021-04-05T05:26:29Z","title":"AST: Audio Spectrogram Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01778","snapshot_observed_at":"2026-08-10T21:03:54.277378Z","title":"Ast: Audio spectrogram trans- former,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.277378Z"},"links":{"cited_paper":"/paper/2104.01778","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:7809b0a1ecfdf3efe2d533848f5a0b2a7bf883faf5cb36388fa3d1920a3fb0ce","observation_id":"793b8bc6-2a09-47d7-bb86-ca4ecd11462f","resolution":{"observed_at":"2026-08-10T21:03:54.277378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:57.108041Z","title":"When vision transformers out- perform resnets without pre-training or strong data augmentations,","venue":null,"work_id":"47cd1150-b15a-4c56-874b-0ca330ccbf6f","year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.288671Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:8b430a6e9aba3d4da19460fd5bb84d66d7a654d64c88798c5a90cd4e5640936f","observation_id":"552e3464-7efa-418b-98dd-c8a67eaaf648","resolution":{"observed_at":"2026-08-10T21:03:57.115640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:54.300750Z","title":"Un- derstanding deep learning (still) requires rethinking generalization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.300750Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:cfe503d093240cd19483f664e147f3ed36fc3165b8f6697d4877caeef418b411","observation_id":"6a0f548d-6574-46d0-a15a-3454d610563e","resolution":{"observed_at":"2026-08-10T21:03:54.300750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:57.057429Z","title":"Dropout: a simple way to prevent neural networks from overfitting,","venue":null,"work_id":"2c312ca1-3fa2-4c61-8f3b-cc3bac360ff9","year":1929},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.307833Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:17a81da994c1ddf8fddcbf2b556d1667bf68abe53ffafb4490cf2a8d8423a73e","observation_id":"b201b411-4961-44e2-8512-98edf04b4d1c","resolution":{"observed_at":"2026-08-10T21:03:57.071240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:57.009311Z","title":"Au- toaugment: Learning augmentation strategies from data,","venue":null,"work_id":"cd8f8f49-c5d0-4c7d-a4d8-520bb59b8424","year":2019},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.322309Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:f5b861a73db61305f28cd64683b33f7f9c18140be6a9ca29550e697923f8d29b","observation_id":"83864ca5-533b-4789-85ac-ab7e4bd3afb2","resolution":{"observed_at":"2026-08-10T21:03:57.018078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03632","last_updated":"2022-04-08T20:03:26Z","snapshot_observed_at":"2026-08-10T02:31:26.513198Z","submitted_at":"2022-04-07T17:57:29Z","title":"The Effects of Regularization and Data Augmentation are Class Dependent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03632","snapshot_observed_at":"2026-08-10T21:03:54.372343Z","title":"The effects of regular- ization and data augmentation are class dependent,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.372343Z"},"links":{"cited_paper":"/paper/2204.03632","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:70e13a03b79b3f2e897c2a6912e743d2c66765f1a981a55b13b85c3309896a01","observation_id":"f8bdb589-5421-4396-a35f-ad62644eac49","resolution":{"observed_at":"2026-08-10T21:03:54.372343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.979739Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":"a1ae29dd-d5c7-443e-a24a-ffdbdafa0b94","year":2016},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.388335Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:58862134a9241728fa9448ed244e454a24f6a5e683d99979fef8e8d5bb96027b","observation_id":"6cc5a387-89d8-4687-b938-90b0081962de","resolution":{"observed_at":"2026-08-10T21:03:56.986880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.959648Z","title":"Towards understanding sharpness-aware minimization","venue":null,"work_id":"d45ca1ae-2468-42c1-a6cc-b0f6f467a080","year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.415094Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:acf581762dc11752327d99c2ffdeaab08eeafcccbbb81a55173b5ca99e5904d7","observation_id":"baa46c82-479c-4e05-8cbd-3fcfe9456050","resolution":{"observed_at":"2026-08-10T21:03:56.966331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.935351Z","title":"How does sharpness-aware minimiza- tion minimizes sharpness,","venue":null,"work_id":"5624d416-890e-4c97-a353-3cfd6a7a02be","year":2023},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.425188Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:2add1690552a2a7fe1c4d96c70e9990445d12ad58f8ea1478e8e61ca3d3a774f","observation_id":"8b0db0f8-652b-4135-b9db-293b2f3ab9de","resolution":{"observed_at":"2026-08-10T21:03:56.943820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02178","last_updated":"2019-12-04T18:58:26Z","snapshot_observed_at":"2026-07-06T08:42:06.688732Z","submitted_at":"2019-12-04T18:58:26Z","title":"Fantastic Generalization Measures and Where to Find Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02178","snapshot_observed_at":"2026-08-10T21:03:54.444744Z","title":"Fantas- tic generalization measures and where to find them,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.444744Z"},"links":{"cited_paper":"/paper/1912.02178","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:22c03d05f2a01f931613e32af6a4ceb35d7462a8fd1c21740458b2e7fdf16847","observation_id":"ba72502b-e7b8-4349-9aa2-dd6bc6eab9b2","resolution":{"observed_at":"2026-08-10T21:03:54.444744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:54.457607Z","title":"Sharpness-aware minimization for efficiently improving generalization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.457607Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:48c8275f0f2d76a4bc42068571469c0a29144c49cba041c040a64d34f2225b1a","observation_id":"7c5eb73d-673a-4765-ba44-79a3787ed851","resolution":{"observed_at":"2026-08-10T21:03:54.457607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.900385Z","title":"ASAM: Adaptive sharpness- aware minimization for scale-invariant learning of deep neural net- works,","venue":null,"work_id":"887e7ff6-06bc-44fb-b3a1-fe72aed9c2e0","year":2021},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.504756Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:c973813d77e088e38c7b37b4355c48ce5859be4d2367c4bc244b763461533163","observation_id":"b064d62f-a382-42e7-83f0-1f62772fe6d3","resolution":{"observed_at":"2026-08-10T21:03:56.907154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.877224Z","title":"Fisher SAM: Information geometry and sharpness aware minimisation","venue":null,"work_id":"dafe2398-fe00-405a-a0c5-bf459632e712","year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.540203Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:9386baed7fd5a2a9bde7dfaed3ac27451213fab5f155ab7437ed3bd13db7943a","observation_id":"6209988b-774b-4a5a-9337-f25ef662583a","resolution":{"observed_at":"2026-08-10T21:03:56.886881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.851616Z","title":"Surrogate gap minimization improves sharpness-aware training","venue":null,"work_id":"c407c9dc-efad-40dd-aed0-604977e94275","year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.564754Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:479b63e717c6b87d109d15661f2955d2f0b3957a2e6b33dd9aefd468625bc74f","observation_id":"88f46fff-9b43-4c2b-a01d-07abb1a0521b","resolution":{"observed_at":"2026-08-10T21:03:56.858822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:54.594668Z","title":"Penalizing gradient norm for efficiently improving generalization in deep learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.594668Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:61015ff3ff1fc2505479374dd5c2177d2a98068943fcda14fb04647073300bf8","observation_id":"3bb0d539-5966-47f6-8a68-802d284bd8d9","resolution":{"observed_at":"2026-08-10T21:03:54.594668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.810537Z","title":"Implicit regularization of sharpness-aware minimization for scale-invariant problems,","venue":null,"work_id":"13205170-45f0-4fb0-944a-56ddf3533825","year":2024},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.600567Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:a338b608d962412e36f9a5a08ea270bf1e6edec1ef6630e2a182462187aaec97","observation_id":"c013e037-28b1-43ae-ad9b-f7782777dfa1","resolution":{"observed_at":"2026-08-10T21:03:56.816835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.766560Z","title":"Make sharpness-aware minimization stronger: A sparsified perturbation ap- proach,","venue":null,"work_id":"2106e14a-2dae-48d1-bbde-229fdcae2221","year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.628265Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:f1146e3982dcc6d81d2f526ec6fbf68c3a00cc664119bd24d55d11b1409fd609","observation_id":"374d54f7-188a-4515-afa1-1d6b93739828","resolution":{"observed_at":"2026-08-10T21:03:56.791251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14647","last_updated":"2023-04-28T06:23:32Z","snapshot_observed_at":"2026-08-10T22:11:49.661157Z","submitted_at":"2023-04-28T06:23:32Z","title":"An Adaptive Policy to Employ Sharpness-Aware Minimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14647","snapshot_observed_at":"2026-08-10T21:03:54.660004Z","title":"An adaptive policy to em- ploy sharpness-aware minimization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.660004Z"},"links":{"cited_paper":"/paper/2304.14647","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:9fd8adbf87a5c0d0738d23c7e2f7fa2a3625e9073621bcdf0bddbcea999cc65f","observation_id":"7eda21b3-0443-4e73-9d8c-415903902c50","resolution":{"observed_at":"2026-08-10T21:03:54.660004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09962","last_updated":"2023-04-10T06:43:15Z","snapshot_observed_at":"2026-08-09T08:26:38.857355Z","submitted_at":"2022-03-18T13:57:17Z","title":"Randomized Sharpness-Aware Training for Boosting Computational Efficiency in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09962","snapshot_observed_at":"2026-08-10T21:03:54.679898Z","title":"SS-SAM: Stochastic scheduled sharpness-aware minimization for efficiently training deep neural net- works,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.679898Z"},"links":{"cited_paper":"/paper/2203.09962","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:5f42f9307605b917850607c591083fb6603bc694daca81cbee23d5a5d5c36692","observation_id":"5521b8bf-f591-44cb-a606-26d5d7b166b7","resolution":{"observed_at":"2026-08-10T21:03:54.679898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.726812Z","title":"Enhancing sharpness-aware optimization through variance suppression,","venue":null,"work_id":"fba243d8-e536-4dfa-8aa1-967f4134bf71","year":2023},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.705672Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:b901af8bcea1e56a22a1b0599fcea7b3976dcacc2bd1b3eb229e8e6df2efb987","observation_id":"2ba0936d-2abf-4870-9f60-2894f9b032cd","resolution":{"observed_at":"2026-08-10T21:03:56.738624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:54.717434Z","title":"Stochastic first-and zeroth-order methods for nonconvex stochastic programming,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.717434Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:8d0fb0393a89eb2d59d7ffee72e6a0d3ebc323a3d9a183b5ae8a8e20a728e309","observation_id":"1e2be162-7750-4954-a153-a4426aea4e89","resolution":{"observed_at":"2026-08-10T21:03:54.717434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.665826Z","title":"Optimization methods for large- scale machine learning,","venue":null,"work_id":"fd38e1e5-3628-4c6b-a887-a53fe9fe5a98","year":2018},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.744749Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:d8c0c32250382761ab59b3c9e730d3ce16238e4afbe84fc598e6a290d8f11a42","observation_id":"d3a0fe84-dc76-44e8-a6cb-1137a45bc1cc","resolution":{"observed_at":"2026-08-10T21:03:56.689180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.623513Z","title":"Sharp minima can generalize for deep nets,","venue":null,"work_id":"a6b73a7c-8d64-4a95-b25e-7641bbdaaffe","year":2017},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.774749Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:10f6368b2baef2dc7214fe019fb2b225e9409bfb8922a88041cad5a96070ab8f","observation_id":"9d7356a7-c606-4fe9-8e3e-0f2a525f2021","resolution":{"observed_at":"2026-08-10T21:03:56.642037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.602176Z","title":"Sparse prediction with the k- support norm,","venue":null,"work_id":"33cb89c5-12dc-4ac6-ae88-eacd15e113ab","year":2012},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.791182Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:5309d47b32fd364ac41337892d97969e049749de72cb32c26b856a086075ee0f","observation_id":"f1611d18-b23b-4fdc-956e-7ce16ce9bdce","resolution":{"observed_at":"2026-08-10T21:03:56.607892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.520762Z","title":"AdaBelief optimizer: Adapting stepsizes by the belief in observed gradients,","venue":null,"work_id":"5b54e878-ffe7-40d4-82af-70a791d7a819","year":2020},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.798523Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:25142ae72feefdcdc2bc381b87082a83672aa880bfab8b46a704f57a033d6645","observation_id":"626fbbf2-a8a0-4734-b04e-e6c8ce5c8d44","resolution":{"observed_at":"2026-08-10T21:03:56.554941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:54.803536Z","title":"Learning multiple layers of features from tiny images,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.803536Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:a981cb25c5e94f377b6242b763323fd8eba157ba92e57e34e035403cefaf52cc","observation_id":"ef4fea22-795b-4709-ae61-17f89a81c1cf","resolution":{"observed_at":"2026-08-10T21:03:54.803536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.290875Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"f1c0fe3f-31e5-464f-b776-421dbcf33d79","year":2016},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.810399Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:dc9d4f0e4db59c6651b2fc120875246895ef9f96e22970afdf2644ca298f78d6","observation_id":"8b340799-b37b-49e7-8cc4-07532b2224d8","resolution":{"observed_at":"2026-08-10T21:03:56.345029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.216854Z","title":"Densely connected convolutional networks,","venue":null,"work_id":"61d4a932-e711-438a-a05d-b4393ab17a42","year":2017},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.818479Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:a6fe9598492c72f00a4f930797244419ca50dfe75950019146183aa1567c6f99","observation_id":"4f0212b0-c477-4c97-8e26-9b9dff26bfc4","resolution":{"observed_at":"2026-08-10T21:03:56.262235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07146","last_updated":"2017-06-14T06:06:48Z","snapshot_observed_at":"2026-08-08T14:57:17.868613Z","submitted_at":"2016-05-23T19:27:13Z","title":"Wide Residual Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07146","snapshot_observed_at":"2026-08-10T21:03:54.834316Z","title":"Wide residual networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.834316Z"},"links":{"cited_paper":"/paper/1605.07146","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:11c64080f04f9248bce737f4b8dcc36cdb015248c4f85437fff2d0d2035236c0","observation_id":"d547cc87-f0fd-4a54-9ef6-62f942705646","resolution":{"observed_at":"2026-08-10T21:03:54.834316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:56.044798Z","title":"Deep pyramidal residual networks,","venue":null,"work_id":"6759a500-e0a9-4abd-a90a-e06897656e85","year":2017},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.881146Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:cec2fb162a47e75e907814fa44fac8df834d54b9ee00d761c618486c0770c0ee","observation_id":"30ac6866-ec77-41fb-9b95-c4e435b43711","resolution":{"observed_at":"2026-08-10T21:03:56.084774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:55.858923Z","title":"ImageNet: A large-scale hierarchical image database,","venue":null,"work_id":"01bd71ca-c6aa-446a-8664-652ac931377f","year":2009},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.901620Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:abba839783f734fb7c7524fb63d03b8590064ede426799e48acc8afd6fbd4c57","observation_id":"07495ada-829f-48a5-9839-acfee000a8c8","resolution":{"observed_at":"2026-08-10T21:03:55.904959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:55.714823Z","title":"Asymmetric valleys: Beyond sharp and flat local minima","venue":null,"work_id":"097e1fa7-fa50-4626-ba5c-507e8064e884","year":2019},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.909741Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:bd4bdfba5267d77aaea992060047cf4c117a23d84fd3c6c425196114b3060e1b","observation_id":"e0e4a3f3-ed83-4938-b31d-acd55ad5b91c","resolution":{"observed_at":"2026-08-10T21:03:55.754822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-08-10T10:31:15.628197Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-10T21:03:54.919038Z","title":"Improved regularization of convolutional neural networks with cutout","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.919038Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:5833575c4a5a7bf0725e0e4a5358571f1f68ae15f091ea92990c4ae3983ebc2a","observation_id":"938f4382-5fbb-41f2-9a89-6728fe74df90","resolution":{"observed_at":"2026-08-10T21:03:54.919038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:55.555188Z","title":"xt finishes the proof","venue":null,"work_id":"4ec761a2-b199-49a5-ba03-37655c9c4709","year":null},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.930355Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:81acee9e830fdd8df295ddc4bd2ed7cbc9d3b04190bceda260f5364c95128bf1","observation_id":"59efc412-cae5-46fc-80a4-3d503299f804","resolution":{"observed_at":"2026-08-10T21:03:55.612168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:03:55.464750Z","title":"Hyperparameters used in our experiments are summarized in Tabs","venue":null,"work_id":"e1ce4945-8661-47bc-8582-dd64c479f148","year":null},"citing_paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T21:03:54.945060Z"},"links":{"citing_paper":"/paper/2501.06603"},"observation_digest":"sha256:d8db51ebc8120de56323fdcbc48546b01c61ed403a9d5034e57c110cc3f4ab8a","observation_id":"7ac8bace-3ee9-40d2-9eda-867f9c68190c","resolution":{"observed_at":"2026-08-10T21:03:55.476577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.06603","last_updated":"2025-01-11T18:05:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T14:34:31.386782Z","submitted_at":"2025-01-11T18:05:33Z","title":"Preconditioned Sharpness-Aware Minimization: Unifying Analysis and a Novel Learning Algorithm"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2501.06603."}