{"as_of":"2026-08-23T19:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ccda10cffdb420568808085eae466453bf9334882783948d70a9aafdf01dc80f","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:10:11.532803Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:16:58.221358Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T10:51:21.870404Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"cited_work":{"arxiv_id":"2501.11584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11584","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sham- poo: Preconditioned stochastic tensor optimization","venue":null,"work_id":"cca43743-d7b2-447f-8871-1e8d88adc16e","year":2018},"citing_paper":{"arxiv_id":"2604.12968","last_updated":"2026-04-14T17:01:36Z","snapshot_observed_at":"2026-08-13T03:34:38.365145Z","submitted_at":"2026-04-14T17:01:36Z","title":"Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:16:58.221358Z"},"links":{"cited_paper":"/paper/2501.11584","citing_paper":"/paper/2604.12968"},"observation_digest":"sha256:8435272de42df0f4e478e2bea5c86787dfc102920e0477cba63ab6ac1d3004d4","observation_id":"566be4c3-ba78-4a8e-a277-6dd0854e0631","resolution":{"observed_at":"2026-05-11T10:51:21.917796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.11584/citation-record","integrity":"/paper/2501.11584/integrity","json":"/paper/2501.11584/citation-record.json","paper":"/paper/2501.11584"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.597458Z","title":"Brendan McMahan, Ilya Mironov, Kunal Talwar, and Li Zhang","venue":null,"work_id":"afc00447-25ca-4bca-a10a-aa62e5db01e7","year":2016},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.264861Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:ea3f462efd233b32aa3977214dcdadd128e5231809fa3181f767ef9d7993401d","observation_id":"b16801a7-73e3-40a3-be05-f4e35fa36903","resolution":{"observed_at":"2026-08-10T18:10:12.603764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.580588Z","title":"Quantum con- volutional neural network for image classification","venue":null,"work_id":"5d82d47e-575e-49af-ad32-8b1e17a3f872","year":2024},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.271995Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:7243238d8d457974391eab6692d17726b3e93152181072499fcac13f823dc25c","observation_id":"5632f7b3-0476-477d-93c1-5ab2530ae2d2","resolution":{"observed_at":"2026-08-10T18:10:12.586355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.565255Z","title":"Sharpness-aware minimization improves language model generalization","venue":null,"work_id":"637bca88-a023-4228-b0dc-f48ebb775e50","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.277156Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:15c289ece1a9394f84b621c84bc9a618ffc65d3070717750017886f4cb3a4421","observation_id":"131a0603-066f-4f81-aee8-82e2cf21cd1f","resolution":{"observed_at":"2026-08-10T18:10:12.570197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.550251Z","title":"Momentum-sam: Sharpness aware minimization without computational overhead","venue":null,"work_id":"3f019f1e-7728-4346-92d9-2d4755625fb7","year":2024},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.282024Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:9eff094fbd55643c842ded22cd7af95651c26cdb3b18797f9384b2beb9af92a8","observation_id":"d75bb46c-79aa-4126-a964-0817026b16e2","resolution":{"observed_at":"2026-08-10T18:10:12.554908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.535268Z","title":"Entropy-sgd: Biasing gradient descent into wide valleys","venue":null,"work_id":"79aea583-9fc7-4b7d-b9e8-707bf6d644e8","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.287126Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:034ae2c3ae394b834a6e98b32370e3d7ee79a1c076a05900f111a4d3023dabed","observation_id":"40d45ef6-1fa3-4918-a622-0376f1dcf962","resolution":{"observed_at":"2026-08-10T18:10:12.540031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.519849Z","title":"When vision transformers outperform resnets without pre-training or strong data augmentations","venue":null,"work_id":"87f3d9d5-352d-4b51-9d72-ef3159a802e1","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.292011Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:26fbdeeaedd07e6905c47974f614b246d8ce5fc7ac8aa20f2676fe7bc9968a80","observation_id":"236c728d-a6be-40ec-aa23-ca4f489f0c0d","resolution":{"observed_at":"2026-08-10T18:10:12.525213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.505288Z","title":"Riemannian approach to batch normalization","venue":null,"work_id":"24e3c67b-3219-4e87-abd8-915660eb43d3","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.297645Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:b5d41badc1ac2408d81b279e10aeade71220ecaced8070999abf95bb2d6028fb","observation_id":"20dee52a-57f8-4aa5-8951-bf584110cec9","resolution":{"observed_at":"2026-08-10T18:10:12.509890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.490625Z","title":"Sharp minima can generalize for deep nets","venue":null,"work_id":"fcffd1f5-9782-441d-9aad-95594f5917f0","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.303499Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:5920041eceedf5ba9538ee4e6fda91e731f350a77e9ecb0e6852d077b819a050","observation_id":"8b30ee63-8eee-4c3d-b975-617a1ddf80db","resolution":{"observed_at":"2026-08-10T18:10:12.495439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.476186Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"55c2cd29-745b-4026-b3b5-4835fe79cca1","year":2021},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.308715Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:28a3fbe5320453ae612e65f6a5a483c0f1dcf43cb4a9b741bc419a819e75cd92","observation_id":"1fadb86b-b386-4af4-8477-cff27a4c0676","resolution":{"observed_at":"2026-08-10T18:10:12.480972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.461478Z","title":"Efficient sharpness-aware minimization for improved training of neural networks","venue":null,"work_id":"2ed6a1e8-c1f8-4b16-ba54-2ad1a3099cdf","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.313629Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:da9f630e2385e0f8d92a37aba1e4ba13ca40ebb171e64a2a8d21c17ad01eb447","observation_id":"1332bb3a-4522-4580-8681-b05e26ffb302","resolution":{"observed_at":"2026-08-10T18:10:12.466290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.445989Z","title":null,"venue":null,"work_id":"2bc31fcc-e7d1-480e-97d0-1067d03a9623","year":2020},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.318614Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:adc6f348a86b7080c1665fc3a18fced4986e4606acdf2c262b769e2a00ae31d8","observation_id":"bf3ca5f7-d49b-449c-b540-df349ba7baba","resolution":{"observed_at":"2026-08-10T18:10:12.451359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.430977Z","title":"Sharpness-aware minimization for efficiently improving generalization","venue":null,"work_id":"79352d83-048a-4c3d-b48b-10a00f9c14b0","year":2021},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.323426Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:48fa4d5a2c3a30bdbe3c1fed5d967d85f107bc0a038c554c8fafb5933719073c","observation_id":"51c56b75-e0eb-479b-859f-7716abed7f4e","resolution":{"observed_at":"2026-08-10T18:10:12.435879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.415606Z","title":"Weight and gradi- ent centralization in deep neural networks","venue":null,"work_id":"c999997d-c2c1-45b7-bf74-731acecb67e8","year":2021},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.329233Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:a8b2010a28c6dee27f8a7977ca8629f8d9f423a8cf429b0927330adf5a957c91","observation_id":"fefb612e-d901-4a7a-a4d9-83b2cec7f385","resolution":{"observed_at":"2026-08-10T18:10:12.420513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.399711Z","title":"Cnn-based projected gradient descent for consistent image reconstruction","venue":null,"work_id":"daa41e78-ebb1-4889-b70a-9d444b90ac0f","year":2018},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.334494Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:c665b74be246f16ff027fd394b523f45d3ec05070f4313bb0e17db22e4b40eb3","observation_id":"4d9fd4e2-745a-4450-81d2-b74f461fb21c","resolution":{"observed_at":"2026-08-10T18:10:12.404872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.04065","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.792062Z","title":"Do sharpness-based optimizers improve generalization in medi- cal image analysis? arXiv preprint arXiv:2408.04065, 2024","venue":null,"work_id":"8fa58b09-fe02-4695-86e8-820ce0dcdc6d","year":2024},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.339707Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:a95a124587f63f8d13708989bde389f6875f9b0c0d640906c70e0018cbe85d11","observation_id":"43ce8fdc-8af0-4c9c-96c9-b41c651d3063","resolution":{"observed_at":"2026-08-10T18:10:11.801392Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.384013Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"e3c0541e-49cd-46c2-8531-b2eddc551acf","year":2016},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.344610Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:ab15d53f4ae8512b35e4af070faaf89cfbff65a2f4129c2aaebb0eae2c9bf894","observation_id":"2cdfa2bf-d3f5-4d28-a5ff-73ed950c95e5","resolution":{"observed_at":"2026-08-10T18:10:12.388947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.366441Z","title":"Averaging weights leads to wider optima and better generalization","venue":null,"work_id":"81dc254b-9562-450a-9a4c-2ab147cecc3e","year":2018},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.349361Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:8b7159c050967a61c589b441bddfb499ad1a5ecbd93febf7455698f1943681d1","observation_id":"ee359dda-f003-430d-9758-190030bc6471","resolution":{"observed_at":"2026-08-10T18:10:12.372313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.348779Z","title":"Fantastic generalization mea- sures and where to find them","venue":null,"work_id":"417999c7-701f-4f05-8876-4a1aa1156d1f","year":2020},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.354012Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:9a85c78a93997e2f4759086fe6b5c8c1b88758a3ebb0da207d150984a3f48d99","observation_id":"0ddef49d-9fb5-423e-b911-b31754ee9299","resolution":{"observed_at":"2026-08-10T18:10:12.354479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.332008Z","title":"Kus- ner","venue":null,"work_id":"66179a5c-aa40-4ea6-8128-24fe78b1a5de","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.358671Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:777569f9bbed903ce10eb81a85edab863780a6ed2a262f3d48ca5b34637793b5","observation_id":"8b335988-604e-4635-abc1-ac457a900b70","resolution":{"observed_at":"2026-08-10T18:10:12.336948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.315576Z","title":"Generalization in deep learning","venue":null,"work_id":"3b451925-183e-494b-9f50-c92b4e60e72a","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.363490Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:ef1c7ca49032afded27368c8c7bf506e3d4316aa9b6fbf7c642dc3868d374c45","observation_id":"72b63e6a-27b5-470f-b5fa-2ad528e234af","resolution":{"observed_at":"2026-08-10T18:10:12.320757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.298964Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":"706561c8-1470-4f12-950d-f08140c0a544","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.368296Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:921c49b174852fe424794185cfb3ac4eb6526805e9622efa2547293f4c4d31fc","observation_id":"1f8eb0ce-1cdb-478b-8ffb-fbb1556e9415","resolution":{"observed_at":"2026-08-10T18:10:12.304391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.281914Z","title":"Accurate image super-resolution using very deep convolutional net- works","venue":null,"work_id":"36b94b6b-e543-4112-ae85-8f21daaf943d","year":2016},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.372968Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:04582d182185bf27a7c62ecb3c6f831f4409e793e7e91e36c801230a6e13c6bf","observation_id":"1f1dd2ce-c19a-49b0-ba56-a77c599b9206","resolution":{"observed_at":"2026-08-10T18:10:12.287461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.263845Z","title":"Fisher sam: Information geometry and sharpness aware min- imisation","venue":null,"work_id":"05d3a08e-9a86-4791-9379-0e3edda1e344","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.377433Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:8a960b64207ba4b071e332ceb83bcf80334ab76d17f01466be13b43ccea2a392","observation_id":"6fd8d1d9-f508-4f17-9ab7-681d2dfedb96","resolution":{"observed_at":"2026-08-10T18:10:12.269579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T18:10:11.381879Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.381879Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:91b101cb2ef0481513eee46a220d1d7e47f96493a0198298310780fb442b79c8","observation_id":"4ef9e345-2d7a-4d12-9a28-38e2a56e1ba0","resolution":{"observed_at":"2026-08-10T18:10:11.381879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.386917Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.386917Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:450828fddbd567c8dd4a2a35ac9a72a6066b1c3bab29b5fde809e1cee597fdc8","observation_id":"becfbd88-c28c-4539-91db-b4d2408bcdd9","resolution":{"observed_at":"2026-08-10T18:10:11.386917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.236786Z","title":"A simple weight decay can improve generalization","venue":null,"work_id":"eaee0549-8af9-4170-948c-5f6febb32918","year":1992},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.391458Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:00d90a1ba3fa7be9eb0302013e0f205c6cee1da521632fd47a4905bd7d92fc65","observation_id":"628b2626-4e0d-47a9-8b85-7ceecf4a8342","resolution":{"observed_at":"2026-08-10T18:10:12.242347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.221690Z","title":null,"venue":null,"work_id":"90e9301f-2f87-47d0-bdbc-074bd18a6efc","year":1991},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.396941Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:70289806dd315c6e8f8dba6bcc1f4d6beced762b06a7cdcb13f4ef727838e62d","observation_id":"2f4ef738-0de6-4279-a0e0-790c4d4c841e","resolution":{"observed_at":"2026-08-10T18:10:12.226439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.205489Z","title":"Asam: Adaptive sharpness-aware minimiza- tion for scale-invariant learning of deep neural networks","venue":null,"work_id":"5a25429a-da7b-45ca-b274-4ce07bced204","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.402024Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:1d57fba4533162614c16ca3addf914078ddff91b80b96c1f0efe031c3f298182","observation_id":"97c47d07-4391-4d8f-8505-4e75f2c558c4","resolution":{"observed_at":"2026-08-10T18:10:12.210837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.187646Z","title":"A projected gradient descent method for crf inference allowing end-to-end training of arbitrary pairwise potentials","venue":null,"work_id":"0ccf10ba-6ceb-423e-9489-9373d0a1fb18","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.406592Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:345cd7fcb1822e506c26f47efbb68630b44b3d6adcd4592464ca608699c507ed","observation_id":"1a4110a0-c092-4273-9c6c-393f8039875b","resolution":{"observed_at":"2026-08-10T18:10:12.193394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.170187Z","title":"Visualizing the loss landscape of neural nets","venue":null,"work_id":"225a1e6b-c0b2-4f33-9267-95553ccc525d","year":2018},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.411119Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:f931da87871e7d5f878ee33e06e8a5f9c88310bb422fff5ddfb9f584c5dbc8c3","observation_id":"7a94a1a0-8199-4fe2-a543-d99317cfab8a","resolution":{"observed_at":"2026-08-10T18:10:12.175120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.151977Z","title":"Visualizing the loss landscape of neural nets","venue":null,"work_id":"2930bb81-b1b0-4088-a511-83b7ff92450a","year":2018},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.415643Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:0a491ef8fb7e9ae7b4b0e87fe0ac591b5dbc6b70c93cb55324080d9f93d6c490","observation_id":"4098d583-2874-4773-ab36-42046fde5fd5","resolution":{"observed_at":"2026-08-10T18:10:12.158467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.135357Z","title":"Towards efficient and scalable sharpness-aware minimization","venue":null,"work_id":"442e267a-fe7d-42de-945b-03ae86e55cae","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.420454Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:b13425797f22653b6ad5dfb00b9764264dfae29bec40ba3c7a3c37898d805caf","observation_id":"80298786-ded3-4718-b96e-aec303ed4a9e","resolution":{"observed_at":"2026-08-10T18:10:12.140863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.117709Z","title":"Swin trans- former: Hierarchical vision transformer using shifted win- dows","venue":null,"work_id":"5534c169-3f38-4cb7-bd34-2468e1a3fc2a","year":2021},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.425112Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:1656d8bad509c2efcd20f206b901bee471d8c16759c7686365d4984836f02bf9","observation_id":"64b81589-7f21-4c3e-91d6-a14544cbf0a4","resolution":{"observed_at":"2026-08-10T18:10:12.123303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.100991Z","title":"Understanding the generalization benefit of normalization layers: Sharpness reduction","venue":null,"work_id":"2ecf345a-85d4-4cdc-9a3d-f2fddb9c5235","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.430113Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:191add00f1be66181fc1ce7a4f9f179e50a029572b9534eeae376cbf6ac8ef4a","observation_id":"66cd9120-2822-40e6-bd42-3660402fe5ea","resolution":{"observed_at":"2026-08-10T18:10:12.106184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.084345Z","title":"A retinal vessel segmentation method based on the sharpness-aware minimization model","venue":null,"work_id":"c0c655de-9ae0-4391-b046-1b702d32cda5","year":2024},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.435835Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:a248e343871d56c7ad5fb789383204d8fef70f2209ee2312f0691a7bdfad2c07","observation_id":"4f2c82a4-ddac-4e05-907b-3e32205a132c","resolution":{"observed_at":"2026-08-10T18:10:12.089223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.067631Z","title":"Hover-trans: Anatomy-aware hover-transformer for roi-free breast cancer 8 diagnosis in ultrasound images","venue":null,"work_id":"a291a068-4008-4513-a3f5-49636c235da8","year":2023},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.441164Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:b7bc4ce68d99b4c6bfe296e9b2fde8f6da9e673b91c5bfda4fb58f87551c0786","observation_id":"f5dfa0d7-d48f-4640-9916-35f8a6f5d308","resolution":{"observed_at":"2026-08-10T18:10:12.073113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.050641Z","title":"A method for solving a convex programming problem with convergence rate o(1/k2)","venue":null,"work_id":"f8821c1c-7290-4798-bf79-c97af23e16ce","year":1983},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.447775Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:b460972d518382a51e876a0b84d945e804579dd17ab92b2f704f13f8bf871b12","observation_id":"f511a9a8-4f27-4999-b416-d2609987b29c","resolution":{"observed_at":"2026-08-10T18:10:12.055876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.033120Z","title":"Un- derstanding the exploding gradient problem","venue":null,"work_id":"eeb89128-a915-4ddd-beff-6851c339826d","year":2012},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.453699Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:1c81d991cec2660609bcff446adc747feaf8c414dc33aa93d204a2c9598ce801","observation_id":"d4de2477-b67f-40e7-b02d-265cea7d3782","resolution":{"observed_at":"2026-08-10T18:10:12.038215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.459928Z","title":"On the momentum term in gradient descent learning algorithms","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.459928Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:1837a3f88ac5ec73d4ab22951cfa481c059b6ace40e9467c2cec629ae5bfd9ee","observation_id":"ddcdf7c4-1d08-4b50-95eb-a8f272d6d61c","resolution":{"observed_at":"2026-08-10T18:10:11.459928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.4339660","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.569628Z","title":"A benchmark for breast ultrasound image classification","venue":null,"work_id":"683de189-9813-4ccc-8a52-0beced927ede","year":null},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.464962Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:2dd7f3eae327b273ab13bf392cb693fac5a4c41c3ad21ecb64a16371913eb8fa","observation_id":"740336ea-19bc-4633-b608-c2678b50afe4","resolution":{"observed_at":"2026-08-10T18:10:11.577468Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:12.006503Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":"57b2e87b-69a5-4d50-bd2e-b9fb36f39a02","year":2015},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.469988Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:15ecc8dff95563b1bb0f7495454bea6ffe3e83b05611ea856b028409f0a1e66c","observation_id":"c723ad4c-11f5-48b4-916f-0dbfe09ed6a5","resolution":{"observed_at":"2026-08-10T18:10:12.011910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.991316Z","title":"A bayesian perspective on gen- eralization and stochastic gradient descent","venue":null,"work_id":"83fd86a0-8465-4805-b211-133d8a0cfbd5","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.474998Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:6762adc01667abec2ba91660a4077b3b5a2437776e33e3a4af380da8ac5a2174","observation_id":"e99f3f32-4a89-4278-a2f9-462f076c33c7","resolution":{"observed_at":"2026-08-10T18:10:11.996514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.975645Z","title":"On the origin of implicit regularization in stochastic gradient descent","venue":null,"work_id":"1b229478-9d73-40a1-9f6a-103147beae4f","year":2021},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.480036Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:8d5c7c5597f5217d8374f1a2c5542345cb93dc0b78e00edbdc6cc205d32e4407","observation_id":"f627d27a-79ad-4f36-9059-776502a4bba1","resolution":{"observed_at":"2026-08-10T18:10:11.981174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05350","last_updated":"2017-06-16T17:08:08Z","snapshot_observed_at":"2026-08-16T22:00:20.852295Z","submitted_at":"2017-06-16T17:08:08Z","title":"L2 Regularization versus Batch and Weight Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05350","snapshot_observed_at":"2026-08-10T18:10:11.484976Z","title":"L2 regularization versus batch and weight normalization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.484976Z"},"links":{"cited_paper":"/paper/1706.05350","citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:1fd6cc86463cba1c0903f4d549f83ca53e58576bde564e9b4489f4df1b97d1d1","observation_id":"7d11f847-52eb-4a65-8ff9-b9b72075da55","resolution":{"observed_at":"2026-08-10T18:10:11.484976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.959512Z","title":"On orthogonality and learning recurrent networks with long term dependencies","venue":null,"work_id":"bcab8392-ee63-4e9b-84d3-d6e0084c374b","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.490674Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:691454d6f9a8e875b23eb5ce9287649416c8daaf39bcb515c1f7b77a04a41887","observation_id":"0d4b0195-0839-4441-8ede-ea681e730cf8","resolution":{"observed_at":"2026-08-10T18:10:11.965001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.943774Z","title":"Cr-sam: Curva- ture regularized sharpness-aware minimization","venue":null,"work_id":"2c290821-1600-4cf3-a4e4-4b2aa1b60147","year":2024},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.496076Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:3e229d13f8ca270608aaccc4dd1d2789076f82778d911c6ee83f158eed9b200f","observation_id":"8f685d8b-4292-4085-90d1-198eef35e706","resolution":{"observed_at":"2026-08-10T18:10:11.948530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.921190Z","title":"Adver- sarial weight perturbation improves generalization in graph neural networks","venue":null,"work_id":"352d8959-6a64-4804-bcf1-6a019ce45ba1","year":2023},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.501875Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:3a71151e089e7eb6a8a79b98071faa04c5f4055c2381368b05eeac23e06feff3","observation_id":"505499ab-df46-4ed7-8753-a6c74d90f7a9","resolution":{"observed_at":"2026-08-10T18:10:11.928461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.901832Z","title":"Understanding and improving layer normaliza- tion","venue":null,"work_id":"f147889d-f232-440a-b97a-9586cd4b346b","year":2019},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.506537Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:3ecc28facd7bab268ea5f71789d5986aa3380adff8d5bfbfe6669bad56123510","observation_id":"c46a76ad-b3b1-43a2-a09d-0486b5a34262","resolution":{"observed_at":"2026-08-10T18:10:11.908452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.883003Z","title":"Gradient centralization: A new optimization tech- nique for deep neural networks","venue":null,"work_id":"d165b201-ebca-42e1-a042-ce3b8656b1cf","year":null},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.511272Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:5c75165e5fae2389220582092583f53396501506f784d50b8629bb3522d9ebec","observation_id":"dc9e9dcf-bbd2-4414-8edb-8c9218ada4a7","resolution":{"observed_at":"2026-08-10T18:10:11.889072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.848511Z","title":"Understanding deep learning re- quires rethinking generalization","venue":null,"work_id":"f699eae1-0e6e-4dac-bcf1-bdc5c17138b4","year":2017},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.521531Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:3dae19ae3a97669d52de1ba9cc8e180289bf25f2e0aeb899526d66c03d058eac","observation_id":"d7f00fb7-2711-4649-97ea-1cff8f55bf7b","resolution":{"observed_at":"2026-08-10T18:10:11.853828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.832024Z","title":"Toward understanding the importance of noise in training neural networks","venue":null,"work_id":"35e68251-8c4e-492e-9914-7fa949d0bfc5","year":2019},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.526817Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:815edbe43f865b6cf1e0795653d33e2563969f4bd92bf0fab4e1c36dca6a3725","observation_id":"0ede5a23-f643-4578-abbd-a9f8c6bbbd70","resolution":{"observed_at":"2026-08-10T18:10:11.836996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.812988Z","title":"Surrogate gap minimization im- proves sharpness-aware training","venue":null,"work_id":"d5871702-f277-4b30-ab6c-e64f27c00442","year":2022},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.532803Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:f1531e212d5fe7572cb8d38cda1097f54f9bda6248dc6523d1923a149da0716e","observation_id":"1914cae1-131d-475b-974e-902af4967779","resolution":{"observed_at":"2026-08-10T18:10:11.818931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:11.865364Z","title":null,"venue":null,"work_id":"58a07b5a-bbfd-48e2-94ac-67fbee01b111","year":2020},"citing_paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T18:10:11.516151Z"},"links":{"citing_paper":"/paper/2501.11584"},"observation_digest":"sha256:73a47c53ce173388e4085ce4a03b8df42450ac867ee09bb3198cf15f581a10da","observation_id":"debeaa67-362e-4e67-a241-4ba30ec29a70","resolution":{"observed_at":"2026-08-10T18:10:11.870748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.11584","last_updated":"2025-01-26T15:37:21Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T11:55:26.983925Z","submitted_at":"2025-01-20T16:42:31Z","title":"GCSAM: Gradient Centralized Sharpness Aware Minimization"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":44},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2501.11584."}