{"as_of":"2026-08-10T23:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c70902de94c866557285ab50c7f7effd72d381b231892c6ecec4cde85ed5aa31","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:12:35.480611Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03110/citation-record","integrity":"/paper/2509.03110/integrity","json":"/paper/2509.03110/citation-record.json","paper":"/paper/2509.03110"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.874354Z","title":"Towards understanding sharpness-aware minimization","venue":null,"work_id":"d738cc04-2879-4ef4-ac8d-6c1801eeea37","year":2022},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:33.454258Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:8fc7c7a6a2fbaeee7d19e63377f9a8d15af30546f70d1ca68efa5a9a82da333a","observation_id":"c3df81d5-a9b9-4f62-8b19-f1a8d59d465a","resolution":{"observed_at":"2026-08-05T11:12:36.880625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.851605Z","title":"Tensor programs v: Tuning large neural networks via zero-shot hyperparameter transfer","venue":null,"work_id":"e1b9a358-ce91-4057-bf75-6282ff77d8e6","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:33.605500Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:7ec320e8ec93c350a3aadcb6cbc38bf49de66ad5e85f43cfee4dbc7186e8b449","observation_id":"c57dff82-1239-4736-8dfe-4d8778822dfe","resolution":{"observed_at":"2026-08-05T11:12:36.861236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.829342Z","title":"A fast iterative shrinkage-thresholding algorithm for linear inverse problems","venue":null,"work_id":"91748bf6-8c51-4368-924a-4d070b535c65","year":2009},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:33.774897Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:be6ca772595125521275202a2339c3727e3f8f798f72cbbc79bcd527edd4f54f","observation_id":"34f9c036-c826-4470-845e-68f2f7ac3762","resolution":{"observed_at":"2026-08-05T11:12:36.836229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09693","last_updated":"2023-10-01T02:19:50Z","snapshot_observed_at":"2026-08-08T00:58:41.590092Z","submitted_at":"2023-02-19T23:27:12Z","title":"mSAM: Micro-Batch-Averaged Sharpness-Aware Minimization","version":2},"cited_work":{"arxiv_id":"2302.09693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.09693","snapshot_observed_at":"2026-08-05T11:12:35.979097Z","title":"mSAM: Micro-Batch-Averaged Sharpness-Aware Minimization","venue":"stat.ML","work_id":"05e69137-48be-4f99-8184-f317baad82ec","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:33.888289Z"},"links":{"cited_paper":"/paper/2302.09693","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:3fca5ff5fda96c8ccef6c52a886e41414dbac93465b58b8a277838d0c3f0c32d","observation_id":"ea4f51d3-ee42-4ea6-8454-d3ab5cbb1359","resolution":{"observed_at":"2026-08-05T11:12:35.985578Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.798255Z","title":null,"venue":null,"work_id":"7e363ac4-73c5-4363-8b69-3c07da30d701","year":1998},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.008390Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:8f5a03086a0aba6d58351da2cb402a2e79c26aa4ff038a49786b19b65cfe3b6d","observation_id":"99d6613a-b92c-45db-9c75-9b63d2e720c6","resolution":{"observed_at":"2026-08-05T11:12:36.811434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.778020Z","title":"Beyond local sharpness: Communication-efficient global sharpness-aware minimization for federated learning","venue":null,"work_id":"dda9e8ad-d262-4833-b62d-878e7270d344","year":2025},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.102115Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:ebf2d37f45c66963e5945691fc25cc3a97ddbff20d870e87dfe4b7fe2ff8a9f3","observation_id":"f455a677-72b8-43c7-9de9-95c37be8a502","resolution":{"observed_at":"2026-08-05T11:12:36.784325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T11:12:34.202549Z","title":"Entropy- SGD : Biasing gradient descent into wide valleys","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.202549Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:fccf99a9aabb15d8dd858c18443370b12af8c0e5b6032c9ea73191958728397a","observation_id":"f7c5d364-69b5-4966-a16d-61c2f6e9cb2d","resolution":{"observed_at":"2026-08-05T11:12:34.202549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.00424","last_updated":"2017-09-10T04:22:49Z","snapshot_observed_at":"2026-08-10T22:32:14.509042Z","submitted_at":"2017-07-03T07:14:56Z","title":"Parle: parallelizing stochastic gradient descent","version":2},"cited_work":{"arxiv_id":"1707.00424","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.00424","snapshot_observed_at":"2026-08-05T11:12:35.920180Z","title":"Parle: parallelizing stochastic gradient descent","venue":"cs.LG","work_id":"cdc6fc29-7f20-4d03-b109-30616fbfc87a","year":2017},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.294606Z"},"links":{"cited_paper":"/paper/1707.00424","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:6b24b8c69c6545a9193be94c919aacd29c75e7d42670b3eaaef93e80491acf1c","observation_id":"d13d4e1e-2f8b-4ed4-a064-ec775f96c794","resolution":{"observed_at":"2026-08-05T11:12:35.925622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.758543Z","title":"Diffusive G ibbs sampling","venue":null,"work_id":"1a9f2462-6c76-41f6-9b34-87fcecfc3d2e","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.359724Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:77bac432c7d5a26da1ee012aa312903f54358cc48b2807f360afc3b0b9c958c1","observation_id":"c77cb239-3a92-4957-a2ae-48805c029d3b","resolution":{"observed_at":"2026-08-05T11:12:36.763818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.740831Z","title":"Improved analysis for a proximal algorithm for sampling","venue":null,"work_id":"0b49a9bf-6fd4-4bd3-ba1e-be7f7e24c1e5","year":2022},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.479016Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:eebd2b2c478b11014ff080915decaa6e62f9d35faa49a37b8a61641fce3a8e0c","observation_id":"fdc14fa1-414c-4714-9b04-77dd8328d4d0","resolution":{"observed_at":"2026-08-05T11:12:36.746971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i15.33756","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Convergence rate in a nonlinear two-time-scale stochastic approximation with state (time)-dependence","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"58f5420d-7253-487b-a25d-0eb21bf35e0d","year":2025},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.582763Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:4513e689b79af6c227b0dee4fd742a6fa2a56617ad45dbd803409dc53d498fe8","observation_id":"7e62e66b-1266-4213-8e91-c98a072631ea","resolution":{"observed_at":"2026-08-05T11:12:35.557489Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.721319Z","title":"An iterative thresholding algorithm for linear inverse problems with a sparsity constraint","venue":null,"work_id":"7045d176-36e3-457d-8d22-a6aefea89ba7","year":2004},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.741317Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:8420e52dccd4c9cdc4602b9bf80dc03c858d79e247bde771a2635f1157fb400a","observation_id":"5e2369b0-0bdd-49d0-827a-d6b065693f34","resolution":{"observed_at":"2026-08-05T11:12:36.726809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.696603Z","title":"Grawa: Gradient-based weighted averaging for distributed training of deep learning models","venue":null,"work_id":"df490f8e-a5bc-4a58-ab4f-96698989540b","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.897272Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:d3f54e3a61513bb6f8a5a8aaa5d617acbc315df6ea58de925f968f965a7beb1c","observation_id":"f2e0e66f-168e-464a-ba42-6cfe5d468fa3","resolution":{"observed_at":"2026-08-05T11:12:36.705341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32101","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:35.886978Z","title":null,"venue":null,"work_id":"28b8d2b7-0cf2-457e-8503-0bf0486e1fbc","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.927083Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:2857ca8b41cee4c5f8f38a4a0d899f1d0ebd6ed918904d66ce33c386102f68c0","observation_id":"4206ee04-ccb7-4e0a-b235-0b9accac35c4","resolution":{"observed_at":"2026-08-05T11:12:35.896863Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.674211Z","title":"Efficient sharpness-aware minimization for improved training of neural networks","venue":null,"work_id":"88031e66-3c75-4658-8c09-47e9dd803c8e","year":2022},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.036827Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:51cd201510adaf1804a355d88efff5cb3340e5fe5414ac34d9988b7f3d872651","observation_id":"7d6c3149-f13f-4249-8046-3c69e9321a8d","resolution":{"observed_at":"2026-08-05T11:12:36.681019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.655314Z","title":"Locally estimated global perturbations are better than local perturbations for federated sharpness-aware minimization","venue":null,"work_id":"e5a0e461-9ff5-4274-8f3f-285432790f93","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.153497Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:bc26f2e61acbd236053d5144298549d205a5316b3158f2732d24accfb05da4c3","observation_id":"22707330-89f0-4c17-80f4-49a7c83b4077","resolution":{"observed_at":"2026-08-05T11:12:36.661064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.636129Z","title":null,"venue":null,"work_id":"386c4416-fc5d-4247-b666-43f9d47e2bf5","year":1999},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.228410Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:53462607dc2fca94e647dcb1b639d11adcaf5ec3b28b23a8dd0a49721355e4d4","observation_id":"fa12d06b-cbb3-4b9f-b446-68f7077adf3b","resolution":{"observed_at":"2026-08-05T11:12:36.642781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01412","last_updated":"2021-04-29T16:44:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-03T19:02:10Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01412","snapshot_observed_at":"2026-08-05T11:12:35.236623Z","title":"Sharpness-aware minimization for efficiently improving generalization, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.236623Z"},"links":{"cited_paper":"/paper/2010.01412","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:2809a858d587a494af9e28fd285b6c4e6570dfd55d77e6aa03f95ef695adfc3f","observation_id":"65dabd30-2b79-40a4-b980-a3d632b10ee6","resolution":{"observed_at":"2026-08-05T11:12:35.236623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.614197Z","title":"Willard Gibbs","venue":null,"work_id":"49502acd-b2fb-4658-a82f-f3289311a682","year":1902},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.265809Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:8ed8c11b7103534cc0280cd87a655593c4a7da07353781de10d93e10539ff700","observation_id":"f83a943e-d5f8-4ba6-b4f3-704cd3d30631","resolution":{"observed_at":"2026-08-05T11:12:36.620959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.592625Z","title":null,"venue":null,"work_id":"5af7a536-daa5-4324-a085-2ffb30b7a5ba","year":1994},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.271004Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:03d26f75c57214bc6e986079b910cc89d6823a3196843f334889b0343b35348e","observation_id":"a0b231e1-100e-4936-bd57-9f4a98f1c539","resolution":{"observed_at":"2026-08-05T11:12:36.597982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:35.275581Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.275581Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:498282d906580999dfc72e679158894d30e30e335d33d168327e915427803e1a","observation_id":"17cd3d59-b9dd-485b-a1d5-c851cf22cd3e","resolution":{"observed_at":"2026-08-05T11:12:35.275581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.561716Z","title":"Flat minima","venue":null,"work_id":"92ecb7b8-0cce-4f0a-9ab3-813e0ec788b6","year":1997},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.281090Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:d8b11a06c9245d292bab17c24141ae3103ed84fd801ff8ccbb560c9792d9be6a","observation_id":"e85090fd-7afc-43d9-bbb7-2c3e11332090","resolution":{"observed_at":"2026-08-05T11:12:36.567029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.542042Z","title":"Reverse diffusion monte carlo","venue":null,"work_id":"e63f9b46-6f1c-4437-b30f-695af67f6f00","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.288641Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:2bb574b964545c729f0c8cfc0755bf9a367411f791259961850b3e817d78456a","observation_id":"742f9dce-caa4-4504-b5f0-6094eea7387b","resolution":{"observed_at":"2026-08-05T11:12:36.547539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11147","last_updated":"2025-03-14T07:34:39Z","snapshot_observed_at":"2026-08-10T16:13:37.123145Z","submitted_at":"2025-03-14T07:34:39Z","title":"Asynchronous Sharpness-Aware Minimization For Fast and Accurate Deep Learning","version":1},"cited_work":{"arxiv_id":"2503.11147","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.11147","snapshot_observed_at":"2026-08-05T11:12:35.690918Z","title":"Asynchronous Sharpness-Aware Minimization For Fast and Accurate Deep Learning","venue":"cs.LG","work_id":"851fb23e-51ca-41ea-8cd2-393d67af695e","year":2025},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.293870Z"},"links":{"cited_paper":"/paper/2503.11147","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:c1d3d95a8d3308ba1155ae0e3dceac7744a7b336015582aa47f6cce752d4ca3e","observation_id":"e1cc1aac-2f20-465a-b100-5a13141f789c","resolution":{"observed_at":"2026-08-05T11:12:35.696332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:35.299285Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.299285Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:68dbcd4d519be85238e9c33afd25ea654892c8b121f23f305ab9df2241e392d4","observation_id":"a9c60d60-9229-44ac-beb2-f72baaa4b16b","resolution":{"observed_at":"2026-08-05T11:12:35.299285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.511310Z","title":"Smooth minima: A convex relaxation framework for optimizing flatness","venue":null,"work_id":"fe9b35da-a9cf-420e-ae40-34e02d6e1067","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.304338Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:988aa1dc7d5264dc9c8285e79176e8987d9e6594f10db5179ac8fe9379074207","observation_id":"1e56adeb-6150-463b-b24a-0379b1d990f4","resolution":{"observed_at":"2026-08-05T11:12:36.517876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.494061Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":"976eed49-0f5b-4ec5-8ec6-a772bddd612a","year":2015},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.309596Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:f520ebf35257825d4fb5f0f6320c1704fd9526e8e11b8cfe3f8a2d17498d75c5","observation_id":"42d1195c-a7a2-4167-a97c-56c23ef5cd2e","resolution":{"observed_at":"2026-08-05T11:12:36.499642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.475111Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":"3ced36af-556c-4f1e-adee-8a4d9421b4cd","year":2009},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.314741Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:d4ca566a6a3afb8f4d5ab7d82e15af9f6a86abb80a79b1ea69e9513cba9f91b1","observation_id":"ff6206ee-7c99-40e8-b170-d8d4781f1151","resolution":{"observed_at":"2026-08-05T11:12:36.482056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.452854Z","title":null,"venue":null,"work_id":"b9a38c19-4012-49ae-846c-0d141f8a9bb6","year":2012},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.319132Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:058a77d60305a5fa82a02ef9e386b3a024c9e4b4140742112020d52ad8617419","observation_id":"7a889a4d-dd39-4218-a1d5-24882207738a","resolution":{"observed_at":"2026-08-05T11:12:36.461902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.431764Z","title":"Asam: Adaptive sharpness-aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":"7eafcb3a-3362-42b8-b5b5-01b577fd4409","year":2021},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.324560Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:c4abd2508efe38c0409f7c3f94a3cc21979b0d8bfcaf94e7f7470ec805950909","observation_id":"aa3ec2d4-514f-4339-9627-15db32027d00","resolution":{"observed_at":"2026-08-05T11:12:36.439894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:35.331502Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.331502Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:ca4dd8d022d84eefde3babb95a1ffd262e08a1305a66e1da95cbb5ae95170a3b","observation_id":"483e598b-2413-4203-8a37-5e648200ba9e","resolution":{"observed_at":"2026-08-05T11:12:35.331502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.411466Z","title":"Structured logconcave sampling with a restricted gaussian oracle","venue":null,"work_id":"b53e5efc-b075-4b83-a060-751d4d8932cf","year":2021},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.337945Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:cb0a55b4cc649ccd82139f30862acc55c840f61e7a8ef3aaf37f7edfb9a7e9a0","observation_id":"8b212376-ace6-4622-a39f-21dc1b90b358","resolution":{"observed_at":"2026-08-05T11:12:36.417423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.390620Z","title":"Entropy- MCMC : Sampling from flat basins with ease","venue":null,"work_id":"59fdc325-3720-41cc-a058-58b614ce024a","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.344519Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:b0eaeeac50b59caa70b47600bebc901a4b7f12981f9bf47eac5c0e9053787e0d","observation_id":"6796fb7b-1a09-44d9-be80-cc7f967f4e44","resolution":{"observed_at":"2026-08-05T11:12:36.396433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.365736Z","title":"Friendly sharpness-aware minimization","venue":null,"work_id":"0b3c5518-ad79-4107-8e4d-e834adecaf26","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.350808Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:cf9ccb09c6660a0568a7a5b2d30cac1e996dfa68b4601863ee8eecb91258176a","observation_id":"b19c4ad3-8815-4b43-8caa-d14c2d46e277","resolution":{"observed_at":"2026-08-05T11:12:36.372760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02714","last_updated":"2022-03-05T11:53:37Z","snapshot_observed_at":"2026-08-06T10:56:06.527094Z","submitted_at":"2022-03-05T11:53:37Z","title":"Towards Efficient and Scalable Sharpness-Aware Minimization","version":1},"cited_work":{"arxiv_id":"2203.02714","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.02714","snapshot_observed_at":"2026-08-05T11:12:35.666585Z","title":"Towards Efficient and Scalable Sharpness-Aware Minimization","venue":"cs.LG","work_id":"7093f413-1af6-4b6e-8e4f-db8c45340058","year":2022},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.356096Z"},"links":{"cited_paper":"/paper/2203.02714","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:0cea90b0ca7301a323f5414b22340e05ba64ef28a7cc3aa54f110413dc488107","observation_id":"a90be5dc-f873-4e5a-bffd-702a79f75de2","resolution":{"observed_at":"2026-08-05T11:12:35.672005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.345425Z","title":"Rosenbluth, Marshall N","venue":null,"work_id":"24ccfcd2-59c5-46b6-b8c4-ac10e6cecc7e","year":1953},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.361923Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:f44c2b21fa805f15f60746558384be40f72a582e2ee63330dfd9b7bbcf6d3a1d","observation_id":"247f9712-ccdc-4f40-a263-cf067f23e08d","resolution":{"observed_at":"2026-08-05T11:12:36.352128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:35.367595Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.367595Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:7c70cf993a6f8086ca9f239bf4ec795155d42fdd2c49f274b172daab16927bbf","observation_id":"068122ec-b5c0-4d92-af7c-74b91d8ee50d","resolution":{"observed_at":"2026-08-05T11:12:35.367595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.319089Z","title":"A method for solving a convex programming problem with convergence rate \\( O (1/k^2)\\)","venue":null,"work_id":"717ac95a-a395-40f7-8e2e-bda340763292","year":1983},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.372168Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:ba8495e9754bccde1f3227f20b3bc3a648783bd8b8140db7f6710dec910f05a0","observation_id":"a9a83767-34ec-4111-a0dc-46a41b517deb","resolution":{"observed_at":"2026-08-05T11:12:36.327230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.294748Z","title":"Bissacco, Bo Wu, and A","venue":null,"work_id":"d9f85fba-53a3-42a9-b4e6-1f6900463afa","year":2011},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.377179Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:eac84b623581c72fe1d9e04b92baff98ad9317ef7ab7c497233ced3d26ddb413","observation_id":"16e9b678-3739-4db8-a479-43b68e341217","resolution":{"observed_at":"2026-08-05T11:12:36.300563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.272688Z","title":"Exploring generalization in deep learning","venue":null,"work_id":"a4c15aa5-6546-4d57-b2b5-39b0eff5beed","year":2017},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.381972Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:7cbad731421d35deb40c789c846e960dcbddc9e6eda44fe60c50005f0e65f3d1","observation_id":"6f42480e-51f6-4308-b4d6-dbee95282589","resolution":{"observed_at":"2026-08-05T11:12:36.278408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.249594Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"1fdd7c43-5fb5-4a5a-a276-315deab43974","year":2019},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.386557Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:a4236a51a41543c2c0bc45024138d82eb796c2fb7ec51f109ee265cbc29b1901","observation_id":"ebe8c6cf-d938-42d9-ab03-e4d9bf40511b","resolution":{"observed_at":"2026-08-05T11:12:36.256105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.227178Z","title":"Generalized federated learning via sharpness aware minimization","venue":null,"work_id":"9c1f2e01-a07d-4adc-8a13-1acf67a935ee","year":2022},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.391415Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:60e579ea37a7f9f1cea7abfbc3ce8f0317c2a59c44106fef9535cb8b9fc02e90","observation_id":"20380170-9d3b-4f52-8a48-7b9a933f8853","resolution":{"observed_at":"2026-08-05T11:12:36.233915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.204646Z","title":"Flatsam: Federated learning with sharpness-aware minimization","venue":null,"work_id":"aa8a9399-d3a2-406a-a063-056d3310b36d","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.396605Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:89a9501fd827c75b7d8ceceb204254eadb0a5067079e95e0abbe6260709f9d88","observation_id":"5654c2ec-641d-4a45-90a6-df7490a0d070","resolution":{"observed_at":"2026-08-05T11:12:36.209994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.185782Z","title":"Practical sharpness-aware minimization cannot converge all the way to optima","venue":null,"work_id":"99321b74-a96d-4d5b-ad94-3e59535ddd14","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.404433Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:3b17f038a944607c85c6c3427921ad1d2a1d1809d49de566d124628b3b69ce19","observation_id":"b3c47585-3f6c-444a-8a13-9abb9e1562c3","resolution":{"observed_at":"2026-08-05T11:12:36.191229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-10T22:24:05.831832Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-05T11:12:35.414067Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.414067Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:3399490cc8df15a0dffbc7c6a7eb04872e3a7431b8a82918207a67f880aaa2fa","observation_id":"b57801da-6cd3-4f61-b067-dbdeb21a499b","resolution":{"observed_at":"2026-08-05T11:12:35.414067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00565","last_updated":"2023-03-01T15:12:42Z","snapshot_observed_at":"2026-08-06T04:31:49.633433Z","submitted_at":"2023-03-01T15:12:42Z","title":"AdaSAM: Boosting Sharpness-Aware Minimization with Adaptive Learning Rate and Momentum for Training Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00565","snapshot_observed_at":"2026-08-05T11:12:35.420761Z","title":"Adasam: Boosting sharpness-aware minimization with adaptive learning rate and momentum for training deep neural networks, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.420761Z"},"links":{"cited_paper":"/paper/2303.00565","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:ebe6b840b936217f7770e9a971e6502fc6cf22c2106c339223a54610e46371f2","observation_id":"68c230e0-0038-4fdb-94fe-14126b1329ae","resolution":{"observed_at":"2026-08-05T11:12:35.420761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.163266Z","title":"Dynamic regularized sharpness aware minimization in federated learning: approaching global consistency and smooth landscape","venue":null,"work_id":"b3ef44ca-246d-4169-aa11-c07bbd46cf8b","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.427234Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:3c684972ad5a0239f249aa8bab745839d13aa3f764a504a7d32d8868cb328c0b","observation_id":"37c7c8ef-994c-4752-aa08-8d4c6d698cd6","resolution":{"observed_at":"2026-08-05T11:12:36.170202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.141772Z","title":null,"venue":null,"work_id":"6ea48b2d-b7f7-487b-9565-6d5a68f444c3","year":2019},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.432619Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:1d7ede2c6dbc6f6b23459cd41236c7e16dedebe48bf3de788efccec720e40cb9","observation_id":"9bd94ccf-889b-4bec-9ace-283d035c7418","resolution":{"observed_at":"2026-08-05T11:12:36.147175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10395","last_updated":"2022-04-28T07:30:01Z","snapshot_observed_at":"2026-08-04T09:37:09.116336Z","submitted_at":"2019-05-24T18:12:06Z","title":"Leader Stochastic Gradient Descent for Distributed Training of Deep Learning Models: Extension","version":5},"cited_work":{"arxiv_id":"1905.10395","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.10395","snapshot_observed_at":"2026-08-05T11:12:35.600678Z","title":"Leader Stochastic Gradient Descent for Distributed Training of Deep Learning Models: Extension","venue":"cs.LG","work_id":"bf1ba0d7-c1e3-42d1-843d-5f5c6da07a05","year":2019},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.438170Z"},"links":{"cited_paper":"/paper/1905.10395","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:ad4985e6500e079ecf2dc76c8b731edcd4b871c95366c82aa40a8509be6bc02c","observation_id":"fae060c1-0980-40d2-a279-d362bcc66190","resolution":{"observed_at":"2026-08-05T11:12:35.607516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.121817Z","title":"Bayesian learning via stochastic gradient langevin dynamics","venue":null,"work_id":"58ba8ad9-2aa7-4fff-837a-1c065781fb3a","year":2011},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.443468Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:742b925ad7cd956070869774ab138a819d7d4d6b179f1ccaf53847ca97d493bd","observation_id":"4153f3d2-b714-4f1c-8e82-3ef19471ee3a","resolution":{"observed_at":"2026-08-05T11:12:36.129162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.098944Z","title":"How sharpness-aware minimization minimizes sharpness? In The Eleventh International Conference on Learning Representations, 2023 a","venue":null,"work_id":"3e3e1d09-98ae-43ff-93d4-60a7af7a7db8","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.448810Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:378c1f00f4803e4590d65f2ea688225b4dbc42a464055113c5cac42c28ab538b","observation_id":"385e237f-36d3-4e99-a174-4a74ffb1b170","resolution":{"observed_at":"2026-08-05T11:12:36.105417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.072486Z","title":"Sharpness-aware minimization revisited: Weighted sharpness as a regularization term","venue":null,"work_id":"5559674f-7b4c-4a79-9d75-d92b8e224b5f","year":2023},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.453720Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:33f12c1d3875b015890d8d542244bf2dbdcdcc9c00353b368d1101ca1c6849a3","observation_id":"99f44950-fad9-4dc0-90d6-7e4df458e5d2","resolution":{"observed_at":"2026-08-05T11:12:36.080218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.053658Z","title":"Adan: Adaptive nesterov momentum algorithm for faster optimizing deep models","venue":null,"work_id":"68bccb1c-e321-4343-8e0b-3a2446450763","year":2024},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.458966Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:8073858ee2e8f762e79814b5fa73055005c83972787fe6e42e293090d60b05d2","observation_id":"873100ee-0551-43d5-b262-29b2cc9f45a3","resolution":{"observed_at":"2026-08-05T11:12:36.059358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07146","last_updated":"2017-06-14T06:06:48Z","snapshot_observed_at":"2026-08-08T14:57:17.868613Z","submitted_at":"2016-05-23T19:27:13Z","title":"Wide Residual Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07146","snapshot_observed_at":"2026-08-05T11:12:35.464595Z","title":"Wide residual networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.464595Z"},"links":{"cited_paper":"/paper/1605.07146","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:5dd6f4784fef32d2b21cef6bbd17baafae67f15acab23b248742e63a8a2db7b1","observation_id":"7fdd96b6-38aa-4200-9920-9b8a3d07929c","resolution":{"observed_at":"2026-08-05T11:12:35.464595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:35.470952Z","title":"mixup: Beyond empirical risk minimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.470952Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:5c1e63c5df5e476803f2679893cd7192024ad8ab743ed3caad7c2e0eec57063f","observation_id":"22469141-0b9b-49ee-bc6d-cb70dda5db2e","resolution":{"observed_at":"2026-08-05T11:12:35.470952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.021564Z","title":"Zhang, A","venue":null,"work_id":"d66798cf-264e-4b13-9f00-402bfea9d3e6","year":2015},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.475719Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:883fd93f8ec2134c846ed4a937c892fa4ac02c60ca8c1c4a2af256328a6157b9","observation_id":"61b2bd6a-ad3a-4cb8-a143-0e7bdc693044","resolution":{"observed_at":"2026-08-05T11:12:36.026559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:12:36.000734Z","title":"Diffusion-based adversarial training produces robust models","venue":null,"work_id":"f46b3e0e-56d0-4033-b84f-9cdd4e92a66c","year":2022},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:35.480611Z"},"links":{"citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:af65251b39cb2423215061555b218b27218e31275582288ab51f8f97aa9eff22","observation_id":"73df0760-6c3f-4bd0-9106-c5b688854efd","resolution":{"observed_at":"2026-08-05T11:12:36.007786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T03:57:51.917267Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":6,"verified_fuzzy":35},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2509.03110."}