{"as_of":"2026-08-20T08:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ffb99f57a38e7801a4149e0a1a291d77701329e98e76d5aac3dd194fd1c229e","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:16:31.931431Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-07T15:43:58.446157Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T15:53:54.525321Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"cited_work":{"arxiv_id":"2509.08483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.08483","snapshot_observed_at":"2026-07-07T15:53:54.525321Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","venue":"cs.LG","work_id":"9c836650-7a82-4697-a449-e75e5d42bbbc","year":2025},"citing_paper":{"arxiv_id":"2602.01642","last_updated":"2026-05-07T23:28:50Z","snapshot_observed_at":"2026-08-13T00:23:14.989193Z","submitted_at":"2026-02-02T04:59:24Z","title":"The Effect of Mini-Batch Noise on the Implicit Bias of Adam","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T08:03:15.785558Z"},"links":{"cited_paper":"/paper/2509.08483","citing_paper":"/paper/2602.01642"},"observation_digest":"sha256:c570fedc3d37047c5d624259e332c0e9c346f66f99df0687d59475ba3f84d50b","observation_id":"4ca4f547-2f58-42fb-a328-998492640079","resolution":{"observed_at":"2026-05-16T08:07:34.259449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"cited_work":{"arxiv_id":"2509.08483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.08483","snapshot_observed_at":"2026-07-07T15:53:54.525321Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","venue":"cs.LG","work_id":"9c836650-7a82-4697-a449-e75e5d42bbbc","year":2025},"citing_paper":{"arxiv_id":"2605.29152","last_updated":"2026-05-27T22:30:39Z","snapshot_observed_at":"2026-08-15T13:50:56.497474Z","submitted_at":"2026-05-27T22:30:39Z","title":"Do Deep Networks Forget Initialization? A Forgetting-Time View of Practical Inductive Bias","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-06-29T13:20:54.303605Z"},"links":{"cited_paper":"/paper/2509.08483","citing_paper":"/paper/2605.29152"},"observation_digest":"sha256:b829c09fb1b6a3c2dc0e06c42240d74821ff292b8f74a7a09b28c7a186501de5","observation_id":"b6716020-942a-4296-809b-6e405b099197","resolution":{"observed_at":"2026-06-29T13:23:28.025496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"cited_work":{"arxiv_id":"2509.08483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.08483","snapshot_observed_at":"2026-07-07T15:53:54.525321Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","venue":"cs.LG","work_id":"9c836650-7a82-4697-a449-e75e5d42bbbc","year":2025},"citing_paper":{"arxiv_id":"2607.05350","last_updated":"2026-07-06T17:31:35Z","snapshot_observed_at":"2026-08-17T03:31:12.649504Z","submitted_at":"2026-07-06T17:31:35Z","title":"Approximate Minimax Estimation of a Bounded Normal Mean via Stochastic Mirror Ascent","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-07T15:43:58.446157Z"},"links":{"cited_paper":"/paper/2509.08483","citing_paper":"/paper/2607.05350"},"observation_digest":"sha256:ee24b0323e9c169f2d244536e04664a96e4151335be148bdb865fed26cf1f79c","observation_id":"b1c8667b-498d-4f09-9078-41fb22c56e67","resolution":{"observed_at":"2026-07-07T15:53:54.526919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.08483/citation-record","integrity":"/paper/2509.08483/integrity","json":"/paper/2509.08483/citation-record.json","paper":"/paper/2509.08483"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:31.713851Z","title":"Edge of Stochastic Stability: Revis- iting the Edge of Stability for SGD","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.713851Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:cfeac6c442bbd928a288163fcbd1ff6aa951f500b176bad9ac174cb3e4901e61","observation_id":"cc9e9185-bd96-4769-b210-7f6073b3a704","resolution":{"observed_at":"2026-08-15T16:16:31.713851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.809410Z","title":"Post-groups, (Lie-)Butcher groups and the Yang–Baxter equation","venue":null,"work_id":"81a047f0-bd01-4270-803c-4753cc02b9a5","year":2024},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.718240Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:50c662592b8f6f2054e840f2dc4d4ddce6a6df44d5f813e3e2fd1a2edd60151d","observation_id":"41ea60a6-8c1c-4c32-a424-23d4243236fa","resolution":{"observed_at":"2026-08-15T16:16:32.814775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.795772Z","title":"Implicit Gradient Regularization","venue":null,"work_id":"cb507a45-2d26-46f6-b073-6387d2d83d42","year":2021},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.722118Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:b4872c60d4a43eb48510c24ce72441f25925046e30b6869d0f40f475c08d06bf","observation_id":"6977c30e-65c0-4950-8a2a-e5d16ce6b842","resolution":{"observed_at":"2026-08-15T16:16:32.800170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16143","last_updated":"2024-04-20T13:38:32Z","snapshot_observed_at":"2026-08-19T21:09:53.277120Z","submitted_at":"2023-12-26T18:06:48Z","title":"On the Trajectories of SGD Without Replacement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16143","snapshot_observed_at":"2026-08-15T16:16:31.726162Z","title":"On the Trajectories of SGD Without Replacement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.726162Z"},"links":{"cited_paper":"/paper/2312.16143","citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:8b2968ad683387e611fece5c88338d52d8827d825c7fc1c247cbfcec60289e2e","observation_id":"348bf1dc-5b50-4e0c-8be0-1e9ec8bbc21c","resolution":{"observed_at":"2026-08-15T16:16:31.726162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.782367Z","title":"Old Optimizer, New Norm: An Anthology","venue":null,"work_id":"5c2eb866-2fe4-45f9-8cdc-13486a297026","year":2024},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.731342Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:7829b71ede4fdf95f155302f8b69d358050ed713bf9b797528b3caeb27198d1c","observation_id":"a6f49fd5-1526-432c-8042-9fb4f89823a4","resolution":{"observed_at":"2026-08-15T16:16:32.786665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.769667Z","title":"Numerical methods for dynamical systems","venue":null,"work_id":"2e22fee2-1766-4280-9323-25529aa47165","year":1991},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.735719Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:854af8a20a4542cb1675f6948a5c6369b7db9a6e8b44d57263e06aeb88d41a3b","observation_id":"e1a0b573-c8bb-4f7e-b912-473d36e93453","resolution":{"observed_at":"2026-08-15T16:16:32.773887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.756507Z","title":"Optimization methods for large-scale machine learning","venue":null,"work_id":"c8b87188-e450-4277-a5af-9b949c5640d6","year":2018},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.740651Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:eb193d57953d59e0684b6485c2123aafa39412f73046e5f3d306cb12df671075","observation_id":"87ef274c-ecf2-4f8a-ac30-402154adf9ac","resolution":{"observed_at":"2026-08-15T16:16:32.761158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.742921Z","title":"An algebraic theory of integration methods","venue":null,"work_id":"9163d839-d8d0-4d2e-a93b-accdf2859a25","year":1972},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.744781Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:6f8bd04ac14fda52d4d0aeaebdb8c9375def9607dcad0c96eabeb4c5248db363","observation_id":"de94fc55-058d-4127-a7c8-73da4eadf39e","resolution":{"observed_at":"2026-08-15T16:16:32.747526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.730172Z","title":"Modified equations for ODEs","venue":null,"work_id":"f57c26ec-03e2-468f-83b0-1ffcc54f3ef8","year":1994},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.749062Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:978213bef959dce498af3377f7a03c92df7de4c53545883e0b50f60f3891ed8f","observation_id":"35d8cb3b-834a-455d-94f8-795344e767ab","resolution":{"observed_at":"2026-08-15T16:16:32.734336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.716995Z","title":"On the Implicit Bias of Adam","venue":null,"work_id":"5a4157bd-9d5e-4fca-8612-8a4955a6cea3","year":2024},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.753169Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:6d2699f17be3edda0d67edbb1f25c6ad0c5001616ff6a9d2b12d57493842d2d5","observation_id":"4313154b-07f5-4866-a186-c11274690d36","resolution":{"observed_at":"2026-08-15T16:16:32.721323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.02132","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.111321Z","title":"How Memory in Optimization Algorithms Im- plicitly Modifies the Loss","venue":null,"work_id":"81d1bea6-a0e7-4087-a9d1-f2d0522d2b76","year":2025},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.757265Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:2414ac2d13b45bfe15fe27efb37596220b135d139bd9d64e9997c977ac0a407f","observation_id":"88352d3d-e57b-4013-a770-c0b6aac95142","resolution":{"observed_at":"2026-08-15T16:16:32.118442Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.704926Z","title":"Algebraic structures of B-series","venue":null,"work_id":"10d84d9d-fab4-4ed8-bd10-978882bb9abb","year":2010},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.761461Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:89073fa82529b070047fafdf2366e6c97e09c01dffaade19a7c461a7e246ac3d","observation_id":"9dec9ad0-06e8-4a58-8655-45c57ae38dbd","resolution":{"observed_at":"2026-08-15T16:16:32.708758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.692247Z","title":"Numerical integrators based on mod- ified differential equations","venue":null,"work_id":"681938d6-f158-4185-8e58-1b6a410ef682","year":2007},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.765523Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:c293de2a4e7ab29d14e3abd404eaaa9ca0de7173fd7a808d7d9b0e1656923099","observation_id":"fa7f0200-a037-4d52-96f5-4ff445a5447f","resolution":{"observed_at":"2026-08-15T16:16:32.696274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.679943Z","title":"Gradient Descent on Neural Networks Typically Occurs at the Edge of Stability","venue":null,"work_id":"d6f82f76-81e5-453b-8760-cbdc84542c7c","year":2021},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.769341Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:42a931a2231d8ef716505e763ea69cf8240e918d1d299281d6b08067d41af323","observation_id":"46b709c9-97e5-46e6-b733-9098c844bd67","resolution":{"observed_at":"2026-08-15T16:16:32.683778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.666933Z","title":"Enumerating a class of lattice paths","venue":null,"work_id":"a64fdad7-f398-466b-b8ee-8399ff7ae2c7","year":2003},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.774304Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:2f66181638bd902f0e3b855724251bf7aa2fee987bcec40f9e3d0fbfd7e7c64d","observation_id":"f209ea5c-5303-4ba2-a696-97d922905bb7","resolution":{"observed_at":"2026-08-15T16:16:32.671181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.653383Z","title":"Aspects of backward error analysis of numerical ODEs","venue":null,"work_id":"f9332c83-1b02-4f36-a998-97b18fc4c95c","year":1993},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.778441Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:daa771b897ada64bd7169e68144b7e957e13c7951b758e967b2a991315451e18","observation_id":"1195bc60-81d3-4f05-afef-221bf0433dab","resolution":{"observed_at":"2026-08-15T16:16:32.658075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.640165Z","title":null,"venue":null,"work_id":"f213cc04-0389-4580-a36d-979431b0806b","year":2006},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.783202Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:25d016804b7fa6ee8309a7c8760e582d23b9f045fa201fba486dde93657d04ca","observation_id":"25eb5ce2-01c8-4f49-83a4-abf2c943700b","resolution":{"observed_at":"2026-08-15T16:16:32.644346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.626734Z","title":"Multiscale analysis of accelerated gradient methods","venue":null,"work_id":"2839fcdd-4f17-4287-971d-9b419897f784","year":2020},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.787526Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:f511cfe5f69e47f762a0ed5609600f11a8badb247e7fe89e6b5f2c39fee7704b","observation_id":"35ad1047-b5ad-4544-8213-165b86889fcb","resolution":{"observed_at":"2026-08-15T16:16:32.631201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09364","last_updated":"2021-01-22T22:18:56Z","snapshot_observed_at":"2026-08-16T18:50:34.388120Z","submitted_at":"2021-01-22T22:18:56Z","title":"Rooted tree graphs and the Butcher group: Combinatorics of elementary perturbation theory","version":1},"cited_work":{"arxiv_id":"2101.09364","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.09364","snapshot_observed_at":"2026-08-15T16:16:31.992719Z","title":"Rooted tree graphs and the Butcher group: Combinatorics of elementary perturbation theory","venue":"math.CO","work_id":"ca02b37c-f86e-45e3-b9ca-9b76b69ef836","year":2021},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.791261Z"},"links":{"cited_paper":"/paper/2101.09364","citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:8dac65cd4fc6e4ee6cbc4d591209cefc0c2d6eda67641a654b62463010becb84","observation_id":"6f4c4dd4-57b5-499f-9552-2f4cb1f9c138","resolution":{"observed_at":"2026-08-15T16:16:31.999607Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.613063Z","title":"Formal power series and numerical algorithms for dynamical systems","venue":null,"work_id":"82f7e7bf-c09f-46bd-a35a-9fb70d3440dc","year":1991},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.795461Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:0764ba58bde77c0babb9a5c9b72be16bf56ec74f39344f84fe696c371818b2da","observation_id":"aecb02af-4e28-4582-935e-56362d3599ef","resolution":{"observed_at":"2026-08-15T16:16:32.617703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.599911Z","title":"Persistence and smoothness of invariant manifolds for flows","venue":null,"work_id":"2d405092-7317-4fba-bb57-855ce435d213","year":1971},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.798966Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:92517af844ecc40f12ffe47ed2ae6da277babf95bc458da8ef01919781fdeb51","observation_id":"407e4e5c-cad7-4692-ae20-e3c8150fcdc7","resolution":{"observed_at":"2026-08-15T16:16:32.604369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.586769Z","title":"Sharpness-aware Minimization for Efficiently Improving Generaliza- tion","venue":null,"work_id":"0f632845-00af-404f-8cde-fffa9f034e63","year":2021},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.802760Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:d97b5214d8daadf8c14c9dddb19ba40df1b692de73a09c36ad2effe26e3e3852","observation_id":"c31315ca-a17b-49fa-b827-c10ef3e0f104","resolution":{"observed_at":"2026-08-15T16:16:32.591094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.572863Z","title":"Implicit regularization in Heavy-ball momentum accelerated stochas- tic gradient descent","venue":null,"work_id":"7a7731f6-abb4-4746-b98d-cbbd76d20675","year":2023},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.807257Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:958356e35c06122110e5eed7876919060e76429178dda216d0d38aeccbf5b07b","observation_id":"fa6a7f24-80db-4912-af09-2b5ad8f5cddb","resolution":{"observed_at":"2026-08-15T16:16:32.577868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.560992Z","title":null,"venue":null,"work_id":"bbf64156-b45d-48ce-a5c4-a16873d9b344","year":2016},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.811265Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:7ba16dfcc01caf947c9f97cad454861f699d11e327094d57f890dbd4743f7b6c","observation_id":"40ecdb84-54fd-460e-b7e6-87e21d351d1d","resolution":{"observed_at":"2026-08-15T16:16:32.564596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.548539Z","title":"On the scope of the method of modified equations","venue":null,"work_id":"8a599001-c308-4106-94b7-85f4049aa9a8","year":1986},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.815293Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:d61e95d3e2368dd2296bc45d67573adc2c11066ec6ce15797f9eae259b847213","observation_id":"df5792a5-90c9-49eb-a160-7d56a989f8d0","resolution":{"observed_at":"2026-08-15T16:16:32.552971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.535159Z","title":"Shampoo: Preconditioned Stochas- tic Tensor Optimization","venue":null,"work_id":"f35a4c05-170d-4935-9b40-a9794dba8066","year":2018},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.819470Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:724ada15fd43f9387bbcabe8e51f6891380ebf7ef8b2b3db8a68094caca789bb","observation_id":"07648af0-061e-4065-b3c3-c2bcbdf18d71","resolution":{"observed_at":"2026-08-15T16:16:32.539513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.521710Z","title":"Backward analysis of numerical integrators and symplectic methods","venue":null,"work_id":"4ede9f2d-6534-4352-a43e-68593e63463e","year":1994},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.823651Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:3e30bdaf1cf81a0262badf6bf2eb7bcfe6f98907670f93a869d3c9e223bac817","observation_id":"b86d383e-f73d-4498-9f69-71457009f4f3","resolution":{"observed_at":"2026-08-15T16:16:32.526136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.508289Z","title":"On the Butcher group and general multi-value meth- ods","venue":null,"work_id":"898bb9e5-b677-4302-ad78-8c9de32f185e","year":1974},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.828962Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:bb730d983bcf4bcecfc65675292ae44b7ce35831f33cce911eae53f6b0a6b212","observation_id":"791d3732-5bda-49e4-aef9-2efb326a4845","resolution":{"observed_at":"2026-08-15T16:16:32.512945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.494627Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"4f16686e-8873-44ef-a614-84c7fe82454f","year":2016},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.833522Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:79ba3f2eebd2903332f93fe1368e32afd46699ee39dd9df4599fb5e4205be27d","observation_id":"df94252c-1f37-4704-80ac-d5fdab58f56a","resolution":{"observed_at":"2026-08-15T16:16:32.499133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.481231Z","title":"Bag of tricks for image classification with convolutional neural networks","venue":null,"work_id":"0ccc02ae-4739-42cd-9f4e-960c12eb0fcf","year":2019},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.837594Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:01d584fc36d8c3cb948afae777b6500df7347868661ea062e69ea6037d8b58bb","observation_id":"1eaa5fa2-8b69-4721-a546-89f234ca0f38","resolution":{"observed_at":"2026-08-15T16:16:32.485614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.467572Z","title":"Invariant manifolds","venue":null,"work_id":"0550a9ba-7f4c-4224-b8de-83bd0fca05cd","year":1970},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.842646Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:935df8ed6f78d1c430c54657ae1cfec091bf5a7cb5682d0a77e890f367187700","observation_id":"f9178e6a-262f-47a9-ba4e-bd1a7d5ab787","resolution":{"observed_at":"2026-08-15T16:16:32.471833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.454130Z","title":null,"venue":null,"work_id":"b951dffa-01d1-4034-aabd-e646c288badf","year":1999},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.847659Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:772a096984a29124af406819c69de8123f72e195a1133d9e5e808b7fd78cef51","observation_id":"5633c672-3157-43db-83e0-bcc4110a5400","resolution":{"observed_at":"2026-08-15T16:16:32.458261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.441880Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","venue":null,"work_id":"bcc7c9d0-8c31-4a2a-ade3-8eb9ce0ab214","year":2017},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.851750Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:e08e754c66ea569d94bce59957ebe9d8ede71c05f0da5d1c25db9bb90b57a90d","observation_id":"8f3757b6-04fe-4fe2-a6cd-e103fac19b0a","resolution":{"observed_at":"2026-08-15T16:16:32.445903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T16:16:31.856530Z","title":"Adam: A Method for Stochastic Optimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.856530Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:9b1dea93d9d426cad6d4c78c841daa3caac7f157bb90bb4b84ec71e218992303","observation_id":"cbe5e6e1-3268-4776-a0ee-b54fd079ae7c","resolution":{"observed_at":"2026-08-15T16:16:31.856530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.429313Z","title":"Continuous Time Analysis of Momentum Methods","venue":null,"work_id":"48964e78-7e90-45a6-9735-9afb2453e625","year":2021},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.860830Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:66083711b2b1cf45750cca633ac9fdff4a94d0f4e7e246d76221c64a652f3070","observation_id":"c74a0b07-7263-4a9f-a24b-d09b96513264","resolution":{"observed_at":"2026-08-15T16:16:32.433257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.415792Z","title":"ImageNet Classification with Deep Convolutional Neural Networks","venue":null,"work_id":"885799c8-31db-4c55-a78c-b26b6683d249","year":2012},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.865120Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:1153b480f7b18d5470e5bcc2b2b1831ef56363e4cd8a8d1128ea00294751b417","observation_id":"61661e05-1f80-49ed-ae99-675444534a86","resolution":{"observed_at":"2026-08-15T16:16:32.420241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07612","last_updated":"2018-04-20T13:44:12Z","snapshot_observed_at":"2026-08-20T00:49:56.855387Z","submitted_at":"2018-04-20T13:44:12Z","title":"Revisiting Small Batch Training for Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07612","snapshot_observed_at":"2026-08-15T16:16:31.869517Z","title":"Revisiting small batch training for deep neural net- works","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.869517Z"},"links":{"cited_paper":"/paper/1804.07612","citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:9fe2a7397252d47924182979decb734864aafd65b250aa0e714338df04aa3feb","observation_id":"8a16c849-49b9-4975-9b49-437f55f9823d","resolution":{"observed_at":"2026-08-15T16:16:31.869517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.402274Z","title":"Toward Equation of Motion for Deep Neural Networks: Continuous-time Gradient Descent and Discretization Error Analysis","venue":null,"work_id":"1177132a-2048-4767-b1a5-3f361b191052","year":2022},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.874096Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:55dfa150f76989daf141636689d18b2900438fa6a1da3ea56facdadda15b65a9","observation_id":"a309d51b-f707-4f76-8a85-1c82dd3c78d7","resolution":{"observed_at":"2026-08-15T16:16:32.406873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.389412Z","title":"Some methods of speeding up the convergence of iteration methods","venue":null,"work_id":"4684b902-6281-4dda-a008-5c8f353f21fd","year":1964},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.877785Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:8d55f157777f489ce99a37bba825929e95a16189edfbf896425d4c0c034a8bad","observation_id":"1d514360-6a63-45d5-bca0-4ab52da432be","resolution":{"observed_at":"2026-08-15T16:16:32.393572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.376036Z","title":"Prince.Understanding Deep Learning","venue":null,"work_id":"1e3f60b8-e190-4996-852d-59aaba34b933","year":2023},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.881433Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:8689d8d72b7da486fd54d255344fc13ddd8e449f238fc486463d40f810e301a8","observation_id":"9f77d9cb-a8e8-4ff4-a397-10db2478920c","resolution":{"observed_at":"2026-08-15T16:16:32.380575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.361716Z","title":"Backward error analysis for numerical integrators","venue":null,"work_id":"09ce47c4-458b-4d46-bda6-0c9a8dca4a4b","year":1999},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.884973Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:f84506985f692fe11f7b6f81ece33c84a4ecaffff15f746eeb9243405b691a2a","observation_id":"63ee9cad-3d4f-4391-82f4-1fb3eaa0be2a","resolution":{"observed_at":"2026-08-15T16:16:32.366399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.348552Z","title":"On a continuous time model of gradient descent dynamics and instability in deep learning","venue":null,"work_id":"7f5b417e-7dd9-4acd-b29d-02b06c8bf58c","year":2023},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.888797Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:629117037a4b943351d624d1eaedbfa94b6f480f23cac7ce8c96ecaebd843daa","observation_id":"e96d0c18-1a27-4abb-b266-216d67fb149b","resolution":{"observed_at":"2026-08-15T16:16:32.353171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.334570Z","title":"Understanding the acceleration phenomenon via high-resolution differential equations","venue":null,"work_id":"11f8a708-3e81-40d1-9bef-dfc027d45827","year":2022},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.892270Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:2cad3427c5918650df061e7a7b171edb386802bb86da510164cf1ff618863944","observation_id":"32956a76-1d20-4750-aad5-303bf888acba","resolution":{"observed_at":"2026-08-15T16:16:32.339127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.320382Z","title":"On the Generalization Benefit of Noise in Stochastic Gradient Descent","venue":null,"work_id":"4021abd5-ade4-41b8-b40c-c81332e614d1","year":2020},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.896625Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:9e530ce0ffc91515b6572774b2e34d19529011ccdeabbdfcc419d1845a4cccb2","observation_id":"a6c47f74-b33f-4f81-8239-f34bc7c51c82","resolution":{"observed_at":"2026-08-15T16:16:32.325097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.307909Z","title":"On the Origin of Implicit Regularization in Stochastic Gradient Descent","venue":null,"work_id":"5077f2ba-eeef-4eaa-a638-475fc7a8fc38","year":2021},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.900828Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:e206d749a7c8335e03b88fc021be06147e38a53b77f10073b41e63fa161c4acf","observation_id":"c70974cc-1b3f-4fbb-83e4-c8e970de7576","resolution":{"observed_at":"2026-08-15T16:16:32.311852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.295461Z","title":null,"venue":null,"work_id":"18e92eee-3295-4896-8d30-338e8834894b","year":1998},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.905088Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:801ad01a1e25bc32fe2efd61723a2fa796107f1ca2b639c6cc8735784c0bde85","observation_id":"82421913-2fa7-41f4-a452-3480428d8cdd","resolution":{"observed_at":"2026-08-15T16:16:32.299486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.280547Z","title":"On the importance of initialization and momentum in deep learning","venue":null,"work_id":"fbd6b032-b3ff-4173-b259-e880082009c5","year":2013},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.909305Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:e9e994d3264b34acd7ae6253e08c1f129f0d349caad5fcbfe5f1524bd08ecf3d","observation_id":"c6ace5ee-cf8f-4e18-92b5-6e9eee694b87","resolution":{"observed_at":"2026-08-15T16:16:32.285583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.265858Z","title":"The modified equation approach to the stability and accuracy analysis of finite-difference methods","venue":null,"work_id":"9d2e120a-290b-4d33-8dc6-dca88c28badb","year":1974},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.913577Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:cd9e41e4258040112b7df36ab2494709de5d5ff709ba1282907d72b31d4a28e3","observation_id":"6dd2614d-26eb-4202-9f42-3511bea1eab3","resolution":{"observed_at":"2026-08-15T16:16:32.270494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.251730Z","title":null,"venue":null,"work_id":"53820dc1-9ce5-423e-b4d5-6a80de9298a3","year":2013},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.917697Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:f40f72a71fee6506d73fca77634d8961132966b881213d82f1e6be24b571a85e","observation_id":"83443dd9-fbe1-4454-a743-42705a2f309f","resolution":{"observed_at":"2026-08-15T16:16:32.256318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.236475Z","title":"Error analysis of floating-point computation","venue":null,"work_id":"553ccc0b-3fe6-47ed-b9f2-205b0eb927e8","year":1960},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.922706Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:241f222b5b042fd2251ddeccd1b48f313867f0703ec0b8b20197c814d8ab2efc","observation_id":"5ceaab9d-e2e9-4d46-a80f-9df6478dce0b","resolution":{"observed_at":"2026-08-15T16:16:32.241232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.222205Z","title":"Aggregated residual transformations for deep neural networks","venue":null,"work_id":"0536a0ae-fc66-4255-a14d-811e7e2c71bc","year":2017},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.927046Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:e52d43464a8f271b96d1fca251d7876f949b09f95c9aa28b6edfdb08b58ce1e0","observation_id":"bbc17dbd-b467-4c87-9b57-0d611e78fe56","resolution":{"observed_at":"2026-08-15T16:16:32.226716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:16:32.207994Z","title":"Penalizing Gradient Norm for Efficiently Im- proving Generalization in Deep Learning","venue":null,"work_id":"5190f4c1-6596-4e7e-b7fb-af0fbf9d733e","year":2022},"citing_paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T16:16:31.931431Z"},"links":{"citing_paper":"/paper/2509.08483"},"observation_digest":"sha256:bf51549302aa9fead0c90821e9f25ea8bdf5f83a914e44684b70b95f3a9a16f1","observation_id":"318fd572-7e07-4486-86c5-9171a5632780","resolution":{"observed_at":"2026-08-15T16:16:32.212579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.08483","last_updated":"2025-09-10T10:47:54Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T20:50:04.140784Z","submitted_at":"2025-09-10T10:47:54Z","title":"Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":41},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 3 inbound Pith citation observations for arXiv:2509.08483."}