{"as_of":"2026-08-07T11:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:980c679cd5ffc858e06391e71e7244dc0f21da893894cb0f852e8ac1f3d6b410","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:56:21.795284Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:22:15.304977Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-06T04:22:15.304977Z","title":"Optimizers qualitatively alter solutions and we should leverage this,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03649","last_updated":"2025-08-05T16:57:24Z","snapshot_observed_at":"2026-08-06T04:22:14.596374Z","submitted_at":"2025-08-05T16:57:24Z","title":"Cross-Model Semantics in Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:22:15.304977Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2508.03649"},"observation_digest":"sha256:93354812af31b1e0e3c7566a51999a9af1726cb9f67af5fa85bf7778fcc5eee7","observation_id":"125f7d68-abbc-497f-a761-6eddc3f384fd","resolution":{"observed_at":"2026-08-06T04:22:15.304977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2510.04686","last_updated":"2026-04-21T09:01:24Z","snapshot_observed_at":"2026-08-02T11:55:04.825901Z","submitted_at":"2025-10-06T10:56:41Z","title":"How does the optimizer implicitly bias the model merging loss landscape?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T09:49:41.550981Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2510.04686"},"observation_digest":"sha256:3b5fb00ece227ece0f411f5586d06d323164ba2a2e97e1273eba1ca4af788c2a","observation_id":"558ba87f-680f-4c22-aa79-602ef4f30be9","resolution":{"observed_at":"2026-05-18T09:51:13.425976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2604.20365","last_updated":"2026-04-22T09:02:14Z","snapshot_observed_at":"2026-07-31T16:18:31.194212Z","submitted_at":"2026-04-22T09:02:14Z","title":"Benefits of Low-Cost Bio-Inspiration in the Age of Overparametrization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T00:21:37.686664Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2604.20365"},"observation_digest":"sha256:d926edb3b9e69bbaaba357f8adcaa0f526f465e7b9bd5bd5b4a7fe7d1a3d504a","observation_id":"3ef28a47-5dc6-4f83-a96d-f73b047389de","resolution":{"observed_at":"2026-05-10T00:24:46.477571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2605.21803","last_updated":"2026-05-20T23:00:34Z","snapshot_observed_at":"2026-08-01T18:06:03.629869Z","submitted_at":"2026-05-20T23:00:34Z","title":"Same Architecture, Different Capacity: Optimizer-Induced Spectral Scaling Laws","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T08:49:32.864065Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2605.21803"},"observation_digest":"sha256:2729da0f20cd1f90ac6ec35e6207cb621128ce20f8051a7a4bf71f3f2ffdded3","observation_id":"79f339b7-602b-4362-8404-1d07f0f08213","resolution":{"observed_at":"2026-05-22T08:51:18.269939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2605.27662","last_updated":"2026-05-26T20:25:44Z","snapshot_observed_at":"2026-08-01T16:04:11.431819Z","submitted_at":"2026-05-26T20:25:44Z","title":"How the Optimizer Shapes Learned Solutions in Equivariant Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T17:59:03.152111Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2605.27662"},"observation_digest":"sha256:2291aefe2dfb1323308b75a867c70d2ccdcb4ff39845cf619ec0d3c0c0bca5cd","observation_id":"0751ef79-8d03-46b6-8692-4a2254da0e66","resolution":{"observed_at":"2026-06-29T18:03:48.001449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2606.11123","last_updated":"2026-06-09T17:21:25Z","snapshot_observed_at":"2026-08-06T11:25:30.226674Z","submitted_at":"2026-06-09T17:21:25Z","title":"Overcoming Rank Collapse in Feedback Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T13:52:57.960921Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2606.11123"},"observation_digest":"sha256:7f1fed2602e015a1c45cb91a9567796b5cdbd8a2c7593110cde8b67a4378d553","observation_id":"e611b25f-9546-4e74-86f1-1ac495debd39","resolution":{"observed_at":"2026-07-03T04:27:37.207966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-01T17:31:48.677047Z","title":"Optimizers qualitatively alter solu- tions and we should leverage this.arXiv preprint arXiv:2507.12224,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17624","last_updated":"2026-07-20T07:26:17Z","snapshot_observed_at":"2026-08-05T12:21:27.591563Z","submitted_at":"2026-07-20T07:26:17Z","title":"Can Transformers Really Do It All? On the Compatibility of Inductive Biases Across Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T17:31:48.677047Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2607.17624"},"observation_digest":"sha256:15dc25c19efeb0f10747ca1754febd6008e43e12e76c45394589bb2b36a1d0df","observation_id":"8f9fb4d3-38b5-4b8a-b259-256ee344464b","resolution":{"observed_at":"2026-08-01T17:31:48.677047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12224/citation-record","integrity":"/paper/2507.12224/integrity","json":"/paper/2507.12224/citation-record.json","paper":"/paper/2507.12224"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1710.03667","last_updated":"2017-10-10T15:48:12Z","snapshot_observed_at":"2026-08-05T16:01:52.576963Z","submitted_at":"2017-10-10T15:48:12Z","title":"High-dimensional dynamics of generalization error in neural networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03667","snapshot_observed_at":"2026-08-06T16:56:21.467822Z","title":"Advani and Andrew M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.467822Z"},"links":{"cited_paper":"/paper/1710.03667","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a2778cb8e75ddfbbbcba086d12437bac1a2a0b821b69b4a4b01c0f1d11cc364b","observation_id":"13570ae0-c803-4c82-a256-42816735eadf","resolution":{"observed_at":"2026-08-06T16:56:21.467822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05421","last_updated":"2019-04-12T14:47:02Z","snapshot_observed_at":"2026-07-06T06:44:49.023966Z","submitted_at":"2018-06-14T09:06:10Z","title":"Selfless Sequential Learning","version":5},"cited_work":{"arxiv_id":"1806.05421","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.05421","snapshot_observed_at":"2026-08-06T16:56:23.070621Z","title":"Selfless Sequential Learning","venue":"stat.ML","work_id":"7c02bd6c-e9c1-4308-808e-0680256a4def","year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.475398Z"},"links":{"cited_paper":"/paper/1806.05421","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:c6b2d5b21c144bc43d861e713379932689655b3df097ffb1aa5da6e91b60cf99","observation_id":"c861194e-09b7-4c0a-9422-0e3ca5c8b8ce","resolution":{"observed_at":"2026-08-06T16:56:23.128971Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.479422Z","title":"Learning and generalization in overparame- terized neural networks, going beyond two layers","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.479422Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0106d689db79df5b7a6c1a026e44e430a33ad9260cce362ea1887f9f0805756a","observation_id":"1ced9c68-3efb-49c0-841c-13e4a47293cb","resolution":{"observed_at":"2026-08-06T16:56:21.479422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.483888Z","title":"Natural gradient works efficiently in learning","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.483888Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4de0b607590aaa14d2004c70fccdc31685be5890f90a01c4571e19107490a31e","observation_id":"c6b3db26-9fae-4090-bc2b-9192ce5efafe","resolution":{"observed_at":"2026-08-06T16:56:21.483888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:30.554481Z","title":"When does preconditioning help or hurt generalization? 2020","venue":null,"work_id":"c98f31ce-0ab4-4c90-9773-732bccfa708c","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.488150Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:996da8f4bac22555efe38254f3c8670299c66b26d93d05c0b4924fa2b259b04a","observation_id":"bd3a1dca-2e74-4d63-807d-c75ec80a60bf","resolution":{"observed_at":"2026-08-06T16:56:30.616739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13655","last_updated":"2019-10-26T07:09:24Z","snapshot_observed_at":"2026-08-05T12:07:30.166192Z","submitted_at":"2019-05-31T14:54:36Z","title":"Implicit Regularization in Deep Matrix Factorization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13655","snapshot_observed_at":"2026-08-06T16:56:21.492418Z","title":"Implicit regularization in deep matrix factorization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.492418Z"},"links":{"cited_paper":"/paper/1905.13655","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e444b6cb3cf58a742be9501fb6aa6a934d051f6b99d6df778bd4046546fdde91","observation_id":"75d79d22-da28-4cff-8d4b-0e060bc218a3","resolution":{"observed_at":"2026-08-06T16:56:21.492418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11162","last_updated":"2022-07-18T20:57:25Z","snapshot_observed_at":"2026-07-06T09:58:08.880543Z","submitted_at":"2020-09-23T14:17:53Z","title":"Implicit Gradient Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11162","snapshot_observed_at":"2026-08-06T16:56:21.496667Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.496667Z"},"links":{"cited_paper":"/paper/2009.11162","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:250ea13ecd844a2bdb5468a1d44843a585f7e9c7a66b86f29818b4dfceb5918c","observation_id":"469237c1-e7b6-4730-92df-245978afd23e","resolution":{"observed_at":"2026-08-06T16:56:21.496667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.500701Z","title":"Reconciling modern machine- learning practice and the classical bias–variance trade-off.Proceedings of the National Academy of Sciences, 116(32):15849–15854, July 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.500701Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3cd50303d83c46893e5a515f5ca1d03203676b07b02682d3675945f35792ef66","observation_id":"d74e641f-4675-4159-b3b4-deee2d616393","resolution":{"observed_at":"2026-08-06T16:56:21.500701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:30.347128Z","title":"Learning deep architectures for ai","venue":null,"work_id":"5366511b-1d4b-425d-9518-024b9dff7639","year":2009},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.504094Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3aeb19d00c90082f4da2557c1f93e417a09eccc830c82f1f06932aa399a9f447","observation_id":"6c954426-2e54-4417-9e31-17200f66ee3f","resolution":{"observed_at":"2026-08-06T16:56:30.433864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:30.178248Z","title":"Scaling Learning Algorithms towards AI","venue":null,"work_id":"193c1e2e-30b4-4e46-85a6-56a10c630677","year":2007},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.508763Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:37d7acc1495338bd757314c429b61e7163e942c1df0c2f9e728995da22e16290","observation_id":"7a367dce-023b-49e0-8bfc-301d37fdac82","resolution":{"observed_at":"2026-08-06T16:56:30.261518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.937843Z","title":"Greedy layer-wise training of deep networks","venue":null,"work_id":"eacf69a6-86b5-4881-b4f7-d720bf343533","year":2006},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.512251Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3e7c420b288247d6cad29374f8c58781211d0a657feac2c47e8378debce643fb","observation_id":"f8b94d34-9176-4b24-85ca-32bdc4d9e6a5","resolution":{"observed_at":"2026-08-06T16:56:30.092830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20325","last_updated":"2024-12-06T14:09:22Z","snapshot_observed_at":"2026-08-03T03:18:47.425243Z","submitted_at":"2024-09-30T14:26:12Z","title":"Old Optimizer, New Norm: An Anthology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20325","snapshot_observed_at":"2026-08-06T16:56:21.515682Z","title":"Old optimizer, new norm: An anthology, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.515682Z"},"links":{"cited_paper":"/paper/2409.20325","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0a9f96a1c2f2e76342661442b58718982d3248a452fe10b62d1c5b94b66683fe","observation_id":"f437dcf3-da5b-4491-ae2a-ae9c67b16592","resolution":{"observed_at":"2026-08-06T16:56:21.515682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.799556Z","title":"The tradeoffs of large scale learning","venue":null,"work_id":"89331dfe-2dcc-4059-931b-59f39a746313","year":2007},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.519396Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:2c3e0cc6977c82c048b83fca8f3ded629549fa201f9fcfdb83de07400b6adce2","observation_id":"b4d81502-93b5-4350-9b9e-fc621a306351","resolution":{"observed_at":"2026-08-06T16:56:29.873526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.691082Z","title":"Large scale online learning","venue":null,"work_id":"967a44a3-d561-42e9-b2ff-76e09373ce3d","year":2003},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.522553Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:32bd65e5741b1ea1ff5db5f7e4ba8c9d469e0cf6b0220f7d908c3905cb34e5ba","observation_id":"a88f1dc2-487e-4c30-acd5-6bf3c6df2934","resolution":{"observed_at":"2026-08-06T16:56:29.734055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-06T16:56:21.526427Z","title":"Chayes, Levent Sagun, and Riccardo Zecchina","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.526427Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:45f45df4d1cbec1d6b507fdf76806b77e8f401f1ce7e47bf3034342d002db546","observation_id":"cccf5ace-63da-43b2-b3e6-004ac0f53179","resolution":{"observed_at":"2026-08-06T16:56:21.526427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.573983Z","title":"On lazy training in differentiable program- ming","venue":null,"work_id":"a8a5ad8f-fcc7-4e31-8928-43e7f6e09ec9","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.530713Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:7eade7dafd05af79b01df5b6331783060929f23ea9d35525f1ef8580e886ce3a","observation_id":"5c1c6b40-1bd1-4546-b316-d76d6c9cba97","resolution":{"observed_at":"2026-08-06T16:56:29.654561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.403491Z","title":"Open problem: The landscape of the loss surfaces of multilayer networks","venue":null,"work_id":"82580912-93d1-4c61-9539-afb28267dbce","year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.534425Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:916e46b77c46bf123dd054a5ca75bd63b848596b70270cb5ac1e0086c82e4056","observation_id":"897a9b41-108d-48dd-8398-a46d9495f9e3","resolution":{"observed_at":"2026-08-06T16:56:29.463766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.248954Z","title":"Turing completeness of bounded-precision recurrent neural networks","venue":null,"work_id":"1d74f8ec-52a6-4eb0-ab2b-31001101c105","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.537875Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:c0a003f0c975f5979e4f4e5f6a48f2e73b817a2dde1fa1ddc30f8452df215cdf","observation_id":"2c8e19f8-6588-489a-bffe-2d40ea1ab63f","resolution":{"observed_at":"2026-08-06T16:56:29.323915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.102146Z","title":"Dauphin, Razvan Pascanu, Caglar Gulcehre, Kyunghyun Cho, Surya Ganguli, and Yoshua Bengio","venue":null,"work_id":"8cce0aed-72c0-4b18-aa61-6f333f58e893","year":2014},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.541561Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:20114701c4202d796a4c5c2769d5faecedaf02d1a759d6e37738e5a539ef34e8","observation_id":"cb33a1e1-0e8e-4737-b102-94d04b97af92","resolution":{"observed_at":"2026-08-06T16:56:29.166063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.545762Z","title":"A continual learning survey: Defying forgetting in classification tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.545762Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:969806149c5026d4cd248a6221c012e42707cb80c8e2970e2d60367972cf96bd","observation_id":"2f3d241c-f3e2-4a1f-87b8-a99034d1aba4","resolution":{"observed_at":"2026-08-06T16:56:21.545762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04933","last_updated":"2017-05-15T23:33:19Z","snapshot_observed_at":"2026-07-06T05:33:41.623357Z","submitted_at":"2017-03-15T05:12:25Z","title":"Sharp Minima Can Generalize For Deep Nets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04933","snapshot_observed_at":"2026-08-06T16:56:21.549446Z","title":"Sharp minima can generalize for deep nets, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.549446Z"},"links":{"cited_paper":"/paper/1703.04933","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:b8f92880a9efedb780e27d72dc0cb0369b080b948f6ce31387869c722d6ecd44","observation_id":"f38362ca-12a6-4277-bd76-3dc258c2e9a9","resolution":{"observed_at":"2026-08-06T16:56:21.549446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.951056Z","title":"A theoretical analysis of catastrophic forgetting through the ntk overlap matrix","venue":null,"work_id":"a29ab785-6df3-4970-9732-19d6e3c1b4a2","year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.554410Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:6803ad4df9c854f4f1693a7d6b7a499b5d99f300982930e541cb17c9c6f50f52","observation_id":"747d978e-5c6b-4ff7-b248-63468021947f","resolution":{"observed_at":"2026-08-06T16:56:29.005838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06325","last_updated":"2022-05-05T17:16:00Z","snapshot_observed_at":"2026-07-06T11:38:09.580962Z","submitted_at":"2021-08-13T17:33:47Z","title":"Continual Backprop: Stochastic Gradient Descent with Persistent Randomness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.06325","snapshot_observed_at":"2026-08-06T16:56:21.558771Z","title":"Continual backprop: Stochastic gradient descent with persistent randomness","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.558771Z"},"links":{"cited_paper":"/paper/2108.06325","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1fde1dab343d24ca800049e085716c045b86e3d27c407f332072fcb09367b15a","observation_id":"6141deb0-1f43-459e-96cb-e193431be8df","resolution":{"observed_at":"2026-08-06T16:56:21.558771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15632","last_updated":"2024-01-12T16:13:26Z","snapshot_observed_at":"2026-07-06T15:47:26.532273Z","submitted_at":"2023-06-27T17:13:20Z","title":"Asynchronous Algorithmic Alignment with Cocycles","version":3},"cited_work":{"arxiv_id":"2306.15632","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.15632","snapshot_observed_at":"2026-08-06T16:56:22.796135Z","title":"Asynchronous Algorithmic Alignment with Cocycles","venue":"cs.LG","work_id":"ef1d0354-8e49-493c-8ed8-3b334dab5d4e","year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.562471Z"},"links":{"cited_paper":"/paper/2306.15632","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a1a1bed6f3e5e164495cc6727ddbc4f558f766a99c3b92bac85567fbbfe028df","observation_id":"533c354a-1237-4521-8eea-3d0e96f81c26","resolution":{"observed_at":"2026-08-06T16:56:22.860575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.786510Z","title":null,"venue":null,"work_id":"9a565b0a-5170-492e-b81a-408be494cd2c","year":2010},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.566076Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0fc3d88d10398144d1145572b9eb64f57c10f5f0bf86ba85ddde0d5e7fef7ac2","observation_id":"5a17fd0e-87a3-43c1-91bb-c1fa4d784c60","resolution":{"observed_at":"2026-08-06T16:56:28.862630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.634446Z","title":"Model-agnostic meta-learning for fast adap- tation of deep networks","venue":null,"work_id":"bfb55686-3b6a-4d62-b001-87338bbe3949","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.569208Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:39bdf3e8f1b4db30d3e4402fdc69fa97574928006ed3523451dfcda07268685b","observation_id":"2ce53fbe-13c8-4c2b-8b45-f872f7a585b7","resolution":{"observed_at":"2026-08-06T16:56:28.723255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.462246Z","title":"Sharpness-aware min- imization for efficiently improving generalization","venue":null,"work_id":"9263820f-d14b-450d-8462-9464422df3a9","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.572373Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:6c2b0951418ec59df0ca73fe38b3a9492b3405ad6fc9b803131005484c885ba8","observation_id":"748c4011-b463-402d-bf87-4c1765fdf4d1","resolution":{"observed_at":"2026-08-06T16:56:28.523574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13343","last_updated":"2022-02-24T17:49:35Z","snapshot_observed_at":"2026-07-06T11:13:26.218341Z","submitted_at":"2021-05-27T17:51:09Z","title":"Drawing Multiple Augmentation Samples Per Image During Training Efficiently Decreases Test Error","version":2},"cited_work":{"arxiv_id":"2105.13343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.13343","snapshot_observed_at":"2026-08-06T16:56:22.653912Z","title":"Drawing Multiple Augmentation Samples Per Image During Training Efficiently Decreases Test Error","venue":"cs.LG","work_id":"83752ff5-020f-47f6-8c01-9cafb4c8ebea","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.576383Z"},"links":{"cited_paper":"/paper/2105.13343","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1e541d76380021d11f0f46af899dac17a454d40e7e1437d6573f06f3d53bf3ce","observation_id":"3d8970fe-db91-4f42-9aad-da7d2f3aef40","resolution":{"observed_at":"2026-08-06T16:56:22.690277Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06898","last_updated":"2020-12-12T20:01:33Z","snapshot_observed_at":"2026-07-06T10:23:49.697086Z","submitted_at":"2020-12-12T20:01:33Z","title":"Revisiting \"Qualitatively Characterizing Neural Network Optimization Problems\"","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.06898","snapshot_observed_at":"2026-08-06T16:56:21.580819Z","title":"qualitatively characterizing neural network optimization prob- lems","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.580819Z"},"links":{"cited_paper":"/paper/2012.06898","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:d926f3ddb1b761540509f30cc5d5637721b16b02217dd85e22f879a170509fa6","observation_id":"4423f3ef-2552-47a3-8430-f043af68336f","resolution":{"observed_at":"2026-08-06T16:56:21.580819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.585238Z","title":"Catastrophic forgetting in connectionist networks","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.585238Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:b12723bcc77ca9f6a7c43d78207859f30676e50aa9a25346a9238efe87eb95dd","observation_id":"e99111d3-feea-48eb-9c4c-a060c2c3a578","resolution":{"observed_at":"2026-08-06T16:56:21.585238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.590032Z","title":"Understanding the difficulty of training deep feedforward neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.590032Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:94ed87e9229ce11c52beb10214675922bfa72390d49d7c75be87bb56b6cc4151","observation_id":"8fc44f1c-50f2-4069-aedb-1965d9cbc189","resolution":{"observed_at":"2026-08-06T16:56:21.590032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6544","last_updated":"2015-05-21T21:44:31Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T21:55:01Z","title":"Qualitatively characterizing neural network optimization problems","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6544","snapshot_observed_at":"2026-08-06T16:56:21.594131Z","title":"Goodfellow, Oriol Vinyals, and Andrew Saxe","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.594131Z"},"links":{"cited_paper":"/paper/1412.6544","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e28c761f926e5d7dd4ac4f90b5735b6e7f47ca1912e2afe1976719c78300a6d9","observation_id":"74f2a661-6894-4837-87f7-d2b82d47b602","resolution":{"observed_at":"2026-08-06T16:56:21.594131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14050","last_updated":"2020-09-29T14:37:12Z","snapshot_observed_at":"2026-07-06T09:59:50.601893Z","submitted_at":"2020-09-29T14:37:12Z","title":"Understanding Human Intelligence through Human Limitations","version":1},"cited_work":{"arxiv_id":"2009.14050","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.14050","snapshot_observed_at":"2026-08-06T16:56:22.534700Z","title":"Understanding Human Intelligence through Human Limitations","venue":"cs.AI","work_id":"b931089f-b15b-445d-b53f-85336f4a6a03","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.598106Z"},"links":{"cited_paper":"/paper/2009.14050","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0f499c79fc33435cc514cff8961631805c1e16dd3e1b4e250a98b7dad62b2b6a","observation_id":"649a1ff6-5400-477a-baf2-c2bdd9b365ac","resolution":{"observed_at":"2026-08-06T16:56:22.572734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09568","last_updated":"2018-03-02T00:12:58Z","snapshot_observed_at":"2026-07-06T06:25:29.112809Z","submitted_at":"2018-02-26T19:36:41Z","title":"Shampoo: Preconditioned Stochastic Tensor Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09568","snapshot_observed_at":"2026-08-06T16:56:21.602594Z","title":"Shampoo: Preconditioned stochastic tensor optimization, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.602594Z"},"links":{"cited_paper":"/paper/1802.09568","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3711baed72b1bd159e23073a230d2dddab593222821db8fe7f30b0d45381d0d4","observation_id":"e096c52e-540f-41ac-81ed-8e44415590fe","resolution":{"observed_at":"2026-08-06T16:56:21.602594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.324861Z","title":"Embracing change: Con- tinual learning in deep neural networks","venue":null,"work_id":"9d8ff032-734d-4360-94b5-7e2b00138dc2","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.606621Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1ad10b212c757aeac989dac62516273b29f06bd1eb84e82464ab546442879c50","observation_id":"db15b856-f66e-4d4e-b3ec-c971c6daf38f","resolution":{"observed_at":"2026-08-06T16:56:28.383613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.610852Z","title":"Hinton, Simon Osindero, and Yee-Whye Teh","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.610852Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:42cb31cb97ed42536a06f25b49921e359d442372d17a642a17fcb255b7834c59","observation_id":"183dc493-937b-4249-b4c0-1c1bde22c7eb","resolution":{"observed_at":"2026-08-06T16:56:21.610852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.185561Z","title":"Flat minima","venue":null,"work_id":"cc2f138a-fdb1-4828-87aa-1d4853f70e80","year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.614692Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9c69921d8dad6d66dc925fd1a80c7649e8defe4ce6723e7d183969601d0298eb","observation_id":"307206eb-0756-4a36-8062-2ba85e6ca0c7","resolution":{"observed_at":"2026-08-06T16:56:28.254650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.005739Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"ceb1f8e8-cb10-4a10-a60e-0fbb4d0f8cc3","year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.623377Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:60e2794d8aa10f58be537af8f0f37ab3eb3b1ec0e1daae835dcc519d4c95e4b4","observation_id":"5d73982b-3a2c-4759-8c88-2b84449b89f0","resolution":{"observed_at":"2026-08-06T16:56:28.078427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.851124Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":"8fef6f85-9248-4f45-a8f2-b876c1a9a5a7","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.627836Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:706719dd605c97521215b546a5c0718ba9e13ebaf643ed715735e53d737dc66b","observation_id":"ee7fef34-9400-438d-b218-134a9bf34e45","resolution":{"observed_at":"2026-08-06T16:56:27.930579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.635334Z","title":"Overcoming catastrophic forgetting in neural networks","venue":null,"work_id":"d96c8219-a44c-4e1c-b9f6-e56bbcd80f85","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.631796Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:093bf872c0d22d14a987402cb649546c63453c3ab35b2ad6766aaa075dea272c","observation_id":"a6fe436c-01cc-4d29-9308-3ea4bb61447d","resolution":{"observed_at":"2026-08-06T16:56:27.752349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.358298Z","title":null,"venue":null,"work_id":"227396e0-0921-4aae-a673-2670b79ff6d1","year":2012},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.635133Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:ce7ea71813a262753d9250f272877ac07cd14d65e35f8369e895da71e2835e9e","observation_id":"48c7779c-780a-4606-80b1-9b85a2aeab88","resolution":{"observed_at":"2026-08-06T16:56:27.484674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.060094Z","title":"Continual learning as computationally constrained reinforcement learning,","venue":null,"work_id":"5069636f-9138-44e6-a5dd-de4d14cd615f","year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.639198Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4182c28851125ea13e05dc04778d1408ee9e57093eeb66f5e7e73c69bc18f4d3","observation_id":"db085b21-2a5c-4f87-9168-714a28f61086","resolution":{"observed_at":"2026-08-06T16:56:27.212185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.768952Z","title":"Maintaining plasticity in continual learning via regenerative regularization","venue":null,"work_id":"431108e3-18c2-415d-9e71-e74831f1edf6","year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.647639Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:cecf1053e306c5f5c0c74dd4a25d94985123b49d3d4bb92a80a2ff596ee58aeb","observation_id":"819bd0a4-46c5-4350-af74-4e54a6d3fd83","resolution":{"observed_at":"2026-08-06T16:56:26.926652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.478418Z","title":"Asam: Adaptive sharpness- aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":"9492ea45-b5c3-452c-b977-2f94485d447b","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.651391Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:867d29cfef8fd7a81864110668ace2b885246e0ea35eca49777263a5cc05d530","observation_id":"63676b0b-fc29-4d39-8843-a0624f97ee0a","resolution":{"observed_at":"2026-08-06T16:56:26.601834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00246","last_updated":"2024-10-05T00:41:30Z","snapshot_observed_at":"2026-07-06T16:55:25.413169Z","submitted_at":"2023-11-30T23:24:45Z","title":"Directions of Curvature as an Explanation for Loss of Plasticity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00246","snapshot_observed_at":"2026-08-06T16:56:21.655160Z","title":"Directions of curvature as an explanation for loss of plasticity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.655160Z"},"links":{"cited_paper":"/paper/2312.00246","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:338473ce11beeb6cac2fb6e1d59028100d55cda75cff035a2612829651c81bb9","observation_id":"2aa990dd-260d-4548-ac0f-1101d963f5c6","resolution":{"observed_at":"2026-08-06T16:56:21.655160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.658641Z","title":"Visualizing the loss landscape of neural nets","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.658641Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:8deb97a38ea762f3ce9b2965a48b99e586ef89ca18e651402d96a8d5ea82e359","observation_id":"adc807cc-fcd1-4d0e-a0a9-53bb9be0348c","resolution":{"observed_at":"2026-08-06T16:56:21.658641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11704-016-6903-6","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.845406Z","title":"Lifelong machine learning: a paradigm for continuous learning","venue":null,"work_id":"a5ca7b9c-868b-4f3c-8e78-3cf3a4524d20","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.662211Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9a7db8aa2520748cf9312570d23b311f5b6e353b2e8f2959ca3d513efb9cde72","observation_id":"7fd628e2-70aa-47bf-9edf-94d1570dffcf","resolution":{"observed_at":"2026-08-06T16:56:21.855586Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.256895Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"4551fb9a-d176-48b8-97c7-c09a92a30535","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.665480Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:2dcbea5394fdf44201185ceb4d43b70c35fdbfeb7d6b7128cb0c9db420ca0425","observation_id":"913c656a-b05d-4b2f-91cf-253cc678ab29","resolution":{"observed_at":"2026-08-06T16:56:26.384343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.060587Z","title":"Understanding and preventing capacity loss in reinforcement learning","venue":null,"work_id":"065abd47-7b7f-4c37-ac96-b63e6b080d2d","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.669910Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:03ef5d7401c454ee961174a83cf37ecafab9c3a73a29672669a5d20385e6e377","observation_id":"17701754-01ef-4999-b64c-6710e8f1b639","resolution":{"observed_at":"2026-08-06T16:56:26.153675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-04T16:00:17.686427Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-06T16:56:21.673962Z","title":"Normalization and effective learning rates in reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.673962Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3843b037cd8ca03d34043182c1da66806d0c1778a98e8b02b622301a4e5306ac","observation_id":"630a4362-d18f-413f-b6a6-adf0362d1db5","resolution":{"observed_at":"2026-08-06T16:56:21.673962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.934177Z","title":"Deep learning via hessian-free optimization","venue":null,"work_id":"da1dce6f-2d2b-4445-9c5a-edfe7a00df7d","year":2010},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.678241Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:2b1d9ff278135bd7f5b399aa12c77d495919ba549aa9bced1fa5c20b7d235196","observation_id":"d6fa2383-3b1f-46e4-992d-8a1fb0ec6dd6","resolution":{"observed_at":"2026-08-06T16:56:25.989876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.759632Z","title":"Optimizing neural networks with kronecker-factored approximate curvature","venue":null,"work_id":"6ed1b0e1-d436-49a7-bff4-49016fd9c808","year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.682177Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:f04b9c278f7987f8667eeb459db6c8190346ebabec0332dc86950f20a6336969","observation_id":"5af0d7bc-5368-4437-852f-fb5568339785","resolution":{"observed_at":"2026-08-06T16:56:25.854507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.565491Z","title":"A logical calculus of ideas immanent in nervous activity","venue":null,"work_id":"2793facf-9059-4a95-b9a1-94f0175d7e36","year":1943},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.685963Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:7cc6f439fa33f8516373f08cec4b0853c0009c5564ea974a8a5219274e7cfc64","observation_id":"caf21fdf-cd44-4892-81fc-b19b2cc60d3c","resolution":{"observed_at":"2026-08-06T16:56:25.654686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.690306Z","title":"Minsky and S","venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.690306Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:adee0fbc7ba213b89000d9ff68e957b7e17e1ff02a3291e5b8ce7003a7de8bc6","observation_id":"82978154-a992-458c-a17e-dc9b852ae374","resolution":{"observed_at":"2026-08-06T16:56:21.690306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02292","last_updated":"2019-12-04T22:47:31Z","snapshot_observed_at":"2026-07-06T08:42:09.483153Z","submitted_at":"2019-12-04T22:47:31Z","title":"Deep Double Descent: Where Bigger Models and More Data Hurt","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02292","snapshot_observed_at":"2026-08-06T16:56:21.695553Z","title":"Deep double descent: Where bigger models and more data hurt","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.695553Z"},"links":{"cited_paper":"/paper/1912.02292","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9cb89985330cbe30eff8430d79501592cd495036453cad96b939ff62f1081978","observation_id":"970ae01c-cc50-475c-bf09-adef742c8997","resolution":{"observed_at":"2026-08-06T16:56:21.695553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06807","last_updated":"2015-11-21T01:11:29Z","snapshot_observed_at":"2026-07-06T04:37:18.887121Z","submitted_at":"2015-11-21T01:11:29Z","title":"Adding Gradient Noise Improves Learning for Very Deep Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06807","snapshot_observed_at":"2026-08-06T16:56:21.702106Z","title":"Le, Ilya Sutskever, Lukasz Kaiser, Karol Kurach, and James Martens","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.702106Z"},"links":{"cited_paper":"/paper/1511.06807","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4eb11adeb90bf6220eeaaf9b960d605f369212952fb521c2c0584cc3a0bd5577","observation_id":"cea9d834-c83b-450e-8b08-1d6be0821226","resolution":{"observed_at":"2026-08-06T16:56:21.702106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.358138Z","title":"Nerem, Samantha Chen, Sanjoy Dasgupta, and Yusu Wang","venue":null,"work_id":"c3f8c5db-5a2d-45eb-8649-7f632516bc3e","year":2025},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.706811Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:b57072a59084391d720e0d0a7f51bf8df492e40c6425fb084fe2c432d1c07c9d","observation_id":"01faa2ae-dc30-4a2b-87ba-cd6e7f7ea44f","resolution":{"observed_at":"2026-08-06T16:56:25.453270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.188371Z","title":"The role of over-parametrization in generalization of neural networks","venue":null,"work_id":"43b94e63-d27c-4044-a430-5c22fc445c24","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.711669Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:760ee35ebcbcd65dbbc3bee0cdb1fe01ff5a9db332f27017aba724265ea99944","observation_id":"e9fd9b8b-fbad-451d-9a91-2826cd7e9c6d","resolution":{"observed_at":"2026-08-06T16:56:25.287275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.987999Z","title":"The primacy bias in deep reinforcement learning","venue":null,"work_id":"95f088d5-c16c-435e-af7e-f6e904b5d372","year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.716896Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:906f28a239e0fbf0f81f2e676919721968b9ece81bdbf2a93c3c9eef0d503644","observation_id":"14ad059f-ef90-43f4-9999-33d25112112b","resolution":{"observed_at":"2026-08-06T16:56:25.084726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.789391Z","title":null,"venue":null,"work_id":"b3f8aeb0-8d2c-41d3-8416-8782fcc17d58","year":2006},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.720672Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:947f782c2ae00ec06d2fb98efe87517d0b9f1f4d0e40249d311564186b5f4f56","observation_id":"2af4951e-ab45-44ef-9173-c56ed9f9879d","resolution":{"observed_at":"2026-08-06T16:56:24.884761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.724002Z","title":"Parisi, Ronald Kemker, Jose L","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.724002Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:cab10a11dc60e0a96cac57555b9a155c69d95dc822414dab79bf2eb220b1f53c","observation_id":"8e907d35-ea9a-4bbd-9ef6-088c10674983","resolution":{"observed_at":"2026-08-06T16:56:21.724002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.588781Z","title":"On the difficulty of training recurrent neural networks","venue":null,"work_id":"66479e7a-ee3e-4888-9b0f-b01d1dc8156c","year":2013},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.729228Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9390cf64a99f0c5c346db9b8dca25eb2405859154c61853f1c6aa914cafce778","observation_id":"70c4ea2c-accf-4f09-a21d-989d6c64c7ec","resolution":{"observed_at":"2026-08-06T16:56:24.683654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.431728Z","title":"Attention is turing-complete","venue":null,"work_id":"8aa04025-3690-4e37-aed3-5ed5edf755c9","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.733132Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9e52d1f68b52e8510c917f7217baaeb1c1aa3fe3edb15a9cf5af51f2d3c901da","observation_id":"ba82417c-4173-43cb-94cc-50a52999137c","resolution":{"observed_at":"2026-08-06T16:56:24.486896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.736663Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards.Advances in Neural Information Processing Systems, 36:71095–71134, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.736663Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3da00ab518cf834d02d8efa91ddea1a39dcdd3adaf0d2d274c48a1e3831f809a","observation_id":"ccc01c0b-7d82-4986-9011-f4fb2b6bae0a","resolution":{"observed_at":"2026-08-06T16:56:21.736663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.223646Z","title":"Sparse feature learning for deep belief networks","venue":null,"work_id":"1255cfbe-0867-47f1-a679-1ede389250e0","year":2007},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.740365Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:13012e3292d3ce2d91e2cf86b2f59cb6dc8a9661b7a52987403a8b6fc710b0b3","observation_id":"41fefeee-fcff-4ced-afe2-5453345380fe","resolution":{"observed_at":"2026-08-06T16:56:24.314260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.053668Z","title":"Catastrophic forgetting, rehearsal and pseudorehearsal","venue":null,"work_id":"382065b4-976d-451f-8408-71bd6fb60192","year":1995},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.745316Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:c094414b5243fcc1fed3e19801c5540d031b2f7c05eadeb7551590b100e4aef1","observation_id":"2abcd8ad-7b84-4540-803b-2e23f22134c1","resolution":{"observed_at":"2026-08-06T16:56:24.150680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.749382Z","title":"Learning representations by back-propagating errors","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.749382Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:eac2586fb0d51a3781cb5f804d66820923dcd91bf0f078a426bbb7ffcaf3224c","observation_id":"d0787047-6e70-4db6-8cb5-1eb6f747225c","resolution":{"observed_at":"2026-08-06T16:56:21.749382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.00296","last_updated":"2021-10-06T13:22:57Z","snapshot_observed_at":"2026-08-05T08:54:18.350167Z","submitted_at":"2021-10-01T10:03:57Z","title":"Powerpropagation: A sparsity inducing weight reparameterisation","version":2},"cited_work":{"arxiv_id":"2110.00296","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.00296","snapshot_observed_at":"2026-08-06T16:56:22.355104Z","title":"Powerpropagation: A sparsity inducing weight reparameterisation","venue":"stat.ML","work_id":"7ebe5c2e-fc8c-43b2-acfd-25772f00fc18","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.753998Z"},"links":{"cited_paper":"/paper/2110.00296","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a0f868c22057595acf3a9da187c0923ae02ab18daf9fd6d0aa474fafe3f37e35","observation_id":"6d4b1a62-8a4b-4cd1-9609-d6012d52c572","resolution":{"observed_at":"2026-08-06T16:56:22.402190Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0385.13043","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:22.243190Z","title":"Siegelmann and Eduardo D","venue":null,"work_id":"30a28a70-2fe3-4bdd-a7d4-09191fad83ff","year":1992},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.758148Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4c7438cca981da4cdeb0380599f3182d2f06c461487c9cfe9b35880378baaad4","observation_id":"5d888c67-2052-4fc8-a5d2-9c29096aaf87","resolution":{"observed_at":"2026-08-06T16:56:22.315614Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.761700Z","title":"Mas- tering the game of go with deep neural networks and tree search","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.761700Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a77545aaff41fdfe92f1c0ae11d5b78d945accb2829730cd3a6c8703cfe2a5c4","observation_id":"60bd0630-9ce9-4918-898c-aa2c69d96970","resolution":{"observed_at":"2026-08-06T16:56:21.761700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14340","last_updated":"2020-11-25T17:31:09Z","snapshot_observed_at":"2026-08-03T17:30:34.578889Z","submitted_at":"2020-04-29T17:14:23Z","title":"WoodFisher: Efficient Second-Order Approximation for Neural Network Compression","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14340","snapshot_observed_at":"2026-08-06T16:56:21.765182Z","title":"Woodfisher: Efficient second-order approximation for neural network compression, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.765182Z"},"links":{"cited_paper":"/paper/2004.14340","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:6d44f75eec597f40a45a014f08067551f2cc2988337bce4231cc96248fb51946","observation_id":"41cc8397-c1ef-4b93-9646-216a1161b522","resolution":{"observed_at":"2026-08-06T16:56:21.765182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.871832Z","title":"Smith, Benoit Dherin, David G","venue":null,"work_id":"0a6b1670-3d3a-4b2a-ad1b-4838ec07ff60","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.768961Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:27bc92cbacf150ff27eec446471ce9aac65f46fc59d580a0e73dd8cac2238311","observation_id":"39c4365f-3c07-4803-b417-de3d7d4e2665","resolution":{"observed_at":"2026-08-06T16:56:23.935503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.677014Z","title":"The dormant neuron phenomenon in deep reinforcement learning","venue":null,"work_id":"59f68b04-a8f6-4627-8aad-35ae857ef059","year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.772384Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:447f43a241de49d70c80088384b60e4bcb04daf26190409201b18f956fa315d2","observation_id":"10454d02-8d6a-44cb-b5a3-6814fff80c8f","resolution":{"observed_at":"2026-08-06T16:56:23.767904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28545","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:22.020263Z","title":null,"venue":null,"work_id":"70f1e9dd-1800-497c-a0b3-c41890c391ca","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.776254Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:2f59f16bd1ad02c9cdff54a906be0b2f7e828cabb035c10a4f7b5197b738d93a","observation_id":"ad3d97d5-c93b-44aa-89c3-64d736760e38","resolution":{"observed_at":"2026-08-06T16:56:22.072229Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf00992697","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.824073Z","title":"Practical issues in temporal difference learning","venue":null,"work_id":"8c9f1b38-52cb-4410-b06c-569ec10632a8","year":1992},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.780085Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:7156027f1de248063658929f43941f275bd57604c82bce02019b0001ffce8853","observation_id":"de7735b9-1187-464c-bb52-f47bd1ca6156","resolution":{"observed_at":"2026-08-06T16:56:21.830160Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.567386Z","title":"softmax is not enough (for sharp out-of-distribution), 2024","venue":null,"work_id":"0d71ef98-0e7e-4041-8fa2-e2ae5180567f","year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.784093Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:92fb8bad57430d94354c9574abbeaee37f4c4c4cf4a732dc46f91ed751c30c67","observation_id":"2bdeb531-d658-48bc-84d6-22d574178a35","resolution":{"observed_at":"2026-08-06T16:56:23.620325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.422660Z","title":null,"venue":null,"work_id":"c95bacf3-469d-42f7-aba7-7eeaafd5436e","year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.787654Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:b69c40a7ff8eb266704d6a856f8cf7175ecc3811df3852838baf27824ae8dd20","observation_id":"68a370e2-71c8-466f-a177-0ae4efb0e478","resolution":{"observed_at":"2026-08-06T16:56:23.476911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.286416Z","title":"Lee, Edward Moroshko, Pedro Savarese, Itay Golan, Daniel Soudry, and Nathan Srebro","venue":null,"work_id":"a0f1d43b-5481-4bcf-80ba-173e9fadbe99","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.791861Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:371a8aa36ed84bb4f95701f06955e34fd01f809abf61bffe6f0b3d201740ade7","observation_id":"e2fdba17-1994-4f6a-8d86-50d22a5138f6","resolution":{"observed_at":"2026-08-06T16:56:23.367835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.187928Z","title":"Understanding deep learning requires rethinking generalization","venue":null,"work_id":"613ca959-55d7-48fd-a34e-65342e0f9d05","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.795284Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:375e72e50c7b38d977bf5a685be9a921ecd20dc617dafdd63d8854ea4cd9f281","observation_id":"9d010b2b-867e-4758-8081-bdf40138134c","resolution":{"observed_at":"2026-08-06T16:56:23.232897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.618591Z","title":"doi: 10.1162/neco.1997.9.1.1","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.618591Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:d482a6749ac9b7779b5d6236eb1641a3d28d6ad063847263e7e50703e32b9ff0","observation_id":"d7fdcfc5-ba3f-4363-82b7-80dd833a5ddb","resolution":{"observed_at":"2026-08-06T16:56:21.618591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04345","last_updated":"2025-06-26T16:08:44Z","snapshot_observed_at":"2026-07-06T15:51:58.017259Z","submitted_at":"2023-07-10T05:06:41Z","title":"Continual Learning as Computationally Constrained Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04345","snapshot_observed_at":"2026-08-06T16:56:21.643315Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.643315Z"},"links":{"cited_paper":"/paper/2307.04345","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:891a204e635e424fc585770b60e668efd68ec909b86f07f713b24fd16412736d","observation_id":"c080a08e-0bfc-46c1-a6fa-cf97e8b436c5","resolution":{"observed_at":"2026-08-06T16:56:21.643315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":34,"verified_exact":6,"verified_fuzzy":38},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 7 inbound Pith citation observations for arXiv:2507.12224."}