{"as_of":"2026-08-11T08:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:82b4b5d20841a70cc942882fad03e64602cdfd2ab82085051aec28095048ca06","coverage":[{"denominator":148,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T18:27:40.390908Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.18528/citation-record","integrity":"/paper/2605.18528/integrity","json":"/paper/2605.18528/citation-record.json","paper":"/paper/2605.18528"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:29:54.485236Z","title":"arXiv preprint arXiv:2512.16928 , year=","venue":null,"work_id":"06ab448a-e346-485e-8f8b-37394e6aacd4","year":2002},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:5cdba7611d7ad1a4857879c3913a3be111ac0322b9b8d2ded18be5d6e0eb8291","observation_id":"2c3b7f3a-0cd5-4f03-9ea0-655f9d6d1a85","resolution":{"observed_at":"2026-07-01T14:55:48.570702Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.05295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:35:37.653099Z","title":"Dion: Distributed Orthonormalized Updates","venue":null,"work_id":"4ecfbe15-0efd-41f4-a129-82f6a2164d2f","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1c5d88f74d4a6b6be70eb57dc564b7d5dc6e1c85457d121b96a42f7956f8566a","observation_id":"a069c6ae-718e-40b7-894f-1028e3752042","resolution":{"observed_at":"2026-07-01T14:55:48.580872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.290335Z","title":"Amsel, D","venue":null,"work_id":"fae97328-6936-4a8f-8e27-c6bf4f3cbec5","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:a0fef78393d2dc1e658c1ca10b2a17249978cf32a696c3535256fbe2c1dadecd","observation_id":"3243c3d6-09bc-4070-9041-003c584c8069","resolution":{"observed_at":"2026-07-08T04:24:33.294054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.060254Z","title":null,"venue":null,"work_id":"f7802227-143e-4669-9959-2abe57f5f7b0","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:21343ead161914e0dba5f116d9a00302e1225f44569f9eb3e7648d55e9cabc05","observation_id":"5fcc2d15-2785-41c7-ac07-42066d929cb9","resolution":{"observed_at":"2026-07-08T04:24:33.062226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.075773Z","title":"Arjevani, Y","venue":null,"work_id":"6cbf99b4-d5bc-4730-8c1c-3ae154b4bbcc","year":2023},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:a0468deada8aded38378683b83bb95f1630fb141063e362d8346a84b7ec91d03","observation_id":"a032ab8c-7f61-4f60-babc-daf0a17f551d","resolution":{"observed_at":"2026-07-08T04:24:33.078061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.157497Z","title":null,"venue":null,"work_id":"4a233534-726a-4fa3-bd8b-4be40119a475","year":2016},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:02b77825fa5e89b0cfc6647fd6f19ad3ed32c5f30b8858c2294418dd70fe399d","observation_id":"79305ed0-934b-4ede-a320-e03a224f181b","resolution":{"observed_at":"2026-07-08T04:24:33.159237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.159991Z","title":null,"venue":null,"work_id":"8438dc78-d4c7-4ed9-8e4f-57e02831d9bb","year":1997},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:d7d8dbaeb30e7f83cf3ffbe333c8ba13cca90576b7ac3230ae1b060c0ce026b1","observation_id":"d089c691-04a7-4b98-89d6-1cb574d8e64b","resolution":{"observed_at":"2026-07-08T04:24:33.161400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.150579Z","title":null,"venue":null,"work_id":"36d3fb9b-cc09-4882-90a6-2f94e558ac8d","year":1994},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:4d0666ac8c0ea42c4cfcca8a5f89712f4b5153d408aa3ba725ab74ae6d314bea","observation_id":"415f337c-fe85-4fc5-8d22-c8bceca7c488","resolution":{"observed_at":"2026-07-08T04:24:33.152048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.088609Z","title":"Balles and P","venue":null,"work_id":"cc5706ae-5d9b-4a39-84f2-59bdf94cfec8","year":2018},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:3b13a0399c45749f411ae9563796a59f8997edb9dc12d97f70152ab15bd7d294","observation_id":"10e1ea61-719b-495b-9b0e-67a59ad5d477","resolution":{"observed_at":"2026-07-08T04:24:33.090798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:446ddcf7f29aa27eb1b1a5c758b4102800ee154abf0721889f6863aa9916858a","observation_id":"5e05e66a-7048-42f7-a662-83c9e3331b07","resolution":{"observed_at":"2026-07-01T14:55:48.613270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.164475Z","title":"Bernstein and L","venue":null,"work_id":"444300c3-daa0-45b9-9cb6-c0b09db1c146","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:314f7208da6c4b6530d84342bb742227e34a7bd82d7b2106737490eb285b57eb","observation_id":"9cbf712f-b99e-4780-883d-2c59b60430eb","resolution":{"observed_at":"2026-07-08T04:24:33.165884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.168750Z","title":"Bernstein and L","venue":null,"work_id":"69b98137-5b39-4072-82c2-97053822bee5","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:2f8b0880aead158d311929dca843216a092d480fad7fcc870b4e95a137a1fdb6","observation_id":"528074d0-408e-46a5-9bb1-0babafaa1ce2","resolution":{"observed_at":"2026-07-08T04:24:33.170581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.229739Z","title":"Bernstein, Y-X","venue":null,"work_id":"b0928af0-0783-4e0d-9dc7-60d2a0c36e18","year":2018},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:3872418ff0d39a59b4b8189542b1d9af3fc78d3b5801b009306fdf2e2556d138","observation_id":"83e33d72-f18a-4164-be9c-dcfe7d7a7641","resolution":{"observed_at":"2026-07-08T04:24:33.231156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.285450Z","title":"Bernstein, J","venue":null,"work_id":"a03eadc5-9f37-4f97-ba0e-5e046c83d46b","year":2019},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:6a6dd76912e131d98b82fbd238ea5c9ca65c3309cde83e061e8a2d61532074e5","observation_id":"30e0d146-ce7a-41bf-b535-2071f8b33737","resolution":{"observed_at":"2026-07-08T04:24:33.287187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.220130Z","title":"Bubeck, N","venue":null,"work_id":"e56991d0-a548-49c1-b91f-76394917bb17","year":2013},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:5a95e2b9db456f4badd4bcebbffe85143f53aef5aa38a132e2cc605f49391f29","observation_id":"43149b26-7bed-405d-89c0-f6f37d85a480","resolution":{"observed_at":"2026-07-08T04:24:33.221264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.178227Z","title":null,"venue":null,"work_id":"debc6509-2198-47b0-8c09-b6583b24b5b8","year":2015},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:2ac2a9945953627a646e41ddef4b7d5ab9efde6b16ef8ae559bc06dc291bc1df","observation_id":"8f7135ed-70a2-4a93-bf2a-708dc0b5ea4b","resolution":{"observed_at":"2026-07-08T04:24:33.180148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.099233Z","title":null,"venue":null,"work_id":"1c323e1b-5194-4fb4-ae97-cae8a11b09a4","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:109f5b6af43659fb1855727fc7319b9352677a4df3b59b4b077bb44c0b716273","observation_id":"cd7f9476-62d7-429a-a422-bdd60488cb09","resolution":{"observed_at":"2026-07-08T04:24:33.101449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.140773Z","title":null,"venue":null,"work_id":"bd1684b3-b343-4087-936d-9cedf9aa2e86","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:49d20958d33be1c619e9660be89d831fc946eb35adb85c7cd0f9bcec67aa929e","observation_id":"8aab3f67-aa38-4c28-a64b-e364081a10a2","resolution":{"observed_at":"2026-07-08T04:24:33.142773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.243287Z","title":null,"venue":null,"work_id":"78291504-283b-4931-a928-5ac279a223d9","year":2023},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:a9678aa16e20ae155aafa34bdfa5a50b12076719d23203161169488c2bc44e68","observation_id":"a0a77fb9-04ec-40c7-b440-52a164731d23","resolution":{"observed_at":"2026-07-08T04:24:33.244658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.233588Z","title":"Chezhegov, K","venue":null,"work_id":"56bbfa75-e2e8-4ba8-8326-de925530e8aa","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:aff8f54744863b3d44e77ca9e9699252dd72305aa52431e4eb3be2a173e9c4d3","observation_id":"5241daed-5214-40dc-9d85-2d095c9b587b","resolution":{"observed_at":"2026-07-08T04:24:33.234778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.106248Z","title":null,"venue":null,"work_id":"2c9e5cde-ed23-47f4-9ab2-35d86a38137f","year":2014},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:c2f8405112774a445ac8ea13bc804b4258d6be866c134fd6327455954c696051","observation_id":"fe569f54-c03c-41f2-a0b4-ddfa585f7333","resolution":{"observed_at":"2026-07-08T04:24:33.108610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06884","last_updated":"2026-05-07T19:32:39Z","snapshot_observed_at":"2026-07-06T23:19:20.674889Z","submitted_at":"2026-05-07T19:32:39Z","title":"Muon with Nesterov Momentum: Heavy-Tailed Noise and (Randomized) Inexact Polar Decomposition","version":1},"cited_work":{"arxiv_id":"2605.06884","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.06884","snapshot_observed_at":"2026-07-04T07:29:38.601087Z","title":"Muon with Nesterov Momentum: Heavy-Tailed Noise and (Randomized) Inexact Polar Decomposition","venue":"math.OC","work_id":"da446b34-8b23-4df3-9000-439bdc6a5ef3","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2605.06884","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:c664681d3b5b172873329fc2773dca871b2727b85f9cf6d121e25d63b6622d7d","observation_id":"f8b536ee-2872-4e15-b568-1e87865e9ef7","resolution":{"observed_at":"2026-07-01T14:55:48.601512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.145839Z","title":"Cutkosky and H","venue":null,"work_id":"82bdc096-2827-4b00-8116-5ac15581792c","year":2020},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:8c5ba737a6e361c35f5c324ab5c5d4af85928daa3a0476d7a7b751ea1cee6770","observation_id":"ea2a82c2-b010-4824-aa47-2a20da5ed544","resolution":{"observed_at":"2026-07-08T04:24:33.147349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.249141Z","title":"Cutkosky and H","venue":null,"work_id":"60774b93-c974-4d5a-8f75-4696ff91309b","year":2021},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:d431ad678d3d3da51b9b96b6c012596b12ec54c2cc3fb3493123aea44c24cda5","observation_id":"985fccad-a970-4938-b504-d31826e01d93","resolution":{"observed_at":"2026-07-08T04:24:33.250308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.221845Z","title":"D'Angelo, M","venue":null,"work_id":"8ac2ae76-6581-4c44-ac24-54bbeb9465b8","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:813e44d36a3a7da838bbcde38a2d4fc1736a1eb55cb01acbc565d213e30c87e5","observation_id":"1d1c7ef1-bfb7-4495-ba29-15c046ffce0d","resolution":{"observed_at":"2026-07-08T04:24:33.222967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.278104Z","title":null,"venue":null,"work_id":"bd3dd6ea-99bd-45e1-b8e0-7f3b0e91d0ed","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:b354f11bad68d8f99d0063858a19d6d59abed4d1d23c4dd2193cc434aaef6d0a","observation_id":"96042cf4-a9ec-465d-8c63-7552bbe78880","resolution":{"observed_at":"2026-07-08T04:24:33.282539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04299","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T11:56:56.094916Z","title":"When do spectral gradient updates help in deep learning?arXiv preprint arXiv:2512.04299","venue":null,"work_id":"2b29279f-97b1-446c-a164-5217d6d534c3","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:ed7e42710eb4538e206831f297659b607f2978833ecb6f0489d042a04967f233","observation_id":"ae69909b-3193-4439-90a5-225649408a93","resolution":{"observed_at":"2026-07-01T14:55:48.645209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.166619Z","title":"Defazio, X","venue":null,"work_id":"79d800c6-6d76-451c-a61a-317e365656b6","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:70c6df6c225c79ddce7acaba7acba90d8efd0f47c10e7ce4d0b6bcd0b4b5215a","observation_id":"cc677852-a68f-4e08-af1c-b2fe9e15d57b","resolution":{"observed_at":"2026-07-08T04:24:33.167993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.155228Z","title":null,"venue":null,"work_id":"57f773c4-40a5-4594-9656-7f51dcb2b805","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:4be245d342da8de1ca007394d358fffb998684f016872a078b073e7109e88dcd","observation_id":"d87daf04-9a71-41c7-b46f-3775315523ef","resolution":{"observed_at":"2026-07-08T04:24:33.156691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13161","last_updated":"2025-11-30T07:03:40Z","snapshot_observed_at":"2026-08-08T11:46:20.080583Z","submitted_at":"2025-04-17T17:58:13Z","title":"Nemotron-CLIMB: CLustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":"2504.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.13161","snapshot_observed_at":"2026-07-09T02:55:53.506375Z","title":"Nemotron-climb: Clustering-based iterative data mixture bootstrap- ping for language model pre-training","venue":"cs.CL","work_id":"412269c2-ec20-4706-8440-3bb6773c3fc0","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2504.13161","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:8cc1ca93fc1ebd39d92c337035161db61f517cb9261b99738dfdb8a7a10bcea1","observation_id":"32de5bfe-6801-4cff-8fe6-9855b5097a18","resolution":{"observed_at":"2026-07-01T14:55:48.649402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.148168Z","title":null,"venue":null,"work_id":"7eff4cc2-6217-4311-9965-e95eea26e64c","year":2016},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:dfa449ff8ab4477f46c4b95da1a15c4de7d9e5898c7c36be8e0406d0a2757326","observation_id":"99487f41-1434-4195-a7f3-a6a67cb5ba46","resolution":{"observed_at":"2026-07-08T04:24:33.149795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.213647Z","title":"Dragutinovi \\'c and R","venue":null,"work_id":"38fdeaa4-a82e-4dc1-b853-87dc75ddd70c","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:e66bbc4fc193270cd19aa238662d9677269fcc051c8780f3b77b8b403e1e8da6","observation_id":"49dd3ea7-2b83-4243-9d76-66c0c2782522","resolution":{"observed_at":"2026-07-08T04:24:33.214947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.01472","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:39:55.258294Z","title":"Du and W","venue":null,"work_id":"ef25ad07-851b-4ed1-b640-baa0802a2892","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:09b701f80bea7809b7541ec9108bfc343a8937e69d58045dc6ee76a69d66d951","observation_id":"bc2f25e1-1f68-469d-8994-261112784dfd","resolution":{"observed_at":"2026-07-01T14:55:48.689012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.218219Z","title":"Duchi, E","venue":null,"work_id":"3bc3e24f-9430-41b1-9c10-2d4d02b2b707","year":2011},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1195661d38811c21906c1571d1b50f535ae9b6934e2321d4792c0a198302c1af","observation_id":"e63645ad-0333-442f-a521-951b5802eb57","resolution":{"observed_at":"2026-07-08T04:24:33.219501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.246970Z","title":null,"venue":null,"work_id":"756fad69-6669-43aa-8f1d-baeb361cb30f","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:7cb55c6143e24c18c007113724b20eb293febf9b55d02a1ce66aafc115ef24bc","observation_id":"13ddb3d1-db03-4875-8ef8-a601927adf37","resolution":{"observed_at":"2026-07-08T04:24:33.248459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.190173Z","title":null,"venue":null,"work_id":"8e7c9116-7e4e-49a7-81dd-788cf36a06a9","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:f39dada617be0eed3210324d0933bf753f684628d6f43e42f5f5855fd2af35df","observation_id":"344d18c5-2621-4b69-8761-816fbaefa942","resolution":{"observed_at":"2026-07-08T04:24:33.192620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.194140Z","title":"Ghadimi and G","venue":null,"work_id":"53d7d1c4-1331-42b3-b5be-dc0dd0590614","year":2013},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:cde406d21f3a3da4811891cc3419faebc8cf79f0da2b4c8e06e30354c9c93957","observation_id":"e0fe70fc-c40d-42d0-adb5-9cbee2800550","resolution":{"observed_at":"2026-07-08T04:24:33.195937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.239435Z","title":"Glorot and Y","venue":null,"work_id":"cf917767-52fa-42ca-9593-148efac16ed7","year":2010},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:407f2412ec82f3f10d443e23b9ca4dda9d05d4d84d5b9fa060c8f19fe85d0e7f","observation_id":"20d4c39e-b69e-4ce7-942a-cb0d32500948","resolution":{"observed_at":"2026-07-08T04:24:33.240704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.124146Z","title":"Goldfarb, Y","venue":null,"work_id":"6c569fac-c1bb-4d9b-996c-4e58bd8937e6","year":2020},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:e5c4bbb6c8169227a245cb495e12bd100a0186cf902291f584108686d3f581ed","observation_id":"94a89203-bab6-47e8-8c97-668d44ffb2d6","resolution":{"observed_at":"2026-07-08T04:24:33.126336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:55:48.667408Z","title":"Aaron Grattafiori, Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, Abhishek Kadian, Ahmad Al-Dahle, Aiesha Letman, Akhil Mathur, Alan Schelten, Alex Vaughan, et al","venue":null,"work_id":"0b1b41e4-a2fe-43e0-a97d-1b3ba9fbf25c","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:3fa16a059afda0feaf030bea4e6559074e05bdba39609ef597829433a1b74f01","observation_id":"0ec55bbe-6eae-4873-9ebe-e746c7e33e4a","resolution":{"observed_at":"2026-07-01T14:55:48.669061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.11948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:38:41.003760Z","title":"Gonon, A.-A","venue":null,"work_id":"42c852f2-1f12-4ef7-8341-ad78caae2327","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:d1e381004f596892cfe82d7839c24c1c8c59f6963acf75f34df94257026982ab","observation_id":"f85b10ef-83d2-428f-b9b9-0dbbafd526e9","resolution":{"observed_at":"2026-07-01T14:55:48.672491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.211667Z","title":"Gorbunov, A","venue":null,"work_id":"8fe54734-20e9-4b0a-bb07-9c1837b6b5a1","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:07f7f616264d1365b4daf93742f4923a8df047a6bbb563207cbec57acd124ded","observation_id":"942d05cf-9cb6-40e2-9581-7a915ac0b6e2","resolution":{"observed_at":"2026-07-08T04:24:33.212972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.16340","last_updated":"2026-05-24T10:50:02Z","snapshot_observed_at":"2026-08-02T22:39:16.253630Z","submitted_at":"2026-02-18T10:25:07Z","title":"The Implicit Bias of Adam and Muon on Smooth Homogeneous Neural Networks","version":3},"cited_work":{"arxiv_id":"2602.16340","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.16340","snapshot_observed_at":"2026-07-01T14:55:48.673815Z","title":"arXiv preprint arXiv:2602.16340 , year=","venue":"cs.LG","work_id":"e7deb41e-c322-4327-ba0e-c76b274793ef","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2602.16340","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:0115d864ff674abbb25ced95b4546e4728feb604e05daaa3441d9facb13a2351","observation_id":"fa561397-e2e2-47eb-b74b-4f58c9c90535","resolution":{"observed_at":"2026-07-01T14:55:48.675184Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.176047Z","title":"Grosse and J","venue":null,"work_id":"20a9a9d4-5405-4c6c-bd20-faadf5af93ff","year":2016},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:b6085988c0e3b5a7018c9e8d881605db6a3d42c8c0975d5f5ad9db9e4e2ea850","observation_id":"21863c30-0798-485f-9893-2d7efb25a6d4","resolution":{"observed_at":"2026-07-08T04:24:33.177488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.23000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:30:07.822162Z","title":"Gu and Z","venue":null,"work_id":"63c619b0-e2c2-4a9c-9dfe-0e4b03073c40","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:34ccf91d4b781e884e4d84557bafac257a3a4af1b9371bf68615f969a970ad3d","observation_id":"b542172d-d147-44ea-8dac-d5e65c8008a0","resolution":{"observed_at":"2026-07-01T14:55:48.683365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.171351Z","title":"Gupta, T","venue":null,"work_id":"110a4b05-99e3-4dc6-8117-8601b5df0b0e","year":2018},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:9244fa2ff10b599e0c90323281c9e0900621b9d544f0ac693744ff4aaa31b353","observation_id":"3aac95e2-c337-49f0-b684-33bc9d575fa0","resolution":{"observed_at":"2026-07-08T04:24:33.172792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.173609Z","title":"Gurbuzbalaban, U","venue":null,"work_id":"97f9f91d-fb2e-488f-8077-a3bcd3690f43","year":2021},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:56adf5c870c7b5a73709b78458264d4e32654a39ecba02ed4525de861dab108c","observation_id":"97738d80-caf6-4da9-badd-88cf9351201b","resolution":{"observed_at":"2026-07-08T04:24:33.175258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.11983","last_updated":"2026-04-19T16:56:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-15T14:28:53Z","title":"Low-rank Orthogonalization for Large-scale Matrix Optimization with Applications to Foundation Model Training","version":2},"cited_work":{"arxiv_id":"2509.11983","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.11983","snapshot_observed_at":"2026-07-04T07:29:38.557965Z","title":"Low-rank Orthogonalization for Large-scale Matrix Optimization with Applications to Foundation Model Training","venue":"cs.LG","work_id":"837753d0-a1f6-45b8-92f2-d83dfcc7f9ed","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2509.11983","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:9f3dbda996de0d06962b4952d86b110a8104975b2d5449e61ceac4ae7fa4b246","observation_id":"f0146bed-666f-4e53-b58f-95521c7d8309","resolution":{"observed_at":"2026-07-01T14:55:48.680826Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.198977Z","title":null,"venue":null,"work_id":"c6228541-d684-4075-a25c-54a5e7dae9c9","year":2016},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:f17606b6e6f6f679f3270f1ae0a79aeb7a6b396a776bc1b9e8a3ea89d14f2eb4","observation_id":"09da8aeb-8f5c-4423-a0d2-2b88ed5e7065","resolution":{"observed_at":"2026-07-08T04:24:33.200381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.196787Z","title":"Henry, P","venue":null,"work_id":"1388d9e8-1453-4c79-afa8-d4da81ec4942","year":2020},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:23f0de3579eacb8fc796563d8968107797ea9a2208b417c4e543165a35e87807","observation_id":"d80baeff-a564-4cab-b5b9-06f64b0c9901","resolution":{"observed_at":"2026-07-08T04:24:33.198236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.225188Z","title":null,"venue":null,"work_id":"7f47226c-9df9-4bea-9d39-87595cb51f26","year":2006},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:d04a2233dcc54d374d8034c81ebd7ce34053dc4ab56802945d7ecac82948b275","observation_id":"c5200ee9-ad93-44f9-a10f-7d23976c3feb","resolution":{"observed_at":"2026-07-08T04:24:33.227059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.300239Z","title":"Hochreiter and J","venue":null,"work_id":"7c9a229f-61cd-4838-8407-4a9c3d59f1f6","year":1997},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:118cfda15a51ccd9be52d1c68ce9b71d7060a7eef33aebcc1ee78198addd3ef7","observation_id":"235bd6f8-2926-498f-ad40-0b0d0c4da1ed","resolution":{"observed_at":"2026-07-08T04:24:33.302403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.091978Z","title":"Hsu and S","venue":null,"work_id":"6273b3bb-4ee1-4688-92e5-86c680b2e2cb","year":2014},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:ef29673b19cc81a74b5f7cab22b2fd0b0cadece9ee111cd5ff3b592981f46302","observation_id":"45628ea2-593d-4c1d-9942-751f1fb0a7b7","resolution":{"observed_at":"2026-07-08T04:24:33.094375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.14562","last_updated":"2026-07-24T13:07:17Z","snapshot_observed_at":"2026-08-04T16:17:41.111108Z","submitted_at":"2025-09-18T02:49:27Z","title":"LiMuon: Light and Fast Muon Optimizer for Large Models","version":5},"cited_work":{"arxiv_id":"2509.14562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.14562","snapshot_observed_at":"2026-07-04T07:29:38.590843Z","title":"Huang, Y","venue":"cs.LG","work_id":"8d242626-c2ae-4a0d-b443-bbb01cc766ed","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2509.14562","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:beca6f9ea7622a29a4292e8014df0181c07eea43d7b95b6287e2950b393a0461","observation_id":"7f9c81ae-da99-4528-882d-b6161cea12a6","resolution":{"observed_at":"2026-07-01T14:55:48.662853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.137544Z","title":"H \\\"u bler, I","venue":null,"work_id":"0de44dac-2f8e-4823-9b95-8fdeda1812dc","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:5ef63ece24f1f4e20cbb600d8a6983985e7f663aa86b92dbf1c0444517dcc7d3","observation_id":"5f3ad602-6316-4233-8316-2e77ee096b79","resolution":{"observed_at":"2026-07-08T04:24:33.139657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.272983Z","title":"Ioffe and C","venue":null,"work_id":"1d15058f-36ac-4240-bf52-010707d7e579","year":2015},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:a87f7961abe4e6690a4079c5099538d2fe1761f1a394e626139d1014fa317129","observation_id":"69dad6a9-98b1-4d6a-8c84-0e8a7f944128","resolution":{"observed_at":"2026-07-08T04:24:33.274896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.283360Z","title":null,"venue":null,"work_id":"7eda626f-1c0a-4d88-90f6-67e75608aad3","year":1991},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:d81c7c0494b3758a8305466b885ca2d169b96b4b2206715c4ba1b1cb23f2e3c3","observation_id":"157d2085-701d-464c-bc21-cd64bc8210d9","resolution":{"observed_at":"2026-07-08T04:24:33.284766Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.266937Z","title":"Jiang, D","venue":null,"work_id":"2a57422c-982f-4c5a-bf1c-1e979696470c","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:31471df0f3ae90cfde67837f404dff71fbe1b548d28ec8ecbcd1c6edd15dc2ce","observation_id":"8cf21659-189a-4f0c-9c8d-da47237a156e","resolution":{"observed_at":"2026-07-08T04:24:33.268038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00498","last_updated":"2024-04-05T00:09:00Z","snapshot_observed_at":"2026-08-11T03:52:38.673670Z","submitted_at":"2024-03-30T23:42:23Z","title":"94% on CIFAR-10 in 3.29 Seconds on a Single GPU","version":2},"cited_work":{"arxiv_id":"2404.00498","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.00498","snapshot_observed_at":"2026-07-01T14:55:48.645423Z","title":"ArXiv Preprint: 2404.00498 , Year =","venue":null,"work_id":"90b09ba6-82c9-45e8-8eff-885bfe7cf39a","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2404.00498","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:15c7c89d988c58abc58638f5203feb874a33ad1e830d9d9a946dd532f6fd03d2","observation_id":"cf45b86a-7681-46cd-a8b5-f30557cc1deb","resolution":{"observed_at":"2026-07-01T14:55:48.648154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.256157Z","title":"Jordan, Y","venue":null,"work_id":"d7d98a75-fc35-4214-b17a-c049f0f493d1","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:6166c6de52fd3e7a4ff1f3be99851754ccdd498c9b5156131b15be390538b588","observation_id":"c9ca10ba-960f-4841-8490-58cb9dea0dbd","resolution":{"observed_at":"2026-07-08T04:24:33.257367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.215728Z","title":null,"venue":null,"work_id":"49c59ee6-ac22-49e9-876b-ef7861700a6d","year":2019},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:8cf8e175b5ed585ea3f9fbd4a40c3fb2cdaed581487874043133356a2433235c","observation_id":"33cc99c1-e344-41c1-ae87-ba165ee86d21","resolution":{"observed_at":"2026-07-08T04:24:33.217488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.268647Z","title":null,"venue":null,"work_id":"554ec518-66da-4b3d-a62b-3b6d1bf5f18b","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:50d86bdb38f3a447cdfaea9766fffd04bb77c3ed2f08259855dacc214f9a2fb3","observation_id":"3493effe-29ab-4a11-9d06-86e3618592c4","resolution":{"observed_at":"2026-07-08T04:24:33.269774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.241376Z","title":null,"venue":null,"work_id":"6488a19d-e38b-4db6-96b3-c1c0c9d0dde7","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:fc37a254542d59f0a6190abf3793a4fd7c15f143edae2e4c2accb4f028bcf31e","observation_id":"fc609079-d638-4e47-9c86-5ff7a0350027","resolution":{"observed_at":"2026-07-08T04:24:33.242595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.254411Z","title":null,"venue":null,"work_id":"17909fde-f232-4de1-8004-9d174bdd1059","year":2015},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:ad21030b207cb03d4c138decf4dc58daa2a717b0cb994623fa079c95b8bc5186","observation_id":"1ed47fd0-f1a6-4444-9a2a-c646d0de3d85","resolution":{"observed_at":"2026-07-08T04:24:33.255540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12645","last_updated":"2025-04-08T16:47:42Z","snapshot_observed_at":"2026-08-09T21:31:17.577486Z","submitted_at":"2025-03-16T20:49:34Z","title":"Understanding Gradient Orthogonalization for Deep Learning via Non-Euclidean Trust-Region Optimization","version":2},"cited_work":{"arxiv_id":"2503.12645","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12645","snapshot_observed_at":"2026-07-04T07:29:38.574824Z","title":"arXiv preprint arXiv:2503.12645 , year=","venue":null,"work_id":"fe62cb1b-f9dc-4379-8586-5c2f591ba7e5","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2503.12645","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:a7380618504c42da3f5294f280e540b03457b2fe0e63153265f8dc00b03d939b","observation_id":"a48fa612-1c17-4b82-9c88-de12dc58630e","resolution":{"observed_at":"2026-07-01T14:55:48.633794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.275915Z","title":"Krizhevsky","venue":null,"work_id":"0a2d8748-9137-4305-ad52-fd4331b64f22","year":2009},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1a7bebe1304df40decc3b8c490dea6b055fd8967b8a9d1f5dab8cb7b4db3b951","observation_id":"01c2bf41-e1ee-46c1-a508-3a1d1876df5a","resolution":{"observed_at":"2026-07-08T04:24:33.277446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.257952Z","title":"Krizhevsky, I","venue":null,"work_id":"bc17a5ef-ff37-48bf-a1f8-88d89c2fe075","year":2012},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:b23717f7a54fc5d683d7198d2a342756e5365041f4bdce66e8ddefb07fd4fdec","observation_id":"260146a6-958a-4f39-b77c-45b468bf64a5","resolution":{"observed_at":"2026-07-08T04:24:33.259070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.130746Z","title":"Kunstner and F","venue":null,"work_id":"7e3bb586-a607-481e-85ae-84235753458a","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1adfe86360c1213c467e719e5eb8f0bfeefd4d992cc351427c4d1b744c7f2718","observation_id":"039e0d93-a2b5-4ffb-9a16-f829eb02c7b6","resolution":{"observed_at":"2026-07-08T04:24:33.132909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.121595Z","title":"Kunstner, J","venue":null,"work_id":"fdc791cc-8cab-48e5-a46f-48486ba6e1d5","year":2023},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:e0b5c30ee77820737bbf7571beedd30123b9ae03517ef52bb03e0369e47c045f","observation_id":"b0b9a0f5-2607-42fb-abc9-906bd50fc6c0","resolution":{"observed_at":"2026-07-08T04:24:33.123023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.152759Z","title":"Kunstner, A","venue":null,"work_id":"968ae8ba-fe83-4228-9af1-a5b680e90ea8","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1ec28246be6eff11d1d2551cbb914b841f0e53ea115e0c027c98b59cd46fd48b","observation_id":"1976cbdc-e332-4bbe-9abf-4a83c381bb91","resolution":{"observed_at":"2026-07-08T04:24:33.154406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.162190Z","title":"Large, Y","venue":null,"work_id":"d26f0700-14fe-4b53-964e-bcd11c70d361","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:cf5e47dbf85beb8d36ed0aed9fb2eae672f1aa1d4e3733ed12cadd069d4c0ff0","observation_id":"12227eaa-8651-4ab6-9503-f8743f51ba0f","resolution":{"observed_at":"2026-07-08T04:24:33.163666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.21799","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:29:54.472214Z","title":"ArXiv Preprint: 2505.21799 , Year =","venue":null,"work_id":"697efaae-b1b5-453e-87eb-aa0d1c995386","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:e70d0a57a4bb2e7dbc01ceb2bc80b54fde895f3910a610a7625594dfbc79825f","observation_id":"89185c06-a796-4ffc-a379-25af06a63ed1","resolution":{"observed_at":"2026-07-01T14:55:48.641062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.203154Z","title":"LeCun, L","venue":null,"work_id":"38515ceb-51e2-4345-ba2b-afabdb9dec71","year":1998},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:f500e5fb782faef235a143d86c44b156991b973b1a1df9e24dba51b17725dd61","observation_id":"03cae06d-c947-4e34-b8f1-00fa2f99bd6d","resolution":{"observed_at":"2026-07-08T04:24:33.204526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.183745Z","title":null,"venue":null,"work_id":"2c35d977-6715-44dc-afa8-e17527322838","year":2023},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:4600e5410f90d3be30e2a77a94a02a89986aa7cdedfe92e52c3ef6fe43af2a4e","observation_id":"ae13a8cf-1f91-4bac-8693-738816bd74d3","resolution":{"observed_at":"2026-07-08T04:24:33.185595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.227755Z","title":null,"venue":null,"work_id":"6bce8046-4171-409a-bbe5-3e0a3a3029a4","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:94d69e5397455913c0f5ce34269ca993383b8b04a441847d53249e99ce6b871e","observation_id":"e1a2d1f0-eb99-4a69-9a6d-72a8cc4e0348","resolution":{"observed_at":"2026-07-08T04:24:33.229031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02900","last_updated":"2025-06-01T18:46:31Z","snapshot_observed_at":"2026-08-09T10:38:54.874245Z","submitted_at":"2025-02-05T05:44:22Z","title":"A Note on the Convergence of Muon","version":2},"cited_work":{"arxiv_id":"2502.02900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02900","snapshot_observed_at":"2026-07-01T14:55:48.649763Z","title":"Li and M","venue":null,"work_id":"be3f1424-323d-44e4-9ebc-c38289176866","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2502.02900","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:51d3ebc537efa8ba93300f6b504900d7970743cecc9748b2b15a7d0bd94bcf2e","observation_id":"61eacf10-5fab-4f83-8737-4d8d37798a98","resolution":{"observed_at":"2026-07-01T14:55:48.651364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.201083Z","title":null,"venue":null,"work_id":"9a782b59-6327-44b8-8988-2047a1373fec","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1a1d08fb82143face41c762a075d2601068f64b45285e8fad52ed74e3379bb72","observation_id":"6b31444a-bf34-4a03-88f7-5d5884e7c255","resolution":{"observed_at":"2026-07-08T04:24:33.202456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09238","last_updated":"2026-05-10T00:39:13Z","snapshot_observed_at":"2026-08-02T15:17:04.657553Z","submitted_at":"2026-05-10T00:39:13Z","title":"Intrinsic Muon: Spectral Optimization on Riemannian Matrix Manifolds","version":1},"cited_work":{"arxiv_id":"2605.09238","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.09238","snapshot_observed_at":"2026-07-01T14:55:48.653263Z","title":"Intrinsic Muon: Spectral Optimization on Riemannian Matrix Manifolds","venue":"cs.LG","work_id":"5a7d5f20-1bc0-41f1-966d-b7a6f9ef8d86","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2605.09238","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:9c2dc9fac73cd90340fe845cb6534b53489885696c949be622f6750056d78e30","observation_id":"368ba23b-c153-4ad2-b1ea-0889a737a3ed","resolution":{"observed_at":"2026-07-01T14:55:48.655002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.05491","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:35:37.637132Z","title":"Normuon: Making muon more efficient and scalable.arXiv preprint arXiv:2510.05491","venue":null,"work_id":"205004c8-7e64-4233-a0e6-c6782d1c2793","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:2b32a4a18dbadc8b2eb90550c68daa361499ed91fad9a39d41e862f44af02cc9","observation_id":"f42306e0-94d3-4326-9de2-9833f3ff5688","resolution":{"observed_at":"2026-07-01T14:55:48.622519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":"2502.16982","doi":"10.48550/arxiv.2502.16982","metadata_source":"pith","pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Muon is Scalable for LLM Training","venue":"cs.LG","work_id":"a818f37a-b985-49e6-879d-603a00525f65","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:14addc04a78bd3dd82eca7bd117434f7e1f8104b4432024786bc6ad5774a6d6f","observation_id":"40c85e73-8832-41fb-883f-bd2ddc3c322f","resolution":{"observed_at":"2026-07-01T14:55:48.630939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.209616Z","title":null,"venue":null,"work_id":"f1b1ee9b-6d83-4512-b712-c5d321442e72","year":2024},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:8fe1b0c812f981ae01133aba48dba9d39e177a90c048f6acb0c0a2129eadfed5","observation_id":"44a88f49-535b-4d72-82f9-01a1ad67b13f","resolution":{"observed_at":"2026-07-08T04:24:33.210957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.127459Z","title":null,"venue":null,"work_id":"b315623a-686c-4759-a3e6-3461e3d0a6b1","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:46618fc0bdad55280cf0f36c3bcb07716acc592355998d164ae7d7b7dba458aa","observation_id":"46dc839a-8372-4847-9cb9-03e062e00258","resolution":{"observed_at":"2026-07-08T04:24:33.129551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.07473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:55:48.600804Z","title":"ArXiv Preprint: 2508.07473 , Year =","venue":null,"work_id":"3e397e02-cddc-46b5-8efe-b7c0fc362e8b","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:b85707e27c286eb7fffabef9748f7e9b2b304c8248deed18df52d915b65a7092","observation_id":"15b68725-e887-476c-a000-d19347a9df8d","resolution":{"observed_at":"2026-07-01T14:55:48.602369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.102980Z","title":"Liu and Z","venue":null,"work_id":"c7dc4d63-d8c3-4f4e-975f-70389c2ef268","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:b6f1617e3de71c5b01094b43ac244138fce9d324452ff94200886a7f698fbe2a","observation_id":"812cfa34-c3a1-4535-8a44-3d016e42234a","resolution":{"observed_at":"2026-07-08T04:24:33.105194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.095642Z","title":null,"venue":null,"work_id":"ca4d0431-33a5-479b-991e-5908ebaa5119","year":2023},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:eeec9f4248b6cdaa87685ac81ed676d13d814e44af364ec9208d482ac1d306dc","observation_id":"861ee0d1-1365-45b6-a1e8-c9bfc675211b","resolution":{"observed_at":"2026-07-08T04:24:33.098017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.039732Z","title":"Loshchilov and F","venue":null,"work_id":"b0ffa96a-4277-4e4f-bc57-3ce126a940cb","year":2019},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:70f21ee3475c0a91a55ec8a4d12e5961e04a18a6e3f4f1bc60f7eda8794b2002","observation_id":"4d170533-06b0-496b-81a1-16c4ef97e228","resolution":{"observed_at":"2026-07-08T04:24:33.041774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.166830Z","title":"Charles H Martin and Christopher Hinrichs","venue":null,"work_id":"c78cf2a1-55f8-45ba-8922-f30f990616be","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:dca90d89aafc170e4fa87a3023906db5823fdd31e3f1902e1e1a3d672ffc9569","observation_id":"6f78b53d-165b-4f23-bacd-4d50a5d12aef","resolution":{"observed_at":"2026-07-01T14:55:48.657372Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.025418Z","title":"Martens and R","venue":null,"work_id":"e2922172-0057-4146-909f-011c3a82b532","year":2015},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:b2fdb9d608b54e9bb53b2790d38c25b6ddd4f35ca8a163ad793ac3ecc755c6a8","observation_id":"b9fb6c30-5f9b-4ebd-b675-5e88274e2f0a","resolution":{"observed_at":"2026-07-08T04:24:33.026646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.082309Z","title":"Morwani, I","venue":null,"work_id":"916d0a2c-2b8d-400c-8a1e-457e3bde4dc2","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:6062408854024c0962cbc5ce666dc7f4c007826ae79ec1bfc3ff6778ed14f4b8","observation_id":"5a357483-9c5c-4774-ae7f-ea22e7e4186c","resolution":{"observed_at":"2026-07-08T04:24:33.084355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.186666Z","title":null,"venue":null,"work_id":"ae52be86-8458-4aaa-ad01-c3f21390e754","year":1983},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:cc2cc4bf2e50f5651fc6cf05a17bb99c14b6abed65303b80efa05b13a7ba3736","observation_id":"4c504a5a-74c8-4bf8-a320-390a2c6b529b","resolution":{"observed_at":"2026-07-08T04:24:33.189049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.237446Z","title":null,"venue":null,"work_id":"19b63f39-1ab5-4419-8ec3-868bbebe143b","year":2023},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:8b1f755cdf4b70ad5f17387643ce256f1aa09e6170d1485ea64af7a9af056d46","observation_id":"82b11952-2f03-4a94-a332-81187d70c0fe","resolution":{"observed_at":"2026-07-08T04:24:33.238630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.06086","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:55:48.606089Z","title":"Muonall: Muon variant for efficient finetuning of large language models","venue":null,"work_id":"daf71d6d-4671-4ab2-8d5a-fbdba8db1937","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:8b7b7b50afbd838dc52ccee40a6e8dde6c2c3a58a024c8629623f69818dde6b8","observation_id":"b5e058d8-3c33-45f5-b753-81fe1e4c200f","resolution":{"observed_at":"2026-07-01T14:55:48.607785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08980","last_updated":"2026-05-09T14:47:59Z","snapshot_observed_at":"2026-08-11T06:45:42.987580Z","submitted_at":"2026-05-09T14:47:59Z","title":"Muon Does Not Converge on Convex Lipschitz Functions","version":1},"cited_work":{"arxiv_id":"2605.08980","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08980","snapshot_observed_at":"2026-07-01T14:55:48.677017Z","title":"Muon Does Not Converge on Convex Lipschitz Functions","venue":"cs.LG","work_id":"1e412e84-2509-4f6e-8d32-4a4c98e0b890","year":2026},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"cited_paper":"/paper/2605.08980","citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:12cf3258ba341864848364754819344bea92599f22d6e816aca1e7f5272c4ab8","observation_id":"30028358-cef4-4e56-ae16-14aeb34b90b5","resolution":{"observed_at":"2026-07-01T14:55:48.678250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.079162Z","title":"Pethick, P","venue":null,"work_id":"9b99658f-c26a-44e4-a5b9-b7448adc49b1","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:ec41280406a838ac906622e478b998c3bccf2780dedd987077aef59177c9dcfc","observation_id":"ba5182d3-8dfe-4b58-875b-8669ccf81db3","resolution":{"observed_at":"2026-07-08T04:24:33.081234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.085401Z","title":"Pethick, W","venue":null,"work_id":"1ffbd443-3bcf-429f-8ef1-c70b87ab39b4","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:62ea7fc908f607fade75469697664d3c12ba7d8a2f332dbf8f7d06f9a28bb4a2","observation_id":"f2477fa5-706c-44e0-9ea2-7cbe4666ee86","resolution":{"observed_at":"2026-07-08T04:24:33.087587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.304766Z","title":null,"venue":null,"work_id":"87cf0b61-603d-402c-baab-83facf0798f7","year":2016},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:e941a46260de68bc66926bf616ff51c1ad77ad5ab0a7fb1a8d9580bbbae01303","observation_id":"e6270319-4915-4476-b002-55890aa16f93","resolution":{"observed_at":"2026-07-08T04:24:33.306302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.109763Z","title":null,"venue":null,"work_id":"ff83444b-ee73-4597-9cfd-f1ff2b2e21eb","year":1964},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:9b19c85fbfa690cf9c834f3b04fca6ae780e51f4e5cfc694550a1cb076a2c3e3","observation_id":"e7161dc0-66e9-423d-aed7-3ad5f2070bfb","resolution":{"observed_at":"2026-07-08T04:24:33.111762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.181006Z","title":null,"venue":null,"work_id":"7bb2f937-093a-4eca-90d0-0fe279dfa40a","year":2025},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:e0bfc35e59a99e70909dbfe368f4ce63f5e458e8ec056f9aa2c2deaf23314c5f","observation_id":"1537cd41-6e2e-4b39-88c2-7a030be7dc12","resolution":{"observed_at":"2026-07-08T04:24:33.182824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.143615Z","title":null,"venue":null,"work_id":"ba7488cb-3956-431b-b529-f6f8bd3624ea","year":2018},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:1156668864ffb7b7667591874fbb757f2a606d717d3b64171f083ec70206c3af","observation_id":"f3792ccf-8cae-403d-a79d-da1e200cf9e8","resolution":{"observed_at":"2026-07-08T04:24:33.145052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:24:33.261465Z","title":"Ren and D","venue":null,"work_id":"994bbe90-56a7-4003-abb1-cbda0e442cca","year":2021},"citing_paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-30T18:27:40.390908Z"},"links":{"citing_paper":"/paper/2605.18528"},"observation_digest":"sha256:fa7e0b6cc0c7572a14d0955a1f9e1aa8484afc0f0b14a577847bc6f6cc09e7c0","observation_id":"99c40e55-e691-4ffb-85eb-1922c9244c8e","resolution":{"observed_at":"2026-07-08T04:24:33.262738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.18528","last_updated":"2026-05-31T14:16:59Z","latest_version":2,"primary_category":"math.OC","snapshot_observed_at":"2026-07-06T23:29:24.494326Z","submitted_at":"2026-05-18T15:13:18Z","title":"Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":33,"verified_exact":23,"verified_fuzzy":43},"total_outbound_references":148},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 148 outbound references and 0 inbound Pith citation observations for arXiv:2605.18528."}