{"as_of":"2026-08-05T03:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5fc76ac3ab095c4836e3133ab9ec5db3568955e63fef723d983714446306885c","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T23:37:33.106390Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T11:24:38.292078Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T06:29:38.170656Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"cited_work":{"arxiv_id":"2603.26554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.26554","snapshot_observed_at":"2026-07-04T06:29:38.170656Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","venue":"cs.LG","work_id":"27b10d69-3108-497a-9be8-937bfa7571d9","year":2026},"citing_paper":{"arxiv_id":"2605.05189","last_updated":"2026-05-06T17:53:20Z","snapshot_observed_at":"2026-07-06T23:17:52.987860Z","submitted_at":"2026-05-06T17:53:20Z","title":"Sharp Capacity Thresholds in Linear Associative Memory: From Winner-Take-All to Listwise Retrieval","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-08T16:23:37.393165Z"},"links":{"cited_paper":"/paper/2603.26554","citing_paper":"/paper/2605.05189"},"observation_digest":"sha256:fe95b33776d6d570896fd7609ec1313dda18d59986ab6c2fc8c05e2e43a9b241","observation_id":"4043c371-ee47-4af6-8152-efe3a5407f4c","resolution":{"observed_at":"2026-05-11T18:16:10.033987Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"cited_work":{"arxiv_id":"2603.26554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.26554","snapshot_observed_at":"2026-07-04T06:29:38.170656Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","venue":"cs.LG","work_id":"27b10d69-3108-497a-9be8-937bfa7571d9","year":2026},"citing_paper":{"arxiv_id":"2605.09552","last_updated":"2026-05-10T14:11:22Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T14:11:22Z","title":"Phases of Muon: When Muon Eclipses SignSGD","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T04:05:08.899876Z"},"links":{"cited_paper":"/paper/2603.26554","citing_paper":"/paper/2605.09552"},"observation_digest":"sha256:377b6ba4030cca45d9c02e582afcb6c70e075e4def566eff63ad699da4867b7e","observation_id":"d1a55712-abce-4ef3-9c3e-d81ee3b41b16","resolution":{"observed_at":"2026-05-12T06:41:28.021389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"cited_work":{"arxiv_id":"2603.26554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.26554","snapshot_observed_at":"2026-07-04T06:29:38.170656Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","venue":"cs.LG","work_id":"27b10d69-3108-497a-9be8-937bfa7571d9","year":2026},"citing_paper":{"arxiv_id":"2605.10795","last_updated":"2026-05-11T16:24:02Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T16:24:02Z","title":"Factual recall in linear associative memories: sharp asymptotics and mechanistic insights","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:13:59.594279Z"},"links":{"cited_paper":"/paper/2603.26554","citing_paper":"/paper/2605.10795"},"observation_digest":"sha256:e64659d37231f1ddb312d50c6adfd4b22b8707f06c54e56af5a167ed281a3b9a","observation_id":"1089e6b3-8dbc-4b2a-8dc7-22dd750cde91","resolution":{"observed_at":"2026-05-12T06:31:25.668866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"cited_work":{"arxiv_id":"2603.26554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.26554","snapshot_observed_at":"2026-07-04T06:29:38.170656Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","venue":"cs.LG","work_id":"27b10d69-3108-497a-9be8-937bfa7571d9","year":2026},"citing_paper":{"arxiv_id":"2606.03899","last_updated":"2026-06-03T02:06:07Z","snapshot_observed_at":"2026-08-01T15:38:47.150046Z","submitted_at":"2026-06-02T16:54:38Z","title":"Denoise First, Orthogonalize Later: Understanding Momentum in Muon via Spectral Filtering","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T11:24:38.292078Z"},"links":{"cited_paper":"/paper/2603.26554","citing_paper":"/paper/2606.03899"},"observation_digest":"sha256:7852494336136c6a5cd300d48866f175179748574e6e897fa1be7853e05e22a5","observation_id":"085caa9e-fe0d-4465-98bd-af3f230ddaeb","resolution":{"observed_at":"2026-07-02T01:56:27.799457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"cited_work":{"arxiv_id":"2603.26554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.26554","snapshot_observed_at":"2026-07-04T06:29:38.170656Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","venue":"cs.LG","work_id":"27b10d69-3108-497a-9be8-937bfa7571d9","year":2026},"citing_paper":{"arxiv_id":"2606.04662","last_updated":"2026-06-03T09:40:30Z","snapshot_observed_at":"2026-07-06T23:44:42.700120Z","submitted_at":"2026-06-03T09:40:30Z","title":"Why Muon Outperforms Adam: A Curvature Perspective","version":1},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-06-28T07:04:21.012269Z"},"links":{"cited_paper":"/paper/2603.26554","citing_paper":"/paper/2606.04662"},"observation_digest":"sha256:b3d1086726d2e15be37e430467408fb24e959d195e5f35559c7f67dc58b2be8c","observation_id":"5d03af4e-8fb1-443a-b954-05048816f1a4","resolution":{"observed_at":"2026-07-02T07:06:45.027082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"cited_work":{"arxiv_id":"2603.26554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.26554","snapshot_observed_at":"2026-07-04T06:29:38.170656Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","venue":"cs.LG","work_id":"27b10d69-3108-497a-9be8-937bfa7571d9","year":2026},"citing_paper":{"arxiv_id":"2606.21514","last_updated":"2026-06-19T15:10:20Z","snapshot_observed_at":"2026-07-06T23:56:31.454439Z","submitted_at":"2026-06-19T15:10:20Z","title":"Towards Understanding the Power and Limits of the Muon Optimizer: A River-Valley Perspective","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T14:22:54.988008Z"},"links":{"cited_paper":"/paper/2603.26554","citing_paper":"/paper/2606.21514"},"observation_digest":"sha256:60566f6f48199a566abcf4be0c174bddc042980ffffab56f4c4badd59ecef222","observation_id":"c1cb717a-3335-4fa7-89a9-ddca762ea2f8","resolution":{"observed_at":"2026-07-04T06:29:38.171940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.26554/citation-record","integrity":"/paper/2603.26554/integrity","json":"/paper/2603.26554/citation-record.json","paper":"/paper/2603.26554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.05405","last_updated":"2024-04-08T11:11:31Z","snapshot_observed_at":"2026-08-05T03:30:28.158531Z","submitted_at":"2024-04-08T11:11:31Z","title":"Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws","version":1},"cited_work":{"arxiv_id":"2404.05405","doi":"10.48550/arxiv.2404.05405","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05405","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Physics of language models: Part 3.3, knowledge capacity scaling laws","venue":"arXiv (Cornell University)","work_id":"316d7b8f-344c-4c99-a387-d012a17b5c50","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2404.05405","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:9d1d2b5061c184d2a67a6920036f59202d820146449ce8c671ff2c7369090256","observation_id":"bb00fe68-5dc0-4c74-ba4e-e5b3d945a46c","resolution":{"observed_at":"2026-05-14T23:38:16.515544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Newton-Schulz","venue":null,"work_id":"e8187f23-f342-4778-bb98-95c511368391","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:01d5ea9bf8efe5d3b5bf359a4be33f7329a4dfede3407c16c5c581495bde3cec","observation_id":"743cfa7f-bed9-4b41-afa0-8b71adfe258f","resolution":{"observed_at":"2026-05-14T23:38:17.033976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20325","last_updated":"2024-12-06T14:09:22Z","snapshot_observed_at":"2026-08-03T03:18:47.425243Z","submitted_at":"2024-09-30T14:26:12Z","title":"Old Optimizer, New Norm: An Anthology","version":2},"cited_work":{"arxiv_id":"2409.20325","doi":"10.48550/arxiv.2409.20325","metadata_source":"pith","pith_arxiv_id":"2409.20325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Old Optimizer, New Norm: An Anthology","venue":"cs.LG","work_id":"c0089db6-7349-44fd-b103-0d7b36142bab","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2409.20325","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:474db9c5525ad43f165797427c78a1ddef33f4f00a6c34682f02327c7da1132b","observation_id":"11b7d7db-d016-4d39-b135-021952e9cbfb","resolution":{"observed_at":"2026-05-16T07:27:53.041705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Birth of a transformer: A memory viewpoint.Advances in Neural Information Processing Systems","venue":null,"work_id":"b856fb40-9d72-4616-9a7f-92891752fa15","year":2023},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:0c0461998eee096d745a5351c55c1a2c5f119ff615f00a571cb1c9079629bc85","observation_id":"2424849f-1ad0-4600-9307-e6da3f8dbbcc","resolution":{"observed_at":"2026-05-14T23:38:17.119807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01092","last_updated":"2024-06-23T10:46:17Z","snapshot_observed_at":"2026-07-06T17:24:03.237617Z","submitted_at":"2024-02-02T01:41:38Z","title":"A Dynamical Model of Neural Scaling Laws","version":4},"cited_work":{"arxiv_id":"2402.01092","doi":"10.48550/arxiv.2402.01092","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01092","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A dynamical model of neural scaling laws","venue":"arXiv (Cornell University)","work_id":"f4f689ad-770c-4e10-9425-c7262c32c019","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2402.01092","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:b44c8ac85764f7f954bb54d8bbc6e9006b8b184f864fce29bacb6a1fbca14e63","observation_id":"85378cda-0043-4862-8178-49dd11c319e3","resolution":{"observed_at":"2026-05-14T23:38:16.414959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling laws for associative memories","venue":null,"work_id":"a5bff787-9b74-4ab7-bd48-45cec51dc73f","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:332ec74fb65590b97b50d19ef3bf6be6c63b5bef0bddcfdd08e85f7c97653205","observation_id":"3508207b-76bc-417f-8724-c95839ecc2b3","resolution":{"observed_at":"2026-05-14T23:38:17.043130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimal rates for the regularized least-squares algorithm.Foundations of Computational mathematics, 7(3):331–368","venue":null,"work_id":"5e7b915e-ab08-455f-9108-90f657b8878d","year":2007},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:8b610096222152aefba7db453c7eb880fc253c8d4304f614c4fae6c50253708d","observation_id":"254d16b9-b71d-4602-894a-49e2ed10a319","resolution":{"observed_at":"2026-05-14T23:38:16.995960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.15054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.164299Z","title":"Muon optimizes under spectral norm constraints.arXiv preprint arXiv:2506.15054","venue":null,"work_id":"11632e07-3f8e-4967-8533-73db12242eee","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:233449a1bc09037a408c3a0252adbd9df2204ea37f1cd1314e618f2b9d462004","observation_id":"2a95a4d8-d9d9-4945-b0d7-740a9d191b27","resolution":{"observed_at":"2026-05-14T23:38:16.554261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04299","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T11:56:56.094916Z","title":"When do spectral gradient updates help in deep learning?arXiv preprint arXiv:2512.04299","venue":null,"work_id":"2b29279f-97b1-446c-a164-5217d6d534c3","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:45dcc053766bbf82ebc16ac478f3b9d014ebd4aab5c9bb785977a0701b536f06","observation_id":"be5e1174-f01f-4ddf-93aa-d1b9151d96f9","resolution":{"observed_at":"2026-05-14T23:38:16.466241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive subgradient methods for online learn- ing and stochastic optimization.Journal of Machine Learning Research, 12(61):2121–2159","venue":null,"work_id":"3901b931-d8ef-4734-9960-e6e446eb5891","year":2011},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:d0e11c4f1583f670490b1bd1a6b4bfb0f132b64ca6649db960b178797d00f744","observation_id":"de10de3b-4018-467d-8018-9a1f560bd444","resolution":{"observed_at":"2026-05-14T23:38:17.005505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toy models of superposition.Transformer Circuits Thread","venue":null,"work_id":"b5f8d93b-17eb-478a-b2ea-31d4fe3c6af3","year":2022},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:c94b5fe727688ece4f2c4ab82b5eda5710e1c5c91632c4a698b7a78de0b0dc25","observation_id":"6dd517af-9c3d-4625-ad68-a6912ab5c55b","resolution":{"observed_at":"2026-05-14T23:38:17.000748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.04664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:29:51.049321Z","title":"arXiv preprint arXiv:2502.04664 , year=","venue":null,"work_id":"f29e5345-6c21-4c5c-8d08-6b7e8844c206","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:bc62eeb4eab3c23f47e634e0f55989d8c97c377c59301d22898f702288206aa0","observation_id":"067830cc-2300-46ad-9963-c415dc90f3e7","resolution":{"observed_at":"2026-05-14T23:38:16.357736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16098","last_updated":"2025-05-22T00:58:50Z","snapshot_observed_at":"2026-07-31T03:05:58.528240Z","submitted_at":"2025-05-22T00:58:50Z","title":"Dimension-adapted Momentum Outscales SGD","version":1},"cited_work":{"arxiv_id":"2505.16098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16098","snapshot_observed_at":"2026-07-03T23:59:07.503096Z","title":"Dimension-adapted momentum outscales sgd","venue":null,"work_id":"9a9efd47-be3c-463a-8af6-1ddda26651c8","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2505.16098","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:408483fb528ebf1ab875f4493004c65ded8ee84b946d5d20494856b7616a80bc","observation_id":"df47034a-be6e-4c53-afd9-564ee5c509b1","resolution":{"observed_at":"2026-05-14T23:38:16.331834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:45:56.149174Z","title":"Transformer feed-forward layers are key-value memories","venue":null,"work_id":"8ed91ed5-c5c0-4292-be54-e31c0383e9b4","year":2021},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:0145e811dfd49986a719a2296b58a5f1c6a496c3c50a33712edcb4530bf145ba","observation_id":"cf9111a5-ae9d-46c0-ac82-9fd58e8b90aa","resolution":{"observed_at":"2026-05-14T23:38:16.967599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dissecting recall of fac- tual associations in auto-regressive language models","venue":null,"work_id":"816d5832-7650-4fc7-ba2f-d56ace6b3511","year":2023},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:0422c680901e4b678ae17a1b8d986cc78b7b42fccc7438fdaf22eefcca620583","observation_id":"3cbf93d4-6e92-4984-96dc-ef22728edaf5","resolution":{"observed_at":"2026-05-14T23:38:16.986205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.11948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:38:41.003760Z","title":"Gonon, A.-A","venue":null,"work_id":"42c852f2-1f12-4ef7-8341-ad78caae2327","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:cd9135648aad5dcdb4a61e2b83ac831c447f989f63339336022119b034144812","observation_id":"3ec53b03-3ca1-4d02-a3cd-072a6908bbd3","resolution":{"observed_at":"2026-05-14T23:38:16.508105Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:52:45.097761Z","title":"Shampoo: Preconditioned stochastic tensor optimization","venue":null,"work_id":"21bd27c1-c23e-4b16-9b92-81a1a1564e2a","year":2018},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:ca8c19161d691fdc7f61fc32a4a01d78df45976e53000643bca80f61e491c700","observation_id":"793d38da-0b97-4dfc-aa0b-91a640530550","resolution":{"observed_at":"2026-05-14T23:38:17.078708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SIAM","venue":null,"work_id":"9966dd21-4f0c-4ac1-8175-e6e9a2046fe3","year":2008},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:d41a607aae711fefdbca6da95ed4770feed444cffb32111e8dea08a2f3df1cbb","observation_id":"39acb91a-d8cc-49d7-8a13-cbf2f33711bd","resolution":{"observed_at":"2026-05-14T23:38:17.059840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural networks and physical systems with emergent collective computa- tional abilities.Proceedings of the national academy of sciences, 79(8):2554–2558","venue":null,"work_id":"ff9ba58f-4b54-4983-8909-7a647a5d1cd2","year":1982},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:537c4ee26cd6bc4ebffa8c16c3c1b9a8291b2105bfa6504ca216c5a47b43ff0f","observation_id":"460598f2-e8dc-4bb3-8b1a-1fe04348c4d8","resolution":{"observed_at":"2026-05-14T23:38:16.972090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T18:45:00.375779Z","title":"arXiv preprint arXiv:2602.08232 , year=","venue":null,"work_id":"a0d75b20-2a9a-4b63-87f7-4816c165b147","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:4608fe4eda8380436da65eff1afcfb8a10185e08c6ced099204b452b170b7e03","observation_id":"17b03d0f-dc2b-498a-b03d-95abe53c886c","resolution":{"observed_at":"2026-05-14T23:38:16.451791Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"28aa9f07-1b63-44c3-8d5e-8aab08cf2127","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:45f47edd77c33fe8dc1c4f5c76577a9bd563f8efece5e20daa0609c4b1448fb4","observation_id":"4da39e7e-a2ab-47dd-9025-ea6f639ac153","resolution":{"observed_at":"2026-05-14T23:38:17.038332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.431452Z","title":"Muon: An optimizer for hidden layers in neural networks","venue":null,"work_id":"92f732c8-b19c-4c2c-8d8d-be2096093467","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:edb05b29e86e61df8b1ffc778298bff18e3413333e78cff5e6c5732907e96b8e","observation_id":"cbde0707-c161-4ff3-9b53-f5a3bd506f31","resolution":{"observed_at":"2026-05-14T23:38:16.962122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.19156","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.158764Z","title":"Convergence of muon with newton-schulz","venue":null,"work_id":"2f290040-1932-48e9-8781-4d40f61448f1","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:d769a782785f673fe44efe45f47989eb39dd8c67273cca4e38a5df5fabc279eb","observation_id":"0af8acdd-8926-4f1e-a8a2-e1791711e595","resolution":{"observed_at":"2026-05-14T23:38:16.305368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling laws of SignSGD in linear regression: When does it outperform SGD? InThe Fourteenth International Conference on Learning Representations","venue":null,"work_id":"6afe579c-90d2-4be2-a881-cbd7154ea2e0","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:c2801efeadd6638ba832e3d6cbd75bb00bd1b169566da85bf0b2bc9771c6fedd","observation_id":"03177960-fee3-43b1-ac29-b38f74be0460","resolution":{"observed_at":"2026-05-14T23:38:17.096627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:2a9e66cbf7aa3d44e659c018bc6103cc8014371df557c5c50466002a8c21dd67","observation_id":"c91610e5-99ec-4e1d-911e-3fcc914deb81","resolution":{"observed_at":"2026-05-14T23:38:16.530127Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On Lipschitz functions of normal operators.Proceedings of the American Mathematical Society, 94(3):416–418","venue":null,"work_id":"c0507c25-9b74-4e8c-a22d-c6bc87ed2b14","year":1985},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:933e38a2c0483cf95be2c8c00fa782a9f999c5cb74475040b3ce1d5056ce58dc","observation_id":"585c8541-fe43-4c7c-9963-d7a1e85f2a97","resolution":{"observed_at":"2026-05-14T23:38:17.127793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Correlation matrix memories.IEEE Transactions on Computers, C-21: 353–359","venue":null,"work_id":"024884dc-9a87-47c9-b655-0a9189f54514","year":1972},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:441f023e837594bf45324b5c32b88956c34b2a13b700b8d3b1ccd45ccd388dd8","observation_id":"8d643344-f022-4a79-94a6-ac42419f4fdf","resolution":{"observed_at":"2026-05-14T23:38:16.957367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19227","last_updated":"2025-05-25T16:43:51Z","snapshot_observed_at":"2026-07-06T21:30:09.658226Z","submitted_at":"2025-05-25T16:43:51Z","title":"Scaling Laws for Gradient Descent and Sign Descent for Linear Bigram Models under Zipf's Law","version":1},"cited_work":{"arxiv_id":"2505.19227","doi":"10.48550/arxiv.2505.19227","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19227","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling laws for gradient descent and sign descent for linear bigram models under Zipf’s law","venue":"ArXiv.org","work_id":"ab5a2baf-c339-4749-8d9e-a967b4e41033","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2505.19227","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:5f9056fee73fafe41bdf3d26029d5a854f38d1df05d1c8eb658909fc52d188b4","observation_id":"56b85639-3a29-4ce3-a1b2-e06552f43fb4","resolution":{"observed_at":"2026-05-14T23:38:16.479805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Heavy- tailed class imbalance and why adam outperforms gradient descent on language models.Ad- vances in Neural Information Processing Systems, 37:30106–30148","venue":null,"work_id":"b917fa3c-3451-419c-bf18-94e6b34721de","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:ecf69088d8b84c7853572840a50d3b70d9e10625c5b58ba36568d145ac765836","observation_id":"e15e8563-06e9-4b54-8700-80849fe01ccc","resolution":{"observed_at":"2026-05-14T23:38:17.019572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.21799","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:29:54.472214Z","title":"ArXiv Preprint: 2505.21799 , Year =","venue":null,"work_id":"697efaae-b1b5-453e-87eb-aa0d1c995386","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:92c3dd1d29f68f3263f5f81ed895df069ac3bb9fd969c01f591a74a8522453a6","observation_id":"f62ece5c-c11a-4e8e-871f-c9bf9ce3b214","resolution":{"observed_at":"2026-05-14T23:38:16.523842Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.05725","last_updated":"2026-06-03T16:40:26Z","snapshot_observed_at":"2026-08-03T04:14:09.367178Z","submitted_at":"2026-02-05T14:49:40Z","title":"Muon in Associative Memory Learning: Training Dynamics and Scaling Laws","version":3},"cited_work":{"arxiv_id":"2602.05725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.05725","snapshot_observed_at":"2026-07-02T07:16:44.437267Z","title":"Muon in associative memory learning: Training dynamics and scaling laws","venue":"cs.LG","work_id":"9c07bb03-2084-4fb4-9d9a-1aa47375851d","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2602.05725","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:4c9dd61fcb20492fc0fedf10067cc05e0758cd05f31b087d46724332a5771e3c","observation_id":"7255f0ad-6231-45c9-9a8e-a18e31036b34","resolution":{"observed_at":"2026-05-26T03:04:11.161880Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08466","last_updated":"2025-06-10T04:25:56Z","snapshot_observed_at":"2026-07-06T18:29:49.284504Z","submitted_at":"2024-06-12T17:53:29Z","title":"Scaling Laws in Linear Regression: Compute, Parameters, and Data","version":3},"cited_work":{"arxiv_id":"2406.08466","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08466","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling laws in linear regression: Compute, parameters, and data","venue":null,"work_id":"c7931e4f-b28f-4875-b834-a6823cbd1321","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2406.08466","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:4234b9b481735345cf526ec2ff31974f83a41d1adba4ca7ef5a6fbe0d2f3cb02","observation_id":"ee6d3d6b-cf1f-46ad-bbec-db4b20c783f9","resolution":{"observed_at":"2026-05-14T23:38:16.542266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-02T00:32:51.000665Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":"2502.16982","doi":"10.48550/arxiv.2502.16982","metadata_source":"pith","pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Muon is Scalable for LLM Training","venue":"cs.LG","work_id":"a818f37a-b985-49e6-879d-603a00525f65","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:b4cb3bd7e8f16c6babe116e89efcb35aa6a23989fd77cfe707bef3d4a21a1b73","observation_id":"515d4ac9-d67d-4f32-a8e1-883ce029ccd2","resolution":{"observed_at":"2026-05-14T23:38:16.547879Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:c58adaba4daaeee97f8562dd3390aa2d116143d439b4310a37c6bda53de297c5","observation_id":"9cf081e8-c334-426b-93b4-1e4e2501b479","resolution":{"observed_at":"2026-05-14T23:38:16.500557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.166830Z","title":"Charles H Martin and Christopher Hinrichs","venue":null,"work_id":"c78cf2a1-55f8-45ba-8922-f30f990616be","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:c44df888aa1e224c332b962d80c240fdf438c0cfe854e77b46f06ecec5990c4e","observation_id":"fc928433-94b1-4212-9e71-142905a41c51","resolution":{"observed_at":"2026-05-14T23:38:16.340518Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimizing neural networks with kronecker-factored ap- proximate curvature","venue":null,"work_id":"25031147-b856-4a99-960e-315e0234908a","year":2015},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:dcd0c8d0b4d6ad80a2c2e80f48357923bd6cad0925c966b7c7da6229b4c9a8a5","observation_id":"c1d8fa1d-4d62-4aac-bc68-c2158538de76","resolution":{"observed_at":"2026-05-14T23:38:17.029769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Locating and editing factual associations in GPT.Advances in neural information processing systems, 35:17359–17372","venue":null,"work_id":"6200ee9c-7b52-4e06-8be9-f648520774a7","year":2022},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:d198d1e6380e8805ab146c2e0109993c4cb93fe27ec51ef97a6003b75cb3b054","observation_id":"52df7bb2-5aa9-44fa-bcf3-85e6fbdb3b5b","resolution":{"observed_at":"2026-05-14T23:38:17.071300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The quantization model of neural scaling.Advances in Neural Information Processing Systems, 36","venue":null,"work_id":"b10466bb-d9ed-49a4-9106-fd539c5b3b02","year":2023},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:2ea24b00a8af3f411c7b5aa6fc7800be583f379bfa47f4769ffb65d9732f4668","observation_id":"ee10091f-432d-4fdc-a988-63b7ae3f2bcb","resolution":{"observed_at":"2026-05-14T23:38:16.952522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06538","last_updated":"2024-12-09T14:48:14Z","snapshot_observed_at":"2026-07-06T20:03:56.309640Z","submitted_at":"2024-12-09T14:48:14Z","title":"Understanding Factual Recall in Transformers via Associative Memories","version":1},"cited_work":{"arxiv_id":"2412.06538","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06538","snapshot_observed_at":"2026-07-10T01:36:44.301678Z","title":"Understanding factual recall in transformers via associative memories","venue":"cs.LG","work_id":"35a95075-3fb2-463f-9082-33da2c36f958","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2412.06538","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:a304a15d4898198ef09feb422e8803a81ec79c6e85c9ae65686d648a42ee1db3","observation_id":"9652324b-2881-457a-a21f-a48ce450962a","resolution":{"observed_at":"2026-05-14T23:38:16.323638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":"2209.11895","doi":"10.1145/3411763.3451760","metadata_source":"pith","pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In-context Learning and Induction Heads","venue":"cs.LG","work_id":"db2b0911-2758-4a2a-99dc-15b14b91bd5e","year":2022},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:a816486cb3f6e0b4f290a30cd79f5163b718f324d0780e933af5a5848bd67246","observation_id":"38449fd9-a742-405f-9039-8960522ea2be","resolution":{"observed_at":"2026-05-14T23:38:16.445015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4+3 phases of compute-optimal neural scaling laws.Advances in Neural Information Processing Systems","venue":null,"work_id":"3c1b2153-984a-482d-b777-19616daa7f8e","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:a3990a0572521978289d12e9fefcd12f3710ee0032dcbe6fb595f6637c78adda","observation_id":"cb119a6e-fe54-4441-90fe-90bce26fd82a","resolution":{"observed_at":"2026-05-14T23:38:16.976661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Piantadosi","venue":null,"work_id":"9d210d9f-1105-42f1-9ecc-750b4c9b6d67","year":2014},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:7978e7e62f225f1c23c79ee8cc4332bce91096cd9c518aea5fd5bac9438442f8","observation_id":"a3357c4a-0105-448e-9e86-a375c06cb453","resolution":{"observed_at":"2026-05-14T23:38:17.051231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.19983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T05:39:41.023600Z","title":"arXiv:2504.19983 , year=","venue":null,"work_id":"af08a440-2e5d-44df-b56b-1e96da8d515a","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:17ccda3fd682ea5c2776cec79619ded5786274209a29351afca2f3ac5744c389","observation_id":"a0368ba5-3ff9-4392-a1b4-99ff432a53ca","resolution":{"observed_at":"2026-05-14T23:38:16.472504Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"677a4995-de5e-4760-b4ae-d2115bdc8eac","year":2020},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:0535d456a5d73cb5bd02eb3d4acfcfa3d0261b4f663f63cf53718c62a98de0d5","observation_id":"b2a2bacf-2e2f-4bf2-93f3-42d750fd3f6d","resolution":{"observed_at":"2026-05-14T23:38:17.064020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"0802.3956","last_updated":"2009-08-03T13:59:43Z","snapshot_observed_at":"2026-07-06T01:35:43.882342Z","submitted_at":"2008-02-27T06:36:03Z","title":"The smallest singular value of a random rectangular matrix","version":4},"cited_work":{"arxiv_id":"0802.3956","doi":null,"metadata_source":"pith","pith_arxiv_id":"0802.3956","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The smallest singular value of a random rectangular matrix","venue":"math.PR","work_id":"f832df22-643f-4132-a4dd-fc51ed8e8bca","year":2008},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/0802.3956","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:06ece73e9c58172716738e4d588c8d33992823b8a3e1cb75d83444cd910ed2fe","observation_id":"ffa00a67-dea1-449e-9271-087b72657ddf","resolution":{"observed_at":"2026-05-14T23:38:16.458494Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-asymptotic theory of random matrices: extreme singular values","venue":null,"work_id":"a16f646a-5a5c-41fc-8767-b1666462b6f5","year":2010},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:2ac2a56aba39ee953ce52b50438f8b2452268853161afb062768711f7c532159","observation_id":"ee9c8335-0c17-4d77-88b7-64bf301ad06a","resolution":{"observed_at":"2026-05-14T23:38:17.024539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09268","last_updated":"2024-02-14T15:54:55Z","snapshot_observed_at":"2026-07-06T17:30:03.953345Z","submitted_at":"2024-02-14T15:54:55Z","title":"Transformers, parallel computation, and logarithmic depth","version":1},"cited_work":{"arxiv_id":"2402.09268","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.09268","snapshot_observed_at":"2026-07-03T11:18:03.211693Z","title":"arXiv preprint arXiv:2402.09268 , year=","venue":null,"work_id":"8dcbe092-d753-4f4f-a4c1-4348615bf637","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2402.09268","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:65d61061403a2322a1e77a47edf7640fec9ec6e57aed22d4fc132028eab0ebe7","observation_id":"008b7f8f-7945-4c3e-ad8a-2123a4bb20e1","resolution":{"observed_at":"2026-05-14T23:38:16.437964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.01440","last_updated":"2025-09-01T12:50:30Z","snapshot_observed_at":"2026-07-06T22:21:43.357115Z","submitted_at":"2025-09-01T12:50:30Z","title":"Benchmarking Optimizers for Large Language Model Pretraining","version":1},"cited_work":{"arxiv_id":"2509.01440","doi":"10.48550/arxiv.2509.01440","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.01440","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Benchmarking optimizers for large language model pretraining.arXiv preprint arXiv:2509.01440","venue":"ArXiv.org","work_id":"0365a535-39b7-4c6c-8ef2-d08314864789","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2509.01440","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:455f69296e2b42d02857b1db7643c31e263b96c07023a2a49de4dbba2895cb7d","observation_id":"c9deeb18-9d70-42b9-8189-95b541cf1845","resolution":{"observed_at":"2026-05-14T23:38:16.407545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23737","last_updated":"2026-07-28T01:40:23Z","snapshot_observed_at":"2026-07-31T23:54:11.554863Z","submitted_at":"2025-05-29T17:58:01Z","title":"On the Convergence Analysis of Muon","version":3},"cited_work":{"arxiv_id":"2505.23737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23737","snapshot_observed_at":"2026-07-04T18:40:03.190709Z","title":"On the Convergence Analysis of Muon","venue":"stat.ML","work_id":"fe8817f3-ca08-4ed5-a8fd-c2bfdaf1a459","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2505.23737","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:604a3c6061b47a0830b962b750628ac4be94836b56554bacfa2545a258960f65","observation_id":"074967e5-1d82-4e91-afb3-184c5c861a82","resolution":{"observed_at":"2026-05-14T23:38:16.421053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.00674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.165345Z","title":"ArXiv Preprint: 2511.00674 , Year =","venue":null,"work_id":"5e0fa664-f7a6-4ce3-934b-dd6d242ac7c6","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:59f53f087449fba8ccede8192c215101e837e0fd95254e6887f99d767ed32f93","observation_id":"13da52bd-587b-48e9-98a1-c49402b1d168","resolution":{"observed_at":"2026-05-14T23:38:16.486707Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22980","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:27:30.174948Z","title":"How Muon’s spectral design benefits generalization: A study on imbalanced data","venue":null,"work_id":"a6f49026-f766-4fe2-86e5-d0131fda5922","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:2a7498d36e26777d2966ed4e6a9e328fef014b2c188eda5522d4f34668f54eb7","observation_id":"dbf72499-5948-40f2-be8d-680aa900536a","resolution":{"observed_at":"2026-05-14T23:38:16.535730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vershynin.High-dimensional probability: An introduction with applications in data sci- ence","venue":null,"work_id":"25f087c8-1e9b-4e10-9d72-02cbd0e6dcba","year":2018},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:8084109f539817b48d9a9050f1dd6d8bfd5e8b8a25ab2d99b9dcd9631d5036f1","observation_id":"e4a568c5-ac78-4e30-8af7-588814b66a7f","resolution":{"observed_at":"2026-05-14T23:38:17.091516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to recall with transformers beyond orthogonal embeddings","venue":null,"work_id":"6967800d-60aa-4e7d-a268-1d6699be0f83","year":2026},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:bddbe955eead48a933a8c99e6acada3634e00daec979b69eb7644a56091748a5","observation_id":"35963b09-de79-406e-8bb3-64d627746ba8","resolution":{"observed_at":"2026-05-14T23:38:17.112132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11321","last_updated":"2025-01-31T18:52:42Z","snapshot_observed_at":"2026-07-06T19:16:51.512681Z","submitted_at":"2024-09-17T16:18:05Z","title":"SOAP: Improving and Stabilizing Shampoo using Adam","version":2},"cited_work":{"arxiv_id":"2409.11321","doi":"10.48550/arxiv.2409.11321","metadata_source":"pith","pith_arxiv_id":"2409.11321","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SOAP: Improving and Stabilizing Shampoo using Adam","venue":"cs.LG","work_id":"65c9d9eb-0524-49bd-9aa5-2756ce24dc7f","year":2024},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2409.11321","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:30e23f539c700128953a32bc6431470e6715f7698d084674e5673319d5b66d09","observation_id":"8cab3970-ffd2-4120-9e6c-accc89152448","resolution":{"observed_at":"2026-05-15T01:02:28.631723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wainwright.High-dimensional statistics: A non-asymptotic viewpoint","venue":null,"work_id":"41aac7c0-7b4e-4dda-8724-fc80d0c8b49b","year":2019},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:59c92d57c49b6ae19d82b2458749aa67520e8728773490593c1cb1b7e9bc9eb1","observation_id":"0b2a07ff-1bfc-40bf-872b-77107b7efbe6","resolution":{"observed_at":"2026-05-14T23:38:17.009925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-dimensional isotropic scaling dynamics of Muon and SGD","venue":null,"work_id":"1b7d3df5-0e44-4d28-9d4d-4b6f2d4f2e36","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:5dd4da1abedfdca64933ec270c022038bc76134d4c97fdea2ea2d91c530eba01","observation_id":"484df34f-a11f-4f2f-a8e6-f15ed0b3b3c6","resolution":{"observed_at":"2026-05-14T23:38:17.014497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26030","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.185587Z","title":"Muon outperforms adam in tail-end associative memory learning","venue":null,"work_id":"557e3d1a-f8b7-4fbe-9dc8-9432aa0bb507","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:c53d84581f30cbab253d5ffe90f9d161ab65b3fc97e87470acbdd80d489a6a3a","observation_id":"a5344549-32cf-4cf2-8bf8-ef077065c8e8","resolution":{"observed_at":"2026-05-14T23:38:16.430815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23683","last_updated":"2025-05-29T17:22:00Z","snapshot_observed_at":"2026-07-06T21:33:07.415628Z","submitted_at":"2025-05-29T17:22:00Z","title":"Learning Compositional Functions with Transformers from Easy-to-Hard Data","version":1},"cited_work":{"arxiv_id":"2505.23683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23683","snapshot_observed_at":"2026-06-29T14:33:30.598717Z","title":"Lee, and Denny Wu","venue":null,"work_id":"45352772-aa21-408e-b9bd-690072865f73","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2505.23683","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:cb24feda1c2c5dc95fccd709bce4f6e8630a27907b3d02943b5226fea334db71","observation_id":"c1fafadd-a6b4-4052-9480-75040c60f282","resolution":{"observed_at":"2026-05-14T23:38:16.390943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02046","last_updated":"2025-09-04T19:22:04Z","snapshot_observed_at":"2026-08-02T20:37:51.914753Z","submitted_at":"2025-09-02T07:43:22Z","title":"Fantastic Pretraining Optimizers and Where to Find Them","version":2},"cited_work":{"arxiv_id":"2509.02046","doi":"10.48550/arxiv.2509.02046","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02046","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fantastic pretraining optimizers and where to find them.arXiv preprint arXiv:2509.02046","venue":"ArXiv.org","work_id":"692b6526-174d-4275-b06f-8afe06e28a6c","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2509.02046","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:801a72c0ece4357a01cd30c747eae02ca7c35eef8b2abce3e57100884f660279","observation_id":"1f5344e2-3042-47f1-a1c2-303c255b71b2","resolution":{"observed_at":"2026-05-14T23:38:16.348622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non- holographic associative memory.Nature, 222(5197):960–962","venue":null,"work_id":"8aec3061-2d62-413e-a284-e1e8f6b00abc","year":1969},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:6272028c40f364f26dcbb6c653301bf64c4801504d57346667c21685ddea27a0","observation_id":"ad79f28d-ec35-45be-9315-b9c8343618bc","resolution":{"observed_at":"2026-05-14T23:38:17.103542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10537","last_updated":"2025-07-15T06:22:08Z","snapshot_observed_at":"2026-07-06T20:52:09.743730Z","submitted_at":"2025-03-13T16:51:59Z","title":"Structured Preconditioners in Adaptive Optimization: A Unified Analysis","version":2},"cited_work":{"arxiv_id":"2503.10537","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10537","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structured preconditioners in adaptive optimization: A unified analysis.arXiv preprint arXiv:2503.10537","venue":null,"work_id":"b15e83a3-d996-4fb3-ab6b-f585a222bb3b","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"cited_paper":"/paper/2503.10537","citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:8c70e32292b870d00f69cbb5c30b004d9eb0269ee33ac4d943f59a5dc464c3f9","observation_id":"d0aa1f5c-3178-4ad9-972b-f84246941acc","resolution":{"observed_at":"2026-05-14T23:38:16.383377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.00763","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:52:44.843222Z","title":"Provable benefit of sign descent: A minimal model under heavy-tailed class imbalance","venue":null,"work_id":"1bf7a0e9-0bae-4c85-affa-ade3e30272eb","year":2025},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:06626e0407ebffe5576b8174edefa9247403394ae9246e2fd8a0c57b9973c5cf","observation_id":"f6d17607-fdfb-4bdb-be7a-e73a6220dc27","resolution":{"observed_at":"2026-05-14T23:38:16.365235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Now supposeB≳d α","venue":null,"work_id":"fb4530a9-fd2b-4c8f-8d2b-368015f8c653","year":null},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:e019e6fb548abe4f51139eae85118d1e9908960ea45a55fcbf05e090c406219f","observation_id":"ba46ade2-d612-499d-8374-82caabb27c12","resolution":{"observed_at":"2026-05-14T23:38:16.990961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"sup (u,v)∈T Xu,v # ≤E","venue":null,"work_id":"f591a1c6-871b-4e1c-a9ad-f839a80f694b","year":null},"citing_paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-14T23:37:33.106390Z"},"links":{"citing_paper":"/paper/2603.26554"},"observation_digest":"sha256:11b9e34e12a2798d2e6c80658dd002818bb7d84bfebe103139f5007e335ddfc6","observation_id":"5a2d0352-d8a5-4f6f-8c74-9bbe25fa5aac","resolution":{"observed_at":"2026-05-14T23:38:16.981385Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.26554","last_updated":"2026-04-28T07:36:37Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T16:13:18Z","title":"Sharp Capacity Scaling of Spectral Optimizers in Learning Associative Memory"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":1,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":2,"verified_exact":26,"verified_fuzzy":28},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 6 inbound Pith citation observations for arXiv:2603.26554."}