{"as_of":"2026-08-09T07:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f50490972c54e501132105a5528002091602ddb96472875a7b6606bdbf5a510d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:58:26.454460Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T16:07:20.384070Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2206.00939","last_updated":"2026-04-14T08:05:07Z","snapshot_observed_at":"2026-07-06T13:16:46.850618Z","submitted_at":"2022-06-02T09:01:25Z","title":"Gradient flow dynamics of shallow ReLU networks for square loss and orthogonal inputs","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-24T11:27:58.190151Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2206.00939"},"observation_digest":"sha256:b517fd65bd40a4c4698e4ccc28e717b4de595a3f85d8ee608dde82c9ec53da47","observation_id":"c5dc415e-0547-4423-bd7c-ffb2aceb4d9d","resolution":{"observed_at":"2026-05-24T11:29:24.943153Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-08-08T19:58:26.454460Z","title":"Saddle-to-saddle dynamics in deep linear networks: Small initialization training, symmetry, and sparsity","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05300","last_updated":"2025-05-23T17:22:54Z","snapshot_observed_at":"2026-08-09T04:49:29.861223Z","submitted_at":"2025-02-07T20:10:05Z","title":"Parameter Symmetry Potentially Unifies Deep Learning Theory","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T19:58:26.454460Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2502.05300"},"observation_digest":"sha256:202bad5d0bcab0b5c52a63ea04e21b0c635195590be8878a58df3ed37403fe92","observation_id":"f0835da8-74a9-4d74-b960-dd28cc4b84d8","resolution":{"observed_at":"2026-08-08T19:58:26.454460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-08-08T11:19:06.913318Z","title":"Saddle-to-saddle dynamics in deep linear networks: Small initialization training, symmetry, and sparsity, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07998","last_updated":"2025-09-10T18:21:17Z","snapshot_observed_at":"2026-08-08T11:09:21.022136Z","submitted_at":"2025-02-11T22:34:49Z","title":"Adaptive kernel predictors from feature-learning infinite limits of neural networks","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T11:19:06.913318Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2502.07998"},"observation_digest":"sha256:3ddd4b73acc577f02ca921ad3b36d18666025063f35618db9312c9060dcebc4b","observation_id":"769afe19-6e56-443e-aa3b-48ef611a577f","resolution":{"observed_at":"2026-08-08T11:19:06.913318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-08-03T22:31:44.546962Z","title":"Jacot, F","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.10362","last_updated":"2025-11-13T14:39:32Z","snapshot_observed_at":"2026-08-07T15:41:32.469632Z","submitted_at":"2025-11-13T14:39:32Z","title":"Gradient Flow Equations for Deep Linear Neural Networks: A Survey from a Network Perspective","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T22:31:44.546962Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2511.10362"},"observation_digest":"sha256:27130d872e6fc47a54a91308daeb181aabe4cc2747b189579a86372fb977b219","observation_id":"3a8f20e4-0c1c-4f62-8650-bbd5be08d4ff","resolution":{"observed_at":"2026-08-03T22:31:44.546962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-08-03T06:00:14.652992Z","title":"Saddle-to-saddle dynamics in deep linear networks: Small initialization training, symmetry, and sparsity.arXiv preprint arXiv:2106.15933,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:14.652992Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:d15d5532303f818d167e7ef35d33d821be6154e8cbb3b486cf10af3244a6b59d","observation_id":"586fda19-a8a8-40da-b22c-a0822fc908b7","resolution":{"observed_at":"2026-08-03T06:00:14.652992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2604.21691","last_updated":"2026-04-23T13:58:12Z","snapshot_observed_at":"2026-08-02T12:48:50.592713Z","submitted_at":"2026-04-23T13:58:12Z","title":"There Will Be a Scientific Theory of Deep Learning","version":1},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-09T20:11:17.616190Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2604.21691"},"observation_digest":"sha256:afe8acc65a5264ea5f634621c68e7c4501bed45f1fe8585c933e80f09a0879a0","observation_id":"9b281b65-6c0a-49ee-bbb4-85a0350aab2a","resolution":{"observed_at":"2026-05-11T15:21:09.144024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2604.21905","last_updated":"2026-04-23T17:50:23Z","snapshot_observed_at":"2026-07-06T23:08:23.939574Z","submitted_at":"2026-04-23T17:50:23Z","title":"Low-Rank Adaptation Redux for Large Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-09T21:48:48.992712Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2604.21905"},"observation_digest":"sha256:479ed98c52c8081ae0f3dfa231e1e185ecd67bbb4be7b28c2887b49053739333","observation_id":"4255e4da-dfcd-46a1-be07-8dca82121aa8","resolution":{"observed_at":"2026-05-11T14:26:03.923173Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2605.01288","last_updated":"2026-06-23T15:11:40Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T06:55:15Z","title":"A Theory of Saddle Escape in Deep Nonlinear Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T14:54:47.763122Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2605.01288"},"observation_digest":"sha256:2a5f42c9e2bf0bcddf795567155edb5c8ed45119769dd1575da851789c13f31a","observation_id":"e986a627-14a1-4570-890d-91fdda2ab573","resolution":{"observed_at":"2026-05-11T16:51:05.621784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2605.01288","last_updated":"2026-06-23T15:11:40Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T06:55:15Z","title":"A Theory of Saddle Escape in Deep Nonlinear Networks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T02:22:38.751375Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2605.01288"},"observation_digest":"sha256:f05b9f617a0013318f1e6d9e9975f3a052a68488e4b6739a854a5afbb6746078","observation_id":"0580cf1d-33f6-493e-a206-c102a1e917a9","resolution":{"observed_at":"2026-05-11T02:25:54.524070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2605.01288","last_updated":"2026-06-23T15:11:40Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T06:55:15Z","title":"A Theory of Saddle Escape in Deep Nonlinear Networks","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T00:37:16.364388Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2605.01288"},"observation_digest":"sha256:be82f2dea2d130cc7b9767581cabc205e153f66a084f07f94c3fd1909298e90f","observation_id":"cc13ca84-3b89-473a-b861-b4f28adf5228","resolution":{"observed_at":"2026-07-01T00:45:12.010776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2605.23087","last_updated":"2026-05-21T22:37:25Z","snapshot_observed_at":"2026-07-06T23:33:19.375527Z","submitted_at":"2026-05-21T22:37:25Z","title":"The Implicit Bias of Depth: From Neural Collapse to Softmax Codes","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-25T05:26:15.556205Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2605.23087"},"observation_digest":"sha256:e67c9c6d134db41a34741d81e458788ff8be96f6941ede9a67011d151110c3bc","observation_id":"2c200eaa-fce0-4c85-9201-bbd28c6cc082","resolution":{"observed_at":"2026-05-25T05:26:38.967729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2605.29548","last_updated":"2026-06-01T17:29:35Z","snapshot_observed_at":"2026-08-02T17:41:19.598860Z","submitted_at":"2026-05-28T08:02:11Z","title":"Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-29T08:39:14.327838Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2605.29548"},"observation_digest":"sha256:639f929b42b71b57b140cb3bd907d13cce7e85c32b01628a787c05f8cb93e277","observation_id":"1ef28b9a-a2f5-49ec-b042-a50300625c0b","resolution":{"observed_at":"2026-06-29T08:43:15.235293Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2606.23198","last_updated":"2026-06-22T11:46:06Z","snapshot_observed_at":"2026-08-07T15:40:45.003271Z","submitted_at":"2026-06-22T11:46:06Z","title":"Incremental Learning in Mirror Flows","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-26T07:41:45.660598Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2606.23198"},"observation_digest":"sha256:6b8e0dad284660e47703f96472f64f04bbfc98c8a662c82dc30aeff81276f7f6","observation_id":"c9b9bdf9-7ed9-495c-b542-75333cb6dc10","resolution":{"observed_at":"2026-07-04T11:49:50.323221Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2606.30509","last_updated":"2026-06-29T16:17:38Z","snapshot_observed_at":"2026-08-04T01:38:12.903204Z","submitted_at":"2026-06-29T16:17:38Z","title":"Muon learns balanced solutions in matrix factorization without slow saddle-to-saddle dynamics","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-30T07:16:14.269675Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2606.30509"},"observation_digest":"sha256:ee47d729f9c585c91d69f2ee56022ec752469d03abe0716735962a541add9fee","observation_id":"5722c635-da17-4046-a543-86ce7abeff20","resolution":{"observed_at":"2026-06-30T07:24:21.767685Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2607.00665","last_updated":"2026-07-01T09:13:24Z","snapshot_observed_at":"2026-08-03T18:18:39.283181Z","submitted_at":"2026-07-01T09:13:24Z","title":"Effective dynamics of the Sinkhorn algorithm in the regime of low entropy regularization","version":1},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-07-02T08:05:55.418491Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2607.00665"},"observation_digest":"sha256:e30bab3fcc53443282a29149ba5bea0a542a26b5c0567c3f5b3e0df7acb793ed","observation_id":"79880936-ea8e-46f1-8465-aee9ee8437c2","resolution":{"observed_at":"2026-07-02T08:06:47.629924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":"2106.15933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-10T16:07:20.384070Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":"stat.ML","work_id":"755f4229-8616-4db7-ac4d-8b52abc3b055","year":2021},"citing_paper":{"arxiv_id":"2607.07884","last_updated":"2026-07-08T19:39:11Z","snapshot_observed_at":"2026-08-06T11:13:01.966646Z","submitted_at":"2026-07-08T19:39:11Z","title":"Optimal Learning Rate Scaling Depends on Data in Deep Scalar Linear Networks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-10T16:03:20.699893Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2607.07884"},"observation_digest":"sha256:6fe482ef6bf059b69281e40d7634a0a4c04300a4d685856c46de5a6d56296a16","observation_id":"30a82447-6799-47ae-b1a5-dddadb43daf8","resolution":{"observed_at":"2026-07-10T16:07:20.385724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-07-14T08:40:30.522134Z","title":"arXiv preprint arXiv:2106.15933 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10869","last_updated":"2026-07-12T18:10:23Z","snapshot_observed_at":"2026-08-08T07:11:46.821844Z","submitted_at":"2026-07-12T18:10:23Z","title":"Singular perturbations and hierarchical learning in two-layer neural networks","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-14T08:40:30.522134Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2607.10869"},"observation_digest":"sha256:2c302c478828253abf194b227e35b86e9ba0d5aa5c301549509541c4c250864e","observation_id":"784de15a-c03b-4197-8571-f18e7530f66d","resolution":{"observed_at":"2026-07-14T08:40:30.522134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2106.15933/citation-record","integrity":"/paper/2106.15933/integrity","json":"/paper/2106.15933/citation-record.json","paper":"/paper/2106.15933"},"outbound":[],"paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2106.15933."}