{"as_of":"2026-08-21T02:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b99ad7ccab59c1dd0a479f34559c223e0cac22ab294a4b65a67204dbde00231","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.00340/citation-record","integrity":"/paper/2606.00340/integrity","json":"/paper/2606.00340/citation-record.json","paper":"/paper/2606.00340"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":"1608.03983","doi":"10.21203/rs.3.rs-7055642/v1","metadata_source":"pith","pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","venue":"cs.LG","work_id":"ad476478-c5ea-495b-a454-168c504bbfcc","year":2016},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:293ee4dfd0b2a93a0caee6552c3e6da620fcd343d33565a1ae76f71b4939a126","observation_id":"7e8891af-deba-4bfc-baf5-7898fb9b6ef6","resolution":{"observed_at":"2026-06-28T23:12:46.362276Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:5dcba62c1bf9149b488914339f3468f444bc445692734755b0f91a6c58ca85bf","observation_id":"ff8932ad-57e2-43c2-9524-1ac25922e95d","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":"We have B0 1 = B0 1 F = q tr(B 0 1 ⊤B0","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:a34540bc2b2ee64b3ba299eace40a48faa5fb37eab7ce03a919b55cd504bba2e","observation_id":"89737936-0ea9-4731-ad59-2faeec2d59bd","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:4c73743ba160c6082e38bd6eb50fd3f26e883d091731dfcdccbd890e936e9420","observation_id":"f3b4cd13-bf19-4467-89c1-48235fed66fc","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":"Thus, we get that G0 1 −A 0 1 ≤ 1√ h−1 G0 1 , G0 2 −A 0 2 ≤ 1√ h−1 G0 2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:7e39953d907b103dd7aaf46b2cbca47ea6fd4dee6c048db9e79328e3207b6d09","observation_id":"a820afe4-d530-4fb9-8e15-81d761b489d1","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:d67ad043082dd17e20f0df0b7b04f6ab8580a80ed87838d7fa90427749dd883a","observation_id":"5661474e-988a-47fe-8dca-21c839ec78b7","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:2b1890bd7c3df136bbf96045467c324ca138ebc8d04d5f03cc061ec11d662cef","observation_id":"3cd8d4e4-e6eb-4447-88e7-476dbe6dad8d","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:fc4f72635c8d9df44a72f10f563720a452c2d47b4520ac300f498847f33a105c","observation_id":"147f80d7-aaf1-40f4-ad7c-36d1e61333de","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":"Thus, we get that G0 1 −A 0 1 ≤ 1√ h−1 G0 1 , G0 2 −A 0 2 ≤ 1√ h−1 G0 2","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:6856b706948b385e93bb731bf0e187cbfa1558044924c189e1bf4b6cb592ef11","observation_id":"8b084bef-2f4d-4a24-85a5-7d9c65c6f9e1","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":"1 h W 1 1 W 1 2 −M ⊤ ˜x⊤ 0 ˜x0 1 h W 1 1 W 1 2 −M #! =tr EW 0 1 ,W 0 2 ,ξ, ˜x0,X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:a5f4c2db80781e02b68e0f138d87d81c08e0dafbd309e11ffbfc414ecbbb05e3","observation_id":"a054caff-314c-4a33-9e9f-6d6958e51ddb","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:715a349e221821aaaa030bd596f192e86ad97573d23cbcd8339f8c8786ffd29b","observation_id":"eb3adf63-e769-4646-986f-563de304716c","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:10a7d810edaa2edbda31d834730824c49f8d051b4bb64569151ac007037fa3d8","observation_id":"86e12ed9-e35f-4cf7-bea7-874ae10dee40","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:313a386f2bf436d6ac83740d236390cef03627b3f4ef810473e75d83f79ea001","observation_id":"4b6cc828-0838-4808-883f-b69a4f6bdda4","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:bdbad6e99d7d4f73838c7a0b7d0a02ddec28ca2580e1ecf4203e77175cdfbf09","observation_id":"bc77ad06-d0d0-442c-b288-4a346a18d2e2","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":"1√ h W 1 1 W 1 2 a−β ∗ ⊤ ˜x⊤ 0 ˜x0 1√ h W 1 1 W 1 2 a−β ∗ # =tr EW 0 1 ,W 0 2 ,a,ξ, ˜x0,X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:0bb63063f5fb87e6bf5836bfc02d72d6796215f461076c4b691c40c332dde7ca","observation_id":"3b99c05f-cbdb-4eaa-8639-09b97a102ba9","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:4975bae74a17af56182baece33b96e8f1c49a75de01f22f92397c85a0176a610","observation_id":"b6274469-c609-4974-ae33-fe4b79e0e092","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:06:06.894036Z","title":"1 h W 1 1 W 1 2 −M ⊤ ˜x⊤ 0 ˜x0 1 h W 1 1 W 1 2 −M #! =tr EW 0 1 ,W 0 2 ,ξ, ˜x0,X","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:06.894036Z"},"links":{"citing_paper":"/paper/2606.00340"},"observation_digest":"sha256:144ec43842567e5e8e2315e7b0e32c8c5fffef136b2f22571e3fe713b461d274","observation_id":"50908399-bfef-40ec-ba2d-e617b4f23b44","resolution":{"observed_at":"2026-06-28T23:06:06.894036Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.00340","last_updated":"2026-05-29T20:28:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T01:38:28.931501Z","submitted_at":"2026-05-29T20:28:52Z","title":"Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":13,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2606.00340."}