{"as_of":"2026-08-21T05:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ffce746c33507573d1b1f50bb6b876bdb52a9fcbcb484428e1afdc6fb0c6871a","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T12:22:30.263086Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:48:12.846717Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19095","snapshot_observed_at":"2026-08-01T04:48:12.846717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22444","last_updated":"2026-07-24T16:06:38Z","snapshot_observed_at":"2026-08-18T18:27:22.476740Z","submitted_at":"2026-07-24T16:06:38Z","title":"Hyperball May Not Be a Free Lunch","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T04:48:12.846717Z"},"links":{"cited_paper":"/paper/2605.19095","citing_paper":"/paper/2607.22444"},"observation_digest":"sha256:3aad5a3963beac08b668b7d7112c959549bf7aad50e17789b5c16084b8840083","observation_id":"b1b2ba76-6c29-4b7e-9e59-793153cc68c4","resolution":{"observed_at":"2026-08-01T04:48:12.846717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.19095/citation-record","integrity":"/paper/2605.19095/integrity","json":"/paper/2605.19095/citation-record.json","paper":"/paper/2605.19095"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f65249f-b948-4af5-bcf5-04bbc034b8a2","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:912a0c4b3d297e53b8ce0087882b64afc47554f8180661acaa3f2db53ac9c20e","observation_id":"0493248a-f65a-4c7a-ad4e-0a3ccc4c0c73","resolution":{"observed_at":"2026-05-20T12:23:17.163772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"S., Gosal, G., Gray, G., Soboleva, D., and Hestness, J","venue":null,"work_id":"710f3a63-25f8-47f7-8f42-77b5256be404","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:f0851dc1459704d95e971888e8702b4b224ca8aff7c0de87a7ca94aa9a293045","observation_id":"940a63b1-3814-40a6-b81c-1cfdad43fa47","resolution":{"observed_at":"2026-05-20T12:23:17.155926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-14T19:47:04.330126Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":"2401.02954","doi":"10.48550/arxiv.2401.02954","metadata_source":"pith","pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","venue":"cs.CL","work_id":"01b10587-025b-499d-8ba3-7a538d24c2d6","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:f996e1d7fac207c6d9a7175d7d7f147726806112209388d6848c1f7545e51fe6","observation_id":"ca6a6106-6ebd-4f5d-abbf-4ed014d7d67c","resolution":{"observed_at":"2026-05-20T12:23:16.793440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"58a13425-9911-4456-906a-40836e5a862b","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:0751217eee1ad72be87af42bf58c521f914f8625b823b36527a55fc3418ba962","observation_id":"2251bd43-83c3-48b4-9402-0cf1389316f5","resolution":{"observed_at":"2026-05-20T12:23:17.174085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6dfd7b4e-4f16-43dc-b2c4-211932ba0698","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:4b4b7b2ad06ada93fd575a0164c24b74cd7a2de2633eed67b95e4f8a5b28823f","observation_id":"6fc25b09-ac3c-4643-a541-73c73d1cb900","resolution":{"observed_at":"2026-05-20T12:23:17.177980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Gower, R","venue":null,"work_id":"7a3ba9aa-515b-403c-bf1c-e60ca6668421","year":2021},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:7349987df08311eb1690c226219bda63df41b06f4744305104631e888d15e846","observation_id":"6c09cb8b-1ceb-49f7-bd01-de247afa7057","resolution":{"observed_at":"2026-05-20T12:23:17.154030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Mishchenko, K","venue":null,"work_id":"7ca2a6c4-9f69-4bde-bcab-c108a01bab52","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:dabceae4b0328ad05b3aa8823f2169fa9d882367705a59cfbf183aeee52f0380","observation_id":"91cb461b-b5f1-4798-95d0-7329df8164fb","resolution":{"observed_at":"2026-05-20T12:23:17.165840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8a68b669-ae02-482a-9ccf-d685cefd6cec","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:37d5b1070919bb3495eef4e23f27b4193906329c12d2e34d5c41017d239f09b9","observation_id":"55777f96-43ac-4b5b-b3ed-4596cba9b7f9","resolution":{"observed_at":"2026-05-20T12:23:17.149975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08105","last_updated":"2024-09-23T10:41:27Z","snapshot_observed_at":"2026-08-18T20:33:44.932427Z","submitted_at":"2023-11-14T12:05:45Z","title":"DiLoCo: Distributed Low-Communication Training of Language Models","version":3},"cited_work":{"arxiv_id":"2311.08105","doi":"10.48550/arxiv.2311.08105","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.08105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A., Chhaparia, R., Donchev, Y., Kuncoro, A., Ranzato, M., Szlam, A., and Shen, J","venue":"arXiv (Cornell University)","work_id":"035ce0b0-a340-41e2-9dd3-f381ed1d7f7d","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2311.08105","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:073db33379d02390534959ccad04c52e7d9aae9491904f0332420936a875a1f1","observation_id":"0dbb234a-1f2d-48ae-8b63-af31aca8ebeb","resolution":{"observed_at":"2026-05-20T12:23:16.790219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-02T01:38:25.681334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T01:38:25.681334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"B., Von Werra, L., and Jaggi, M","venue":null,"work_id":"774debf0-a0dc-4774-a5fe-5498b486cbcc","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:2cf7454775aa1e13b07acc72e547485e538aa4ee5562ecca9c7e6512fa050535","observation_id":"b0acc0f4-b37e-45fa-ad4e-a3143e20066c","resolution":{"observed_at":"2026-05-20T12:23:17.169909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A., Welbl, J., Clark, A., et al","venue":null,"work_id":"10395e61-4096-4ef9-8101-2e90e306cb5d","year":2022},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:d1f5cd25eb6393156118b93439aee0bc33fe27f926776d7355ea6de257d9fc5b","observation_id":"84d38130-1db9-4ada-8f28-4d553e6649bf","resolution":{"observed_at":"2026-05-20T12:23:17.167941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L., Wang, C., Yao, Y., Zhao, C., Zhou, J., Cai, J., Zhai, Z., Ding, N., Jia, C., Zeng, G., dahai li, Liu, Z., and Sun, M","venue":null,"work_id":"1c44b174-172e-43c4-887e-1c8eb6204d4b","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:9252c17aac63de7791183d85d4c0f08e1b1b124060e03fa9889eb12181c03e14","observation_id":"2936bc17-87e2-446c-9e7d-5dfdaf5ffbac","resolution":{"observed_at":"2026-05-20T12:23:17.148364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Y., Song, S., Hajishirzi, H., Kornblith, S., Farhadi, A., and Schmidt, L","venue":null,"work_id":"f508adae-f4b0-4ede-a8a7-bfaf8ff05814","year":2022},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:eaa4e287dcf3b10fe9511e0302d12ebcc3e7cfc9de5357df262cf2f3119141de","observation_id":"b4c9b867-cfd4-45fc-87d9-35064d885cf0","resolution":{"observed_at":"2026-05-20T12:23:17.171990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7d16e550-89b6-4b7d-b3ca-14e3282213ad","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:7246f9fee8f947021bd158f04bb645553a43205f66a781e36223edaa56f1c0e5","observation_id":"0d148fe7-b92c-4f65-9385-a829907babc1","resolution":{"observed_at":"2026-05-20T12:23:17.161680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"P., and Wilson, A","venue":null,"work_id":"5ae3431b-faa6-49f4-863c-f7cef79b5705","year":2018},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:59b72fba47280678be0e4182e06b545ed9690652d3d9424a6aa8a88d925a8858","observation_id":"b7f4c928-037a-4270-b8e3-30a99784c800","resolution":{"observed_at":"2026-05-20T12:23:17.152401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b76696b6-c59b-4519-9f19-d33f0ebf8f9d","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:872c4713b2623c10340b94e437247f25f5eccf51f0337074e3ad0fdf4854e3d1","observation_id":"d4b89dec-654d-439b-b89f-e94ee5e9d753","resolution":{"observed_at":"2026-05-20T12:23:17.176038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kimi k2: Open agentic intelligence","venue":null,"work_id":"9841bfe2-acbb-4bf3-a186-8aa5b7ed9a5b","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:8e697097788328eafeba89a052110f2d49adecb32145ca5d9a5362a3da590c43","observation_id":"44ba0cd3-7f79-4229-a831-f654aa624cd3","resolution":{"observed_at":"2026-05-20T12:23:17.157682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"08944b91-1ca8-4e2a-a848-7444806eaac1","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:ff36e6bc6eef326aefc2986a01b4b1c2277359adde71b22d9344ae8a574db3a9","observation_id":"1b7ef1d4-7864-4b08-8ebc-4ed80c18d576","resolution":{"observed_at":"2026-05-20T12:23:17.159582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2f2997c3-78f6-4832-8844-76e0f38c2ba2","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:dd4da1b2c3ea1c91b34848f4d94590ad27081579c3809a3b1ddb04f166e0d148","observation_id":"fe8d3f8c-bf10-4c8a-a37f-54e452f330b4","resolution":{"observed_at":"2026-05-20T12:23:17.115944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.03306","last_updated":"2022-08-05T17:46:38Z","snapshot_observed_at":"2026-08-18T13:05:31.068739Z","submitted_at":"2022-08-05T17:46:38Z","title":"Branch-Train-Merge: Embarrassingly Parallel Training of Expert Language Models","version":1},"cited_work":{"arxiv_id":"2208.03306","doi":"10.48550/arxiv.2208.03306","metadata_source":"arxiv_reference","pith_arxiv_id":"2208.03306","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Branch-train-merge: Embarrassingly parallel training of expert language models","venue":"arXiv (Cornell University)","work_id":"53f249ec-fe00-4890-9c6f-64582a367d17","year":2022},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2208.03306","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:9b222f5a93e0b1aa9f43fb50996826358e6ef3aacdfdd08238ebb5493d088490","observation_id":"6bef364a-0d99-4d45-9728-c51e1b4e1419","resolution":{"observed_at":"2026-05-20T12:23:16.769512Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12082","last_updated":"2025-05-22T09:35:43Z","snapshot_observed_at":"2026-08-20T11:24:07.465449Z","submitted_at":"2025-05-17T16:53:14Z","title":"Model Merging in Pre-training of Large Language Models","version":3},"cited_work":{"arxiv_id":"2505.12082","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12082","snapshot_observed_at":"2026-07-04T10:49:46.245243Z","title":"arXiv preprint arXiv:2505.12082 , year=","venue":null,"work_id":"a6b02b76-6c31-41bf-9706-2c3470dda4ad","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2505.12082","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:3e8498642c9ada15da0f3b5287ac65f4816bd2bb50852d8ca5c8c8587a73fd0c","observation_id":"cdfded52-de3c-4810-8fbc-99db82938247","resolution":{"observed_at":"2026-05-20T12:23:16.787163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"G., and Goldblum, M","venue":null,"work_id":"edee22d9-5c1d-469d-85c0-6b371db9f04d","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:634539adf71ea05ff6525dfeeb1d29cc0b096a8d9338caf297304d2bc916faba","observation_id":"b91e292f-a052-48db-bec8-8d44fccc014d","resolution":{"observed_at":"2026-05-20T12:23:17.141354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Defazio, A","venue":null,"work_id":"fcbcc38b-71b8-4933-9a0a-080964064ea9","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:c17a027b1e37178a50aa92d7f3ece078f9a689636affa0109a3baa76da3b4252","observation_id":"4316f2fc-8874-4984-a48f-0b40614f5866","resolution":{"observed_at":"2026-05-20T12:23:17.119631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02431","last_updated":"2025-02-04T15:55:35Z","snapshot_observed_at":"2026-08-20T06:32:09.127898Z","submitted_at":"2025-02-04T15:55:35Z","title":"Connections between Schedule-Free Optimizers, AdEMAMix, and Accelerated SGD Variants","version":1},"cited_work":{"arxiv_id":"2502.02431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02431","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.02431 , year=","venue":null,"work_id":"a0432b83-8f2a-45b8-a6a1-e2ca5c70e308","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2502.02431","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:259d4da7621c9fa810df29550f94d9ade912a1d2cf171f75bb1daef577f02e11","observation_id":"7a65891a-2c8e-4bd1-8f3a-d0181a590edd","resolution":{"observed_at":"2026-05-20T12:23:16.772543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., and Loizou, N","venue":null,"work_id":"70190180-38b2-47e1-8958-b9fb3e91c02c","year":2026},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:af8b7996f005096c871346e68f1733dc18dcc553f9faf625887b33e548b5d43c","observation_id":"ed81c561-74fd-4352-a034-78374cd98925","resolution":{"observed_at":"2026-05-20T12:23:17.144761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e67ba315-a498-4239-b842-4e1bf9696699","year":1990},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:f7e7e64a3733c4e04edd9cd84c9a4b381b9f0fae53e87c1761256c642c64b51d","observation_id":"de907a1a-828e-4ea9-98d9-838a7adff802","resolution":{"observed_at":"2026-05-20T12:23:17.138089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:a0c6ff67efa292c821b86bbcb5e1af1074a2e1c7559deb213ffad05f69d74be9","observation_id":"c9956c83-6e47-496f-addb-bb35e0b5c44c","resolution":{"observed_at":"2026-05-20T12:23:16.781464Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4e55e912-f91c-43a6-ba9e-21269b230355","year":1988},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:bd58940312549dff68baa1c69128ff4665d1b4cdba1344bd3d7941e3dc2274f0","observation_id":"75c2d1cd-fb9f-4fd3-8545-ef1179935678","resolution":{"observed_at":"2026-05-20T12:23:17.134338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02312","last_updated":"2023-02-01T07:08:58Z","snapshot_observed_at":"2026-08-16T16:04:08.479357Z","submitted_at":"2023-01-05T21:58:46Z","title":"Training trajectories, mini-batch losses and the curious role of the learning rate","version":2},"cited_work":{"arxiv_id":"2301.02312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.02312","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"439ae8bd-7e78-46c2-9547-75d68c69514b","year":2023},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2301.02312","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:caf06a0bde9cda8d236f74c1bbed2f6543ce8c089a59198355d19c0960b97db6","observation_id":"8bf73e49-b023-47a1-b2f6-0d8210f4ed28","resolution":{"observed_at":"2026-05-20T12:23:16.784243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"db801292-1191-4f41-b6cf-1263294eeeb7","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:4eeb106befd163a08f5c5bfa4f974563f1cb018de230482b34ed936b7b5b5641","observation_id":"c68cede9-ef1e-412f-920d-192394cf9aed","resolution":{"observed_at":"2026-05-20T12:23:17.123073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"J., Lee, J., Antognini, J., Sohl-Dickstein, J., Frostig, R., and Dahl, G","venue":null,"work_id":"d57fcfeb-e59e-4dd2-8834-600bbd585ab6","year":2019},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:d4f13e0a0eed406244d2c547ee4237f3b9a0fd7345bf26bcf8dcd1c6d024a642","observation_id":"c0fd6f55-5db4-425a-99a9-f2636a113bce","resolution":{"observed_at":"2026-05-20T12:23:17.132311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Zhang, T","venue":null,"work_id":"7bdde48a-fd1d-4a58-8198-84ee71556cd9","year":2013},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:fae08d36d5006c270170d2aee69336fc4a31d54cca2754b469bcc2e1157d8b23","observation_id":"14ba67c3-f01e-4c4c-91dd-548d13840d55","resolution":{"observed_at":"2026-05-20T12:23:17.124973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Edelman, Y","venue":null,"work_id":"77c3d9f9-92e3-4fe6-8eaa-d5504e91f01f","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:1c573e0e200e3f1554135d80210a494cb7cd81711641f39a1ff008ecfea9c676","observation_id":"4afa78d9-076f-4230-9400-f919adc8a20e","resolution":{"observed_at":"2026-05-20T12:23:17.121224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9d0638a4-f3d5-41ce-9d6c-71c5d9b58647","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:88f046ade97b954d69ff280260a2e8de265aadf5c2c78d4b1064193f14cb9e53","observation_id":"58a6ccf4-45e4-43ae-95ed-531f315e4c04","resolution":{"observed_at":"2026-05-20T12:23:17.128815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05350","last_updated":"2017-06-16T17:08:08Z","snapshot_observed_at":"2026-08-16T22:00:20.852295Z","submitted_at":"2017-06-16T17:08:08Z","title":"L2 Regularization versus Batch and Weight Normalization","version":1},"cited_work":{"arxiv_id":"1706.05350","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05350","snapshot_observed_at":"2026-07-04T20:30:07.604801Z","title":"L2 Regularization versus Batch and Weight Normalization","venue":"cs.LG","work_id":"17e14df7-cc67-4fa7-b09c-4bc22ea9e76a","year":2017},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/1706.05350","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:787489736646b87d1bd96c9eeecb10fd7a77916b021307d9fcf515a9f90326e9","observation_id":"f46ce5b8-436a-48c6-87d8-5c8dfaa162c9","resolution":{"observed_at":"2026-05-20T12:23:16.778398Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"S., Hall, D","venue":null,"work_id":"6b02516c-9a44-49fb-9267-eca82f48cb07","year":2025},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:0b740a299b4faf66fc53bb3f3e8b870806763960711e9abb4ca179d00a136576","observation_id":"0445dc34-54a2-4baa-a569-07c7493de4a4","resolution":{"observed_at":"2026-05-20T12:23:17.143051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Y., Roelofs, R., Gontijo-Lopes, R., Morcos, A","venue":null,"work_id":"02ef0556-5b95-46d3-834f-b6c30b3ef0d7","year":null},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:f56413501c4c97a07b97f75d7727ed75c615b004d45c4b87e94073f0d3b8223b","observation_id":"e678cf7e-5390-436c-b6d0-ce3533378950","resolution":{"observed_at":"2026-05-20T12:23:17.127064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"W., Li, M., Kornblith, S., Roelofs, R., Lopes, R","venue":null,"work_id":"4cf3cb06-c03b-44d9-898f-652995ea9501","year":null},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:2bffefdd04258e4e92989fd231ba81987d577a2bdfeef33d80dcf8414eba0e4e","observation_id":"d196e8c2-a082-4c87-a5c2-f1ba90c361ad","resolution":{"observed_at":"2026-05-20T12:23:17.146508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17c9bfec-e70b-4613-9892-90e503c368fd","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:e3f957aa923d811bb3b6c1a37ea5c740ec384f6e12d40dab481989a668a7a696","observation_id":"b5c182e1-e319-4d86-832f-1c9938afd0cf","resolution":{"observed_at":"2026-05-20T12:23:17.130491Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6e978b2-0f80-4ee7-a92a-916b9e693404","year":2022},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:7b4580352fcf73ba2b5b4818112ae5f61ad80b5e4aefc98e7f05e8ca053021ed","observation_id":"1eb7f267-7b21-453a-974e-23c92b9f625b","resolution":{"observed_at":"2026-05-20T12:23:17.117969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"62b8b555-8b80-4c3d-8ed5-99a81cc1adad","year":2019},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:a143a46ae31647e6d12534bd3a74e53d7d07203bb9e7b8da4ceacbfbf1d8c9fc","observation_id":"49896bf3-1d00-4159-a313-1f2f5542776f","resolution":{"observed_at":"2026-05-20T12:23:17.136296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21676","last_updated":"2025-04-21T04:19:56Z","snapshot_observed_at":"2026-08-16T13:05:08.265484Z","submitted_at":"2024-10-29T02:54:06Z","title":"How Does Critical Batch Size Scale in Pre-training?","version":4},"cited_work":{"arxiv_id":"2410.21676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21676","snapshot_observed_at":"2026-07-03T23:59:07.430461Z","title":"Zhang, D","venue":null,"work_id":"ff070f01-8558-4662-ade8-c1a10ea2423f","year":2024},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"cited_paper":"/paper/2410.21676","citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:797fe7ae8601ee77b90379cc60b7983fb21134a0b1ffa2a762201da8724e3267","observation_id":"dcfc156b-b9a1-4849-a977-f084f4a441a1","resolution":{"observed_at":"2026-05-20T12:23:16.775669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9430729f-2907-4751-acc8-6c8190552102","year":2003},"citing_paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-20T12:22:30.263086Z"},"links":{"citing_paper":"/paper/2605.19095"},"observation_digest":"sha256:2edea4f70ccc29278a89a035fc917a42dc90edcdad085e70fd7319d32bb84c48","observation_id":"f5caaac6-4377-48df-b821-49ac04f952f4","resolution":{"observed_at":"2026-05-20T12:23:17.139654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.19095","last_updated":"2026-05-18T20:31:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T16:01:10.130690Z","submitted_at":"2026-05-18T20:31:49Z","title":"ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":16,"verified_exact":7,"verified_fuzzy":18},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2605.19095."}