{"as_of":"2026-08-11T06:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f0e4d1ec020b0250b977b7349f66397c36516e34dbcb4956490cde3cf4bcb07","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T03:50:43.744189Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.21292/citation-record","integrity":"/paper/2605.21292/integrity","json":"/paper/2605.21292/citation-record.json","paper":"/paper/2605.21292"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agarwala, F","venue":null,"work_id":"69f2fef1-4551-4b79-9121-cb78176c782b","year":2023},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:11a982fb1948f215dd99f3472445dfd5dc5904b654fc8b524910faf18ec18a7c","observation_id":"f5d209e1-5601-4424-844f-0e06e7549681","resolution":{"observed_at":"2026-05-21T03:54:31.928482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arora, Z","venue":null,"work_id":"01adb6cc-64d3-4909-8222-10e3f82ddaa2","year":2022},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:8f65c0df279db212dc583692052590d3c0a734ee9bc6e160411218cab680ad6a","observation_id":"bdd73763-e1bb-4e45-a816-2ceab5aa52e8","resolution":{"observed_at":"2026-05-21T03:54:31.943368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chen and J","venue":null,"work_id":"794ca954-a152-4bf1-b923-4b8e3be578de","year":2023},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:6f046984a25cf4ee80443fea2cf8009b3d992866324f0a1237c87ecccd0d91d7","observation_id":"1d8415ba-7b8d-424d-82d1-ea87533ef884","resolution":{"observed_at":"2026-05-21T03:54:31.930502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83575c3f-19f3-4fd4-9da9-fabf823ada88","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:b03e0504980ef0b25195f6e935be687d58984b38dab220e45336ae8af64e6a07","observation_id":"d4fb99a7-3ab1-4129-9b1d-1c562c2dbf86","resolution":{"observed_at":"2026-05-21T03:54:31.932515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cohen, S","venue":null,"work_id":"e1bcfd0a-0b58-45ed-a560-07617c8f33eb","year":2021},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:6eea57ee160049613ba8fff9892c19518e79b1ed627829b7224426905b007689","observation_id":"e7a35c0b-6cda-44f4-99ea-2db1ff6314fb","resolution":{"observed_at":"2026-05-21T03:54:31.934356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Damian, E","venue":null,"work_id":"16bc20db-0abe-4a13-a602-dad24de35303","year":2023},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:3c8455deec04c6586aea6540e95a8477ba4587e0c4632db2bbbcb3d7860328a9","observation_id":"5ea17e0b-1bf7-4d11-a7ee-44162f2fddd9","resolution":{"observed_at":"2026-05-21T03:54:31.936364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c7207e3f-23a9-45fc-9159-67a3e0d86891","year":2003},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:fd63fa02c6b9f6825fbcebdc7fa61c52c869221c14725533fd82c1e3bda08472","observation_id":"b3b19251-28bc-4501-a3f6-9b6c412c0732","resolution":{"observed_at":"2026-05-21T03:54:31.938089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gilmer, B","venue":null,"work_id":"d140e46b-3765-4fb1-9b54-a275c9c1ae01","year":2022},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:17bf0d4d671ad7ff6befc10dcc5ac963d66590fbc73285fd47b6dd63be4d3e4a","observation_id":"983885b9-19bc-40ac-b019-3ca990ae1752","resolution":{"observed_at":"2026-05-21T03:54:31.922460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Herrmann, M","venue":null,"work_id":"09032713-113e-471d-9520-eee69aebe204","year":2022},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:ba39e40e7ce2a73ab31f8fd9928140fae10f543cdaedb762b5d0f263d71e2515","observation_id":"6fd1fdbb-de70-4451-a651-f33f353957d4","resolution":{"observed_at":"2026-05-21T03:54:31.924479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kodryan, E","venue":null,"work_id":"f98d5510-bd73-4a93-bec2-517432d28cc6","year":2022},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:0a9cf44685115deb293b71f0edca30a3cf373a644fbe2b97b396007f225d6fb5","observation_id":"b51800bb-ebf5-4b23-a801-d8fc0c630322","resolution":{"observed_at":"2026-05-21T03:54:31.926598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kong and M","venue":null,"work_id":"8ad97d2b-1e4e-4237-be1a-5b422f348275","year":2020},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:299ef8c7c64636be4f4d843d592d527ff9d2089ea7235532a66917b53e48ca60","observation_id":"53651514-6e85-46ac-9462-31e468b4cc65","resolution":{"observed_at":"2026-05-21T03:54:31.913473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02218","last_updated":"2020-03-04T17:52:48Z","snapshot_observed_at":"2026-08-08T21:43:40.840815Z","submitted_at":"2020-03-04T17:52:48Z","title":"The large learning rate phase of deep learning: the catapult mechanism","version":1},"cited_work":{"arxiv_id":"2003.02218","doi":"10.48550/arxiv.2003.02218","metadata_source":"arxiv_reference","pith_arxiv_id":"2003.02218","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The large learning rate phase of deep learning: the catapult mechanism","venue":"arXiv (Cornell University)","work_id":"fdbcc7a5-2170-42dd-8424-9e228495e447","year":2003},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"cited_paper":"/paper/2003.02218","citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:7740d130043872e12bd1b7df9b38b877c7dc1ccf682ca3b96a43550b02df7791","observation_id":"d622889e-88bb-4c7b-a0d8-efc3a61dd255","resolution":{"observed_at":"2026-05-21T03:53:56.329810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-12T15:49:36.486557+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T15:49:36.486557+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liang and G","venue":null,"work_id":"ddd3dbc0-a71c-40fe-a194-67bd60312b73","year":2026},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:6f032dc17528555a69911323c2bef7d973f91a929c12f7265faea236ab306604","observation_id":"4c3c99f1-ca06-4919-85ba-8321b7375674","resolution":{"observed_at":"2026-05-21T03:54:31.920689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lobacheva, M","venue":null,"work_id":"63de0d2f-44e1-4a78-8ed7-9a737b127a7f","year":2021},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:3a266eec71d1bd99f96f0dc71f0246bbb5abc3697854a32e499b4dfb06128e09","observation_id":"dd47994d-6d3b-449a-a8b8-88eec03d2ec7","resolution":{"observed_at":"2026-05-21T03:54:31.940576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6458.1992","doi":"10.1080/10586458.1992.10504242","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":null,"venue":null,"work_id":"6186ee69-38c0-463b-a86c-9ae8092445e9","year":1992},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:854895d359894a1ff8123de7c70c92b749c59146dda87080363f59dfd187c7a4","observation_id":"7e81b792-66a6-48a9-ab5f-cf3553860d16","resolution":{"observed_at":"2026-05-21T03:53:56.123528Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T05:23:41.736878+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T05:23:41.736878+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s002200050018","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Communications in Mathematical Physics","work_id":"3fe9dec5-4ed6-43b8-8626-ef7e2b268193","year":2000},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:bb20cbe2c428bc8b03eba26ba2e3497e21b10a180a48dae83ca5153ecfec6041","observation_id":"6b683292-5b24-439b-80fd-83bd99316e61","resolution":{"observed_at":"2026-05-21T03:53:56.125643Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T05:23:42.095988+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T05:23:42.095988+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Song and C","venue":null,"work_id":"1ff5c9b5-eba0-474d-b62e-8dff0e308c2d","year":2023},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:cbccdd741a0012079551675bce6bad89290eeb7114e5299827686b6ee8daa3ea","observation_id":"91e3ef30-65cb-4858-ae65-0cca4258bddc","resolution":{"observed_at":"2026-05-21T03:54:31.905923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d7e7599f-d9da-4acb-ac4d-244b64491281","year":2022},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:40c21158617fe065f6fdf4f9e72c6b105fd9067e402825feb2cedd4a6666de6d","observation_id":"4f34c2fd-964c-446a-a1bc-98c45164c2e1","resolution":{"observed_at":"2026-05-21T03:54:31.911550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c4e5ffa-5b57-452d-8d92-43061871b409","year":2003},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:a388ca618c2ad2518258118f8c91fb4304a0e049c0dd0a8e087a091feb16f79e","observation_id":"ecba862e-689e-45a9-bdd4-b31f835b838a","resolution":{"observed_at":"2026-05-21T03:54:31.899755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wortsman, P","venue":null,"work_id":"056d1aa4-50ec-4db3-911a-3e175eec5351","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:c6f7e81beb6342b9c93cac53a8598449b0ad93bb92491430ae8362a542f130f2","observation_id":"8793b784-a621-4a2d-843d-9b08cde2db7e","resolution":{"observed_at":"2026-05-21T03:54:31.909706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"68643f44-9eb6-4fb7-af55-31ff4cb0acc3","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:174aaf0cfd63eff13783eb088b72d8a5048c099d28b8feca2bc19caf92959f94","observation_id":"965f02d2-fb2b-437c-b4cd-7458c5415c68","resolution":{"observed_at":"2026-05-21T03:54:31.895611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b0d47f20-aa9c-4464-9db1-2a0fdac40eb9","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:492ddb239e7edc2d8f6acffcf66b188de3e6cebf5740fcf2658e42ef1090c5e0","observation_id":"d82ddbac-7e15-4db4-83ba-8f9fb95c6f81","resolution":{"observed_at":"2026-05-21T03:54:31.916015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.02336","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T07:59:39.663525Z","title":"Large stepsizes accelerate gradient descent for regularized logistic regression.arXiv preprint arXiv:2506.02336, 2025","venue":null,"work_id":"3eca26bb-b43e-4dcb-8103-c3ac46b309e8","year":2025},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:efd41a243413efb3ddb8e78e1a9f40dce9a30e38b0c016d9cbab66126744db82","observation_id":"42d4ffa1-cfe9-40c3-8cb2-c3ce4d16f8aa","resolution":{"observed_at":"2026-05-21T03:53:56.332902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, H","venue":null,"work_id":"4ab82565-7925-49dc-a262-d4b74be6d14f","year":2022},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:f3c2eed2dc7773bc32ae1cbe8b64935c71b0506be9c94de20dad231dd145418e","observation_id":"19ab1d80-9d67-4d59-a516-132dc6fbf638","resolution":{"observed_at":"2026-05-21T03:54:31.918367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, S","venue":null,"work_id":"8e590ced-988e-4724-bfd9-6b1db0bd5242","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:d3ed68d51aca236900607f187bd814979cbe47b2ec782aa3c078d5ec77ec1783","observation_id":"1a36811b-dc62-4ba2-be37-6ffa5074c777","resolution":{"observed_at":"2026-05-21T03:54:31.901977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, J","venue":null,"work_id":"dc967cf6-3cab-494c-bb43-cbab7121d668","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:d2b6cb51fa619bd59f14a37049b303f257788b91b421b9065f5379bc2a6b26c1","observation_id":"9547e8c0-9bff-40d4-90d2-27e0efbf1716","resolution":{"observed_at":"2026-05-21T03:54:31.897615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04105","last_updated":"2025-04-18T03:35:46Z","snapshot_observed_at":"2026-08-07T16:08:25.523140Z","submitted_at":"2025-04-05T08:34:20Z","title":"Minimax Optimal Convergence of Gradient Descent in Logistic Regression via Large and Adaptive Stepsizes","version":2},"cited_work":{"arxiv_id":"2504.04105","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04105","snapshot_observed_at":"2026-07-04T07:59:39.677560Z","title":"Zhang, J","venue":null,"work_id":"f54e444d-feca-47b5-8387-1b42d922c3ad","year":2025},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"cited_paper":"/paper/2504.04105","citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:0823a3a234a18dbd5165baf032f851c478a55d3d9937b28ac20d8b43a36659fb","observation_id":"0cd64b23-46ab-4cc5-9a2c-20647501fa09","resolution":{"observed_at":"2026-05-21T03:53:56.335715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dfb74557-76c8-48fb-b25f-9fdaa9b22f11","year":2024},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:e27005e645cdc3fbc064a6a528a7d86797763bf14fc4ff2abe024ea4f5c3096e","observation_id":"b01e7d67-bf23-4204-b131-5071bdca4b56","resolution":{"observed_at":"2026-05-21T03:54:31.903886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c2f1106e-1557-4459-a89c-e96b79174d92","year":2023},"citing_paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-21T03:50:43.744189Z"},"links":{"citing_paper":"/paper/2605.21292"},"observation_digest":"sha256:77933a3df52cba8d518b74cb5573c719934e5913709860085702ec7eb6cb0dfd","observation_id":"6b9a881a-7b5b-4ea9-a771-998979ffe7b0","resolution":{"observed_at":"2026-05-21T03:54:31.907800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.21292","last_updated":"2026-05-20T15:25:13Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-01T20:42:28.027915Z","submitted_at":"2026-05-20T15:25:13Z","title":"Large-Step Training Dynamics of a Two-Factor Linear Transformer Model"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":5,"verified_fuzzy":16},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2605.21292."}