{"as_of":"2026-08-08T09:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b62f35ae6b4ff3d9ba1832dded84e0a34694f7cea083c4cf72da0cc3b8a2777","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:56:28.113429Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T02:14:38.644041Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T12:16:57.398617Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"cited_work":{"arxiv_id":"2502.09376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09376","snapshot_observed_at":"2026-07-02T12:16:57.398617Z","title":"arXiv preprint arXiv:2502.09376 , year=","venue":null,"work_id":"47ee7338-4ba9-47f0-b152-5455c69a7071","year":2025},"citing_paper":{"arxiv_id":"2605.07959","last_updated":"2026-05-08T16:22:08Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T16:22:08Z","title":"Convergent Stochastic Training of Attention and Understanding LoRA","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-11T02:48:35.907351Z"},"links":{"cited_paper":"/paper/2502.09376","citing_paper":"/paper/2605.07959"},"observation_digest":"sha256:11c58aae36a1f525d1f2014d33b74145f1a5883d3359bd187fd640382f81ec75","observation_id":"4ba7e21e-97fb-462b-a8b5-5eadba40b672","resolution":{"observed_at":"2026-05-11T03:05:55.048780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"cited_work":{"arxiv_id":"2502.09376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09376","snapshot_observed_at":"2026-07-02T12:16:57.398617Z","title":"arXiv preprint arXiv:2502.09376 , year=","venue":null,"work_id":"47ee7338-4ba9-47f0-b152-5455c69a7071","year":2025},"citing_paper":{"arxiv_id":"2606.05899","last_updated":"2026-06-04T09:05:59Z","snapshot_observed_at":"2026-07-06T23:45:51.910263Z","submitted_at":"2026-06-04T09:05:59Z","title":"High-Dimensional Theory of LoRA Fine-Tuning in a Solvable Attention Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T02:14:38.644041Z"},"links":{"cited_paper":"/paper/2502.09376","citing_paper":"/paper/2606.05899"},"observation_digest":"sha256:3b3477648890f0f3acc00a9b5beda05c10a774e84aeed01b18e8779ad7bfb8cb","observation_id":"0c9f8c0a-a952-4bc6-a56e-9d6b44369933","resolution":{"observed_at":"2026-07-02T12:16:57.400233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09376/citation-record","integrity":"/paper/2502.09376/integrity","json":"/paper/2502.09376/citation-record.json","paper":"/paper/2502.09376"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:27.899907Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.899907Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:87ce71f822d0e653551b67d643170869e01ee6da30c28f44942ba8fc31f9407e","observation_id":"e692fd8d-1ba8-49e4-b864-3ed36e885fa7","resolution":{"observed_at":"2026-08-07T21:56:27.899907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.807500Z","title":"Intrinsic dimensionality explains the effectiveness of language model fine-tuning","venue":null,"work_id":"4c1bd97c-5ff6-4d53-94e3-28f8ed5e0e1a","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.906207Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:806d948dc3940062dbe257c4e0f4d104afddbb3e38b6df9309c317acc522067e","observation_id":"5f35f5a6-f48e-423f-a14d-9becfefb8db4","resolution":{"observed_at":"2026-08-07T21:56:28.812312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.792193Z","title":"B it F it: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":"0550c707-a05e-43bc-8644-54aa4295ddb2","year":2022},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.911127Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:8bdf2408519167fc623d96263cc0a34acbb667ef3e4ccbdfe54e4dc9480fd23a","observation_id":"354e09e1-7b1e-4b23-96e6-2ddfaf24f344","resolution":{"observed_at":"2026-08-07T21:56:28.797593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.777506Z","title":"Global optimality of local search for low rank matrix recovery","venue":null,"work_id":"f17b3df0-8e96-4863-94c5-02638a6f3b86","year":2016},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.916668Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:0df8a50d744022aa0d439fcc03d7d51ac183b07c43fd46ed0a9ab30792f69b4a","observation_id":"fd86df65-7367-445a-9fbe-0ae25ad9de1a","resolution":{"observed_at":"2026-08-07T21:56:28.782377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.762622Z","title":"and Monteiro, R","venue":null,"work_id":"989dd37f-5aae-4997-8b42-de041f8cccb4","year":2003},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.922243Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d3a6da714fa50db86d647c5de9ec21ef14db45dcdded7f93e4f6d80eba4eb246","observation_id":"cd6d59e4-768d-4e1d-8ef3-3e13a64bbe81","resolution":{"observed_at":"2026-08-07T21:56:28.767377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.748287Z","title":"P., and Bernardino, A","venue":null,"work_id":"b07bb2c2-df65-490f-abef-351b0e9313d1","year":2013},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.927203Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:4623ef69e3a4f08f88b2f0d4ab839c64c169db5663c5a7d099050f117f03f6e7","observation_id":"e06c3974-09de-4777-b4ff-e8b1bff34cc0","resolution":{"observed_at":"2026-08-07T21:56:28.752771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.734136Z","title":"and Recht, B","venue":null,"work_id":"c4be151e-f7b1-4efd-a5ec-ad8df8012eca","year":2012},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.932414Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:0b7d624646d015d1618dbe263e2e7300c985711c470e0fef5b50d63c41b275dd","observation_id":"3e580b70-3f66-4966-82aa-c68ca4231d37","resolution":{"observed_at":"2026-08-07T21:56:28.738862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15385","last_updated":"2024-11-23T00:00:28Z","snapshot_observed_at":"2026-07-06T19:55:51.415524Z","submitted_at":"2024-11-23T00:00:28Z","title":"Gradient dynamics for low-rank fine-tuning beyond kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15385","snapshot_observed_at":"2026-08-07T21:56:27.937594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.937594Z"},"links":{"cited_paper":"/paper/2411.15385","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d735764affba26c61e64c1d671a07f3b444f3d39a77fd8fac3863a961f92f535","observation_id":"98c220fe-5550-4078-a9af-aa78bbf0f120","resolution":{"observed_at":"2026-08-07T21:56:27.937594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.719696Z","title":"QL o RA : Efficient finetuning of quantized LLM s","venue":null,"work_id":"6af932b2-6072-491a-aec2-1c96fa7d3200","year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.942697Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d5f56303e35b76fca00a881b7ba5633c26f0a69654266bc579eb668c75addeea","observation_id":"0114dca8-2941-4a94-b09b-38435dd18298","resolution":{"observed_at":"2026-08-07T21:56:28.724370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.704301Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"5c60594c-12f4-443d-9926-9fca073f4047","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.947515Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:75468950438574969cb98b6c058b4ee6fa32621b7e34d1ed13987f00e6d66c15","observation_id":"7e6d0f35-5b82-448b-aafe-d56d436a9f58","resolution":{"observed_at":"2026-08-07T21:56:28.709190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.689386Z","title":null,"venue":null,"work_id":"35c87296-0624-466a-b2ca-b98b53faab4c","year":2001},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.952364Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:bfda6b75a4ffe02b16013c54c58436ee0b3f0177574f28e3c4e6bc89b0768748","observation_id":"c50a52c0-0a2a-49b6-8ca3-f88ec042fcdc","resolution":{"observed_at":"2026-08-07T21:56:28.694097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.674540Z","title":"S., Gupte, A., and Poggio, T","venue":null,"work_id":"15e3d878-a444-40f7-8134-2ce32bf6a728","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.957464Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:8da9a3c7eaedf3ab4496e950330f9e2fa1cd8ab57d5b1fe998c62ef37ab63c55","observation_id":"cae99a14-a724-42e8-a266-1b6ac3e5f5ec","resolution":{"observed_at":"2026-08-07T21:56:28.679582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.659388Z","title":"Escaping from saddle points --- online stochastic gradient for tensor decomposition","venue":null,"work_id":"dc0ff1aa-0db0-4dbe-b963-6c982393cd41","year":2015},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.962169Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:30ebbcddd3ee2705594419ceee32c2e5e4015f4eda5ebe29e1e1495e2b79b92a","observation_id":"91e3008a-c7d3-4b87-94dc-9340e658ead4","resolution":{"observed_at":"2026-08-07T21:56:28.664330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.643451Z","title":"No spurious local minima in nonconvex low rank problems: A unified geometric analysis","venue":null,"work_id":"c01b3c2d-d9aa-4458-abc6-87876e123232","year":2017},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.967014Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:8ad81277e81b94b5452984cce6da8b5bb16b0e7cbca2faad2e6f398fb1a2bfe8","observation_id":"017794ee-b27e-40d0-80fe-647da8a56313","resolution":{"observed_at":"2026-08-07T21:56:28.648522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.627304Z","title":null,"venue":null,"work_id":"e0bfdb3f-f30f-4e26-87c0-00fd32759185","year":2020},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.971546Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:8d7bc5e94b69126f306592c68e51c274ee826567cff432cc5cdb44d9baa73787","observation_id":"12ac7549-30c7-4280-8023-943184755ac3","resolution":{"observed_at":"2026-08-07T21:56:28.632480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.611119Z","title":"LoRA+ : efficient low rank adaptation of large models","venue":null,"work_id":"791d1b24-60ce-463e-a4c8-aee084386453","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.976368Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:4970bdf44286f4d2df08e96f35054ca243afc2bfe7f72dc0fc2d0334d8b244a3","observation_id":"62ab7258-c005-4f8e-8ebc-cd993b190924","resolution":{"observed_at":"2026-08-07T21:56:28.616156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.596089Z","title":"J., yelong shen, Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":"b8979996-5481-4ab1-b290-f58379686f68","year":2022},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.981130Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d6f4a003798330a822b054699b2529933d26aba11e63dbcd8f8a4e32cd079c73","observation_id":"9d39d05b-8049-47b0-bacb-1de7a9f080a9","resolution":{"observed_at":"2026-08-07T21:56:28.601034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.580792Z","title":"Low Rank Regularization : A review","venue":null,"work_id":"67fc55b4-ba98-4800-a158-dbf7d16a2d3e","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.985546Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:99389ebe30b25602dac4ffdbd2535ceb4d19ff2efd555b9c06fadc7c9f2f05b3","observation_id":"30783878-c28c-4028-86a6-674d4354f617","resolution":{"observed_at":"2026-08-07T21:56:28.585418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.566052Z","title":"D., and Ryu, E","venue":null,"work_id":"fb1cb110-aab4-408a-b9ea-c2a9371b3eb1","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.990523Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:49b20e5ffc184afb486e96d191cd3db880217c09ccbf9021095bcfad7d0ff323","observation_id":"4fab97aa-446b-4d8d-a51d-f0c629f4c786","resolution":{"observed_at":"2026-08-07T21:56:28.570896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03732","last_updated":"2023-11-28T03:23:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T03:23:20Z","title":"A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03732","snapshot_observed_at":"2026-08-07T21:56:27.995531Z","title":"A rank stabilization scaling factor for fine-tuning with LoRA","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.995531Z"},"links":{"cited_paper":"/paper/2312.03732","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:dc3f8c0bab4317acf72d3c54fc1b55258c0039b4063e83479c2345fdc2e10ef0","observation_id":"416b7158-9c77-4b75-acdb-502bbb439a5b","resolution":{"observed_at":"2026-08-07T21:56:27.995531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.550956Z","title":null,"venue":null,"work_id":"373c260c-f02f-4a0b-8f27-9bc7a1acd714","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.000578Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:e7d98060dcf5dbb78200dd76a8c11905d06a7aca8ee1ffeaac810e074cef7342","observation_id":"0ff75e8d-3568-4ada-b755-63560221e9ba","resolution":{"observed_at":"2026-08-07T21:56:28.555961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.005302Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.005302Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:600ac633c8bff9d7d90bfc49e9dc403995620d1786e2028cf1678cc9508a7b45","observation_id":"ada2276f-4090-4e46-9bee-6286ed4e5a13","resolution":{"observed_at":"2026-08-07T21:56:28.005302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.526372Z","title":"D., Simchowitz, M., Jordan, M","venue":null,"work_id":"9bfb3fd0-b0e7-4b3c-bb61-1476c02783bd","year":2016},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.009859Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:ac87c91a6ff6e097aa3ac1cd3e5c744abc1d7f0ae715782e05aa4c351d06e3c0","observation_id":"5de2cea3-9444-4f8c-93e7-2b4bdf7810d5","resolution":{"observed_at":"2026-08-07T21:56:28.530964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.511706Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":"6f62e8fc-9cd8-4c65-86c7-d4f2d54ef993","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.014448Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:a73409d760a748fbe73afdc4a3464ae98413ef691193533829f45186c6de71f5","observation_id":"a38e8f7e-12c7-43a7-a56b-2f63d781f076","resolution":{"observed_at":"2026-08-07T21:56:28.516380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.497032Z","title":"Measuring the intrinsic dimension of objective landscapes","venue":null,"work_id":"ac2e927f-9554-4b90-8ff9-fadc66d5746c","year":2018},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.020191Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:5676b021d9b4039b8ac58e7993fb32e481e5d04793ca2bf19f8f0d56284b4c27","observation_id":"fe869634-a126-4574-b228-e538d3b8d1fd","resolution":{"observed_at":"2026-08-07T21:56:28.501808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.482277Z","title":null,"venue":null,"work_id":"5939e5a5-add7-4c64-b039-4116a726ab3e","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.024841Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:acb667b3005b0bf66052247569ecc2f7ff283af9fdec16b741a40dcf6f5440ce","observation_id":"a885dbf8-3e97-4355-b330-55683f191372","resolution":{"observed_at":"2026-08-07T21:56:28.487069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.466842Z","title":"A kernel-based view of language model fine-tuning","venue":null,"work_id":"cca79856-084a-45fa-8493-0b4b515adff8","year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.029568Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:b120be3b5f622af3140f843be94b5df1921ba748f3c4ff5c755209ab0e973179","observation_id":"62e0fc89-f368-43b7-9052-d4add531312a","resolution":{"observed_at":"2026-08-07T21:56:28.471798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.451460Z","title":"Pi SSA : Principal singular values and singular vectors adaptation of large language models","venue":null,"work_id":"a138a68b-7d2c-41f4-9d45-e7e22c7bc125","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.034518Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:074f731a77c549427c6a5cafaf4ca75c29662e7233bbc874cba8a5ba3c616d74","observation_id":"01321cd3-d9b4-4f00-872b-47263ca9aadb","resolution":{"observed_at":"2026-08-07T21:56:28.456540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.434987Z","title":null,"venue":null,"work_id":"89cade65-4aa4-4d37-b0ac-c6174a635e64","year":1995},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.039307Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:81aa83bce90423d067bfe46bc044fa8ccf330c5ae4833620a47ad1f414f2ea5d","observation_id":"53222814-a074-4fe6-bb97-c9f8ece95353","resolution":{"observed_at":"2026-08-07T21:56:28.440247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.419488Z","title":"and Boyd, S","venue":null,"work_id":"37dff93b-3c97-40b8-961f-5a4a73861411","year":2014},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.044281Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:6dcf29b6d63703895954a5e94101d04b0b30916994420b22d9a5836e51015cc9","observation_id":"c86a463b-5ff5-4562-9603-1fd1fc82901a","resolution":{"observed_at":"2026-08-07T21:56:28.424465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.403010Z","title":"Non-square matrix sensing without spurious local minima via the B urer-- M onteiro approach","venue":null,"work_id":"d2f3c150-5133-4b82-be94-5f6ee47d2d00","year":2017},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.048937Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:e5a5efbf2e28598bc1aeabf08476355308d59cc214632fbaa8dab2e714fd5112","observation_id":"3375a43c-ca55-4edf-9cc8-502f574c0119","resolution":{"observed_at":"2026-08-07T21:56:28.408667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.387944Z","title":null,"venue":null,"work_id":"a6398c1e-85f2-4922-946b-7375c5d84036","year":2010},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.053630Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:78865d08207efa171a6a926b59dcc647d61e53f6003a34a4d74d50547a392725","observation_id":"8889ed63-315e-44d9-adf7-ad019701345c","resolution":{"observed_at":"2026-08-07T21:56:28.392727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.370279Z","title":"D., Ng, A., and Potts, C","venue":null,"work_id":"c3411920-e27e-40c4-b121-b6f2ffc1b307","year":2013},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.058145Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:62727b0bb89aace5bde4b127ad014f1e472591fa5430bdcc38eb3184d61cc786","observation_id":"ac0b48d3-9b3b-4e98-8fd6-b7b68f15536d","resolution":{"observed_at":"2026-08-07T21:56:28.375214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.355596Z","title":"and Sato, I","venue":null,"work_id":"1dac31b6-b8a2-4516-9f6d-ce142256744f","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.062756Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:3ed17dd39527b245d5c6c8d337a4395b6fb2deb9159564ad689d46f1fffda7ea","observation_id":"b3e8238e-5eb3-4d94-b243-d2f9cc0d6c99","resolution":{"observed_at":"2026-08-07T21:56:28.360267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.340348Z","title":"GLUE : A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":"f7f3e9ab-6207-4ad2-a04d-9a331d93ba48","year":2018},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.067134Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:8052e44f1cddf84745020f241933e7d64ac745dbf67ed80f56dbcfb717683e5e","observation_id":"b40947ee-a377-45cb-a724-b6f05e57a5ec","resolution":{"observed_at":"2026-08-07T21:56:28.345341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.324714Z","title":"M i L o RA : Harnessing minor singular components for parameter-efficient LLM finetuning","venue":null,"work_id":"5b3d4518-096d-4012-810f-f6ca11475084","year":2025},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.071846Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:ebab33c26f78fcf9b0c5680d7f48a6f8a0bdeff32a4fbd76fead2cf25b1dcc0a","observation_id":"477deed3-5f96-4764-a0a5-4a4a73a674d5","resolution":{"observed_at":"2026-08-07T21:56:28.329656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.308899Z","title":"and Jacot, A","venue":null,"work_id":"95d8a0d0-0756-444a-8b12-e87bbfa4c145","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.076380Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:2cfd1066eab414d81b8ba2d952232fc08447519ea60ad02c47e3701b945167d4","observation_id":"f8ca8107-1019-441d-bed4-f323b40f5527","resolution":{"observed_at":"2026-08-07T21:56:28.314361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.293107Z","title":"How over-parameterization slows down gradient descent in matrix sensing: The curses of symmetry and initialization","venue":null,"work_id":"b4a53c03-e385-41ee-9eb0-77a89ea7aa3c","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.081070Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:629a10a6a882681479644a982fc073db0cc0f4e99e93e1d3d1b1d72d699c4259","observation_id":"85f87de4-738a-4589-b1fc-ec1091800e4a","resolution":{"observed_at":"2026-08-07T21:56:28.298215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.277132Z","title":"and Du, S","venue":null,"work_id":"ed47137a-3ddc-4358-b6fd-898f7c7d84d1","year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.085615Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:789de3a8bf4f6a8fc6f22d64b743cef5b3fab6b92ec53b9f82fd4d992ce7397b","observation_id":"de271249-a669-44dd-a697-090ff8b481f9","resolution":{"observed_at":"2026-08-07T21:56:28.281989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.260713Z","title":"and Lee, K","venue":null,"work_id":"d576a2d8-e5e9-4617-9fde-4f06b0ec7fab","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.090302Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:b2dcfc08f463dd3805ccc0bb1033eb7afc1c9e8237bb22411d7c3c55a0cd6579","observation_id":"c9409d36-1580-4f62-9fe4-d2cde2b899c8","resolution":{"observed_at":"2026-08-07T21:56:28.265706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10790","last_updated":"2025-05-06T17:29:39Z","snapshot_observed_at":"2026-07-06T11:02:35.284943Z","submitted_at":"2021-04-21T23:07:18Z","title":"Sharp Global Guarantees for Nonconvex Low-rank Recovery in the Noisy Overparameterized Regime","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10790","snapshot_observed_at":"2026-08-07T21:56:28.094778Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.094778Z"},"links":{"cited_paper":"/paper/2104.10790","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d5f927f208a645f8535e331ebb69ec1f3565a650a03dee00d0a7bc5f06af030c","observation_id":"85bf6b30-e480-4139-9ae0-99e21e6a5400","resolution":{"observed_at":"2026-08-07T21:56:28.094778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.245355Z","title":null,"venue":null,"work_id":"25b75efc-d535-4147-9320-8ad6eb9043ef","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.099545Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:101183d367bc3bcf981d403bd5284d9ec86f73c82cc8c370291eaf8d92026ad7","observation_id":"224d6510-8743-4e55-a701-f9e367683784","resolution":{"observed_at":"2026-08-07T21:56:28.250106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-03T17:13:44.553385Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-08-07T21:56:28.103866Z","title":"One-step full gradient suffices for low-rank fine-tuning, provably and efficiently","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.103866Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:e88c8c6fba95cf12a5d87470e479728407e88a0951071dd1bec4461df6cf5fa5","observation_id":"697a3dbe-9bbf-4765-b1d1-41004303ff33","resolution":{"observed_at":"2026-08-07T21:56:28.103866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.229753Z","title":null,"venue":null,"work_id":"34fa4bc5-f0e1-4e1a-8aa5-a17b6356fb78","year":2018},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.109040Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:ffbd00a3ad340975ec0c925e037880612adb5ac97d77dca51322cd5f7ecb0ece","observation_id":"54a33de9-664a-46f0-b306-8939139093f2","resolution":{"observed_at":"2026-08-07T21:56:28.234701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.211682Z","title":"A robustly optimized BERT pre-training approach with post-training","venue":null,"work_id":"d40f8111-1a58-4ba7-b845-b67c24391a8d","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.113429Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:20da0f5ee6c07cfa2bc6e8efb3157be3599547a77d9b86b91d5cfb14a74833c1","observation_id":"60523968-22e0-4d39-ab4c-e74ca3149161","resolution":{"observed_at":"2026-08-07T21:56:28.218464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T21:40:18.100891Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2502.09376."}