{"as_of":"2026-08-08T22:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e46595e2e26ce2849dd5036f3873806f4993e9142c6c25427de48778d86d5270","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:51:10.457246Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.07739/citation-record","integrity":"/paper/2502.07739/integrity","json":"/paper/2502.07739/citation-record.json","paper":"/paper/2502.07739"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T11:51:09.935617Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.935617Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:cd66cb777e3aa7b702fd234b5b4cbb4a203b23b9a689024891ae3dbc8dc8dc37","observation_id":"d78085e1-0f15-4c17-a251-65b1de83c4ea","resolution":{"observed_at":"2026-08-08T11:51:09.935617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17604","last_updated":"2025-08-19T19:14:56Z","snapshot_observed_at":"2026-07-06T18:20:52.408832Z","submitted_at":"2024-05-27T19:07:13Z","title":"LoRA-XS: Low-Rank Adaptation with Extremely Small Number of Parameters","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17604","snapshot_observed_at":"2026-08-08T11:51:09.942047Z","title":"Lora-xs: Low-rank adaptation with extremely small number of parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.942047Z"},"links":{"cited_paper":"/paper/2405.17604","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:da67a404421f65384ff2edcd9a77c9312caecbde9ac097cde51a7aa4a088bb2c","observation_id":"003ee60f-5673-4d56-a477-a643e2fd7e61","resolution":{"observed_at":"2026-08-08T11:51:09.942047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-08T11:51:09.948149Z","title":"Lora learns less and forgets less","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.948149Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:f963d60ef5faa997aef86035c0f8b5a3cffb939b502c26c9212ce413d2ec201c","observation_id":"9ca2d721-629a-4124-bc2b-51d635eccc00","resolution":{"observed_at":"2026-08-08T11:51:09.948149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-08T11:51:09.953937Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.953937Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:1a3b87966aa25ebf2613d2be1c2b5d0624df348873f3a0610ff8e79f82e298c7","observation_id":"2eef8ede-ca9c-493b-a11b-54fb3d867758","resolution":{"observed_at":"2026-08-08T11:51:09.953937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01775","last_updated":"2024-11-25T12:45:19Z","snapshot_observed_at":"2026-08-06T05:03:26.904729Z","submitted_at":"2024-06-03T20:37:27Z","title":"OLoRA: Orthonormal Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01775","snapshot_observed_at":"2026-08-08T11:51:09.959188Z","title":"Olora: Orthonormal low-rank adaptation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.959188Z"},"links":{"cited_paper":"/paper/2406.01775","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:a9ccc064963486a95672709d0b34f37650a256271c9489f35894aa361d982c1a","observation_id":"7ed829f0-8d4c-475d-8d88-f8bd760f3237","resolution":{"observed_at":"2026-08-08T11:51:09.959188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:09.966211Z","title":"Nonconvex optimization meets low-rank matrix factorization: An overview","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.966211Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:1462790fde130d766546d26ba5aacdda9a0c72b6feaa29f4f877677609893195","observation_id":"e3a2e738-3acc-45df-9555-dcd3f241ef68","resolution":{"observed_at":"2026-08-08T11:51:09.966211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T11:51:09.974232Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.974232Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:c376e94fd35565e3ee2dcb550bf81553f25733f47cc87c536175d25851732595","observation_id":"4f377922-c9ea-4771-b9cf-7c787e9f960d","resolution":{"observed_at":"2026-08-08T11:51:09.974232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.903768Z","title":"Metainit: Initializing learning by learning to initialize","venue":null,"work_id":"419ecf6a-9d35-4c7d-91ac-179cfe7bcc3a","year":2019},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.981609Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:35c413303cb1090b0ab74982518cc5fd59f14c26e8ad1de548e27863712f1c16","observation_id":"04a07925-a921-4de9-acd4-727ca4ebc31a","resolution":{"observed_at":"2026-08-08T11:51:11.910666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:09.987470Z","title":"The approximation of one matrix by another of lower rank","venue":null,"work_id":null,"year":1936},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.987470Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:45a6799330aa6bf150b7bdf431b674bd6e04568853f68b0d4a235d240a882416","observation_id":"1b9af9ac-46c9-4b81-812f-0fd32e2c7673","resolution":{"observed_at":"2026-08-08T11:51:09.987470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.871988Z","title":"Low rank adaptation for stable domain adaptation of vision transformers","venue":null,"work_id":"73062268-e8d0-481d-8e8e-e8ffb7a05e81","year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.995920Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:f0a69fac12c16e2b217bf57551dd280f352d8ed8aed2b3cda6e4390e265c2890","observation_id":"55270172-619f-4622-b037-69b06f973298","resolution":{"observed_at":"2026-08-08T11:51:11.878544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11444","last_updated":"2024-11-24T15:02:23Z","snapshot_observed_at":"2026-07-06T19:33:43.723135Z","submitted_at":"2024-10-15T09:48:03Z","title":"A Theoretical Survey on Foundation Models","version":2},"cited_work":{"arxiv_id":"2410.11444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.11444","snapshot_observed_at":"2026-08-08T11:51:11.388668Z","title":"A Theoretical Survey on Foundation Models","venue":"cs.LG","work_id":"45810347-b594-41a5-b834-648527814a4b","year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.007479Z"},"links":{"cited_paper":"/paper/2410.11444","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:584865058ca4281d9793cbd1ca2b6c8e4b840e89ee37c08b09d10fff0f678e42","observation_id":"363998b1-fdef-4514-9024-7338286c035d","resolution":{"observed_at":"2026-08-08T11:51:11.394978Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11778","last_updated":"2024-06-24T14:23:30Z","snapshot_observed_at":"2026-08-08T19:33:21.643418Z","submitted_at":"2024-02-19T02:08:09Z","title":"Towards Theoretical Understandings of Self-Consuming Generative Models","version":2},"cited_work":{"arxiv_id":"2402.11778","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11778","snapshot_observed_at":"2026-08-08T11:51:11.360934Z","title":"Towards Theoretical Understandings of Self-Consuming Generative Models","venue":"cs.LG","work_id":"efc701cb-ed60-4845-aa72-033d5b2e84cd","year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.017476Z"},"links":{"cited_paper":"/paper/2402.11778","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:77cbc0730a143635bd31e1318d902ec4bcb898d17bfd12cc80a5e2e31c0c1f4a","observation_id":"1f9eb1e0-4068-4d7e-8482-aca49966c0d8","resolution":{"observed_at":"2026-08-08T11:51:11.367432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.026624Z","title":"Understanding the difficulty of training deep feedfor- ward neural networks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.026624Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:fd1032d82cdf6489168abb7a296985ec2cabc3fbcf62a0b615da4adff67c00fa","observation_id":"06292aff-f686-4025-9956-db01956e5d61","resolution":{"observed_at":"2026-08-08T11:51:10.026624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T11:51:10.039299Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.039299Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:5b595865421e6c61cbfbcc7f68c8278bec36702c46a494d0d73094fd64b8a554","observation_id":"50844b88-a383-412c-8985-949153816344","resolution":{"observed_at":"2026-08-08T11:51:10.039299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08447","last_updated":"2024-06-12T17:38:20Z","snapshot_observed_at":"2026-07-06T18:29:49.284504Z","submitted_at":"2024-06-12T17:38:20Z","title":"The Impact of Initialization on LoRA Finetuning Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08447","snapshot_observed_at":"2026-08-08T11:51:10.047333Z","title":"The impact of initialization on lora finetuning dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.047333Z"},"links":{"cited_paper":"/paper/2406.08447","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:5d993b5b85888c781e73309c522eb277c97f25f698e62049f649ab47c7099e4e","observation_id":"8df582e0-ed47-4ba1-9433-599bbb0e72c0","resolution":{"observed_at":"2026-08-08T11:51:10.047333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12354","last_updated":"2024-07-04T18:33:00Z","snapshot_observed_at":"2026-08-03T17:12:16.534784Z","submitted_at":"2024-02-19T18:33:49Z","title":"LoRA+: Efficient Low Rank Adaptation of Large Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12354","snapshot_observed_at":"2026-08-08T11:51:10.059236Z","title":"Lora+: Efficient low rank adaptation of large models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.059236Z"},"links":{"cited_paper":"/paper/2402.12354","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:cb0d6e66a5d5094281d833e99486bf7e02e5e28987d55ae3da90c0b786f84db9","observation_id":"134b7460-80df-43db-9627-e5bb8e90c354","resolution":{"observed_at":"2026-08-08T11:51:10.059236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.066550Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.066550Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:c5add8d8e9bffafc9feff48584c1da5853f0496878f12e38b19f4f1dc2cc1a8c","observation_id":"851492bc-9bc1-415e-ac5d-8847100c14a0","resolution":{"observed_at":"2026-08-08T11:51:10.066550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-08T11:51:10.073244Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.073244Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:98342e4a50c5724aae57920a376068acf5788c20ea56f3c4d3c7e7c93b7f526d","observation_id":"c2c1008d-715d-4844-a503-398cc5e761c5","resolution":{"observed_at":"2026-08-08T11:51:10.073244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.832888Z","title":"The gronwall inequality","venue":null,"work_id":"30d11189-195d-4f26-9c3a-5b79c33e32e5","year":1998},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.080289Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:53de3e98fc5504f8d0edfca1a3a24087e4ea792c143ef79700438a82b133b685","observation_id":"d2c02794-18ff-43d1-8609-03e38786fd08","resolution":{"observed_at":"2026-08-08T11:51:11.839190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-08T11:51:10.089374Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.089374Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:e4a788d838dd4cb29abef83b7e7ae5cd86db1b0506874b3425637e8ce7d9d09a","observation_id":"391a5a18-0db7-4416-9f98-f9391fb8e0c5","resolution":{"observed_at":"2026-08-08T11:51:10.089374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13425","last_updated":"2025-02-20T02:24:55Z","snapshot_observed_at":"2026-08-08T10:47:51.541069Z","submitted_at":"2024-04-20T17:19:54Z","title":"Enhancing Adversarial Robustness of Vision-Language Models through Low-Rank Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13425","snapshot_observed_at":"2026-08-08T11:51:10.097799Z","title":"Advlora: Adversarial low-rank adaptation of vision- language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.097799Z"},"links":{"cited_paper":"/paper/2404.13425","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:4fafc0de515cdc179965ee8a1e31528c5f5f97a24591f8fb617ef7482d114e6f","observation_id":"a41f7d7b-7040-44d1-9484-7601dfe22f2f","resolution":{"observed_at":"2026-08-08T11:51:10.097799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03732","last_updated":"2023-11-28T03:23:20Z","snapshot_observed_at":"2026-08-08T21:34:35.024914Z","submitted_at":"2023-11-28T03:23:20Z","title":"A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03732","snapshot_observed_at":"2026-08-08T11:51:10.106714Z","title":"A rank stabilization scaling factor for fine-tuning with lora","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.106714Z"},"links":{"cited_paper":"/paper/2312.03732","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:496c9569397923a90b90e2c9a066b0e67c548427ecf29b591860aab7fe840011","observation_id":"fc812965-49fe-42ae-88c5-fb51f43a0586","resolution":{"observed_at":"2026-08-08T11:51:10.106714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11454","last_updated":"2024-01-16T18:59:22Z","snapshot_observed_at":"2026-07-06T16:34:38.718198Z","submitted_at":"2023-10-17T17:59:46Z","title":"VeRA: Vector-based Random Matrix Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11454","snapshot_observed_at":"2026-08-08T11:51:10.127136Z","title":"Vera: Vector-based random matrix adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.127136Z"},"links":{"cited_paper":"/paper/2310.11454","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:ad7cc0c0f09e00120f1d1c09c4abf87486572a2ac05b222e4cbade84aaefc8b5","observation_id":"5e036f4b-1cc4-42b9-a915-efbefba94605","resolution":{"observed_at":"2026-08-08T11:51:10.127136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10054","last_updated":"2022-02-21T09:03:34Z","snapshot_observed_at":"2026-08-04T02:30:25.691953Z","submitted_at":"2022-02-21T09:03:34Z","title":"Fine-Tuning can Distort Pretrained Features and Underperform Out-of-Distribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10054","snapshot_observed_at":"2026-08-08T11:51:10.133982Z","title":"Fine- tuning can distort pretrained features and underperform out-of-distribution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.133982Z"},"links":{"cited_paper":"/paper/2202.10054","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:cecb449476713da059f03f334fa9da75ed58540aea41b6634df5ed9c67671149","observation_id":"07bebc56-6a0d-4ce1-a516-e22093423f1c","resolution":{"observed_at":"2026-08-08T11:51:10.133982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18965","last_updated":"2024-12-12T19:54:41Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-24T17:58:21Z","title":"On the Crucial Role of Initialization for Matrix Factorization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18965","snapshot_observed_at":"2026-08-08T11:51:10.141504Z","title":"On the crucial role of initialization for matrix factorization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.141504Z"},"links":{"cited_paper":"/paper/2410.18965","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:cf30fa1565a9e0e403c1f05de597f8b07eb5aa0d6e9d0c7859b932ce1a485055","observation_id":"9e07cd81-3687-4bd8-8c4b-746f0309813f","resolution":{"observed_at":"2026-08-08T11:51:10.141504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.151103Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.151103Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:f93ac948a71c3cf4568b72c40acd822215130bddb335dbfafca884333913c012","observation_id":"3e5d7fcc-a844-421e-bda2-36a11b4a59ce","resolution":{"observed_at":"2026-08-08T11:51:10.151103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-08T11:51:10.158578Z","title":"Dora: Weight-decomposed low-rank adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.158578Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:fc96bf1baadcd032800c150e94fa128f1f51a499e3a8f84142f10d002976e9fd","observation_id":"2d9558d8-70f7-4622-88cb-96ab2b9e6fbe","resolution":{"observed_at":"2026-08-08T11:51:10.158578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.169443Z","title":"Decoupled weight decay regularization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.169443Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:8a87a86856fdecd64628dff0750b7f7a2608328bd5ebd2f0a00767d36f0dab1d","observation_id":"c8bf0e7c-cf1b-46ba-a3b8-fb4cb8f702ab","resolution":{"observed_at":"2026-08-08T11:51:10.169443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08305","last_updated":"2024-10-10T18:51:53Z","snapshot_observed_at":"2026-07-06T19:31:27.349925Z","submitted_at":"2024-10-10T18:51:53Z","title":"Randomized Asymmetric Chain of LoRA: The First Meaningful Theoretical Framework for Low-Rank Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08305","snapshot_observed_at":"2026-08-08T11:51:10.182586Z","title":"Randomized asymmetric chain of lora: The first meaningful theoretical framework for low-rank adaptation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.182586Z"},"links":{"cited_paper":"/paper/2410.08305","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:c13739763ce9b5ebf6fa06141d1b691a5fda3547c49f7900408661750ec66d63","observation_id":"89aabb06-e1ac-4319-82fa-7989181a9b0c","resolution":{"observed_at":"2026-08-08T11:51:10.182586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.794479Z","title":"A survey on lora of large language models","venue":null,"work_id":"82ddc591-4398-4927-b2d1-00003d84d0ff","year":2025},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.191445Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:773a6767293930e0fa2209b11f74d701a632fee33742bd2abed273b65e623ca1","observation_id":"9a49474e-1d39-4312-be70-7f9993f53e3c","resolution":{"observed_at":"2026-08-08T11:51:11.799786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-03T21:03:39.746617Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-08T11:51:10.201271Z","title":"Pissa: Principal singular values and singular vectors adaptation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.201271Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:61049620e0c8044b0780437ba42cd164cf1b167c5ee02b9c40441150a59ebd71","observation_id":"21fb92ca-c8e9-4d03-b369-e30ca3d555af","resolution":{"observed_at":"2026-08-08T11:51:10.201271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.774954Z","title":"On the explicit role of initialization on the convergence and implicit bias of overparametrized linear networks","venue":null,"work_id":"c949c517-30af-428d-b046-d16cd91c3ad5","year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.210611Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:0ae83f23cc509b2700d817ae56f075e866272199912fea284fc8864617570ee4","observation_id":"06b7100f-60e7-4fc7-bd24-eb7bc1d4548f","resolution":{"observed_at":"2026-08-08T11:51:11.780155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06422","last_updated":"2016-02-19T14:37:10Z","snapshot_observed_at":"2026-07-06T04:37:10.505278Z","submitted_at":"2015-11-19T22:19:15Z","title":"All you need is a good init","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06422","snapshot_observed_at":"2026-08-08T11:51:10.218992Z","title":"All you need is a good init","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.218992Z"},"links":{"cited_paper":"/paper/1511.06422","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:ba4f6fc4187d443016d6131358104d77fe52f72258985c983a946e806d4022b9","observation_id":"f88975d3-78c1-46a6-8658-9253fa0d5b5a","resolution":{"observed_at":"2026-08-08T11:51:10.218992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.758850Z","title":"Global convergence and stability of stochastic gradient descent","venue":null,"work_id":"33219858-9bfd-4004-a3be-347fbd42ee30","year":2022},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.228381Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:52a710ac45cfce382816a4f69e7b5dee589df1471df99f4c0e52a2e9294dcda5","observation_id":"c2d13bcb-0cae-4416-8e14-eaf8f0a48f83","resolution":{"observed_at":"2026-08-08T11:51:11.764250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.237689Z","title":"Initialization using update approximation is a silver bullet for extremely efficient low-rank fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.237689Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:9cbf4d777462783f5ad40d24b658f09b715c694050129a02f78f5a853bd6792b","observation_id":"53eb7a48-0809-41aa-9a9d-3f48faabb5b5","resolution":{"observed_at":"2026-08-08T11:51:10.237689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.244933Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.244933Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:d9514ae684e29c2b183f64d0d62f0aa9ce71d6d488ecee0394f2e151b9a4aff8","observation_id":"73072fbe-8237-491c-8429-5c6a14701dcd","resolution":{"observed_at":"2026-08-08T11:51:10.244933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09578","last_updated":"2024-04-12T23:15:51Z","snapshot_observed_at":"2026-08-04T19:55:50.190412Z","submitted_at":"2023-11-16T05:29:39Z","title":"Tied-Lora: Enhancing parameter efficiency of LoRA with weight tying","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09578","snapshot_observed_at":"2026-08-08T11:51:10.259651Z","title":"Tied-lora: Enhacing parameter efficiency of lora with weight tying","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.259651Z"},"links":{"cited_paper":"/paper/2311.09578","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:f45595df4729196fe1169a2cfc6adaa0d1c4b0e070f0e4bd239b38427b842378","observation_id":"1cd322c7-f24f-4f1e-82c3-9220f1f8caaf","resolution":{"observed_at":"2026-08-08T11:51:10.259651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-08T04:46:43.735461Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-08T11:51:10.272377Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.272377Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:a846a8c28dda23815f09880f89e3715dd3d10e607fd108eb38f900e82dcd586e","observation_id":"e6857a70-32f6-4768-9ff3-482cbf80d310","resolution":{"observed_at":"2026-08-08T11:51:10.272377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10785","last_updated":"2025-05-18T21:38:26Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T02:52:28Z","title":"ShareLoRA: Parameter Efficient and Robust Large Language Model Fine-tuning via Shared Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":"2406.10785","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.10785","snapshot_observed_at":"2026-08-08T11:51:10.775764Z","title":"ShareLoRA: Parameter Efficient and Robust Large Language Model Fine-tuning via Shared Low-Rank Adaptation","venue":"cs.CL","work_id":"68e48110-e568-4492-81aa-ab1ea278a76a","year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.285417Z"},"links":{"cited_paper":"/paper/2406.10785","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:d555312d4c66ccd7a2bb5aba4593d0d93579cf4e5c290f09df0d596370cb6b2c","observation_id":"e0bfd0a2-3432-46db-bbdb-d24c886570ae","resolution":{"observed_at":"2026-08-08T11:51:10.783356Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.732820Z","title":"Understanding the dynamics of gradient flow in overparameterized linear models","venue":null,"work_id":"d82e7cad-1c01-4a0e-8057-f988b4323be5","year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.292761Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:3c88f7c205df0bb20b50d00e21084d546e0bf55ef51df2b8696616ec86ac5103","observation_id":"47cfa5de-1d89-48ba-8830-5eb1b12a2bc6","resolution":{"observed_at":"2026-08-08T11:51:11.738000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.298966Z","title":"Gemma, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.298966Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:daf10c5c0a7fd56e27e8ef5251f30dc707521351d569a81e4e3a4dff4f97b82b","observation_id":"aece3599-8be2-48a2-8c8c-d90ce4ea84ac","resolution":{"observed_at":"2026-08-08T11:51:10.298966Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.701248Z","title":"Qwen3, April 2025","venue":null,"work_id":"9639fc04-4a1d-4f80-96c3-821b2c2a7b7a","year":2025},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.306585Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:8b8f7193651bd41f0de6e9f8c02f9451ae3856dc6db15a24f78e3f6f58508129","observation_id":"46e47c93-22b0-4933-8e0e-03718129a6d2","resolution":{"observed_at":"2026-08-08T11:51:11.706555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T11:51:10.314277Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.314277Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:8642b0270868c56ec8b61e737186ca28b75a6f29a58d3d36560218b0d6fbab89","observation_id":"605b1842-b3cd-438b-b301-2aeb51d8ab32","resolution":{"observed_at":"2026-08-08T11:51:10.314277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05366","last_updated":"2016-08-29T19:19:35Z","snapshot_observed_at":"2026-07-06T04:09:37.418340Z","submitted_at":"2015-02-18T20:13:26Z","title":"RSVDPACK: An implementation of randomized algorithms for computing the singular value, interpolative, and CUR decompositions of matrices on multi-core and GPU architectures","version":3},"cited_work":{"arxiv_id":"1502.05366","doi":null,"metadata_source":"pith","pith_arxiv_id":"1502.05366","snapshot_observed_at":"2026-08-08T11:51:10.731971Z","title":"RSVDPACK: An implementation of randomized algorithms for computing the singular value, interpolative, and CUR decompositions of matrices on multi-core and GPU architectures","venue":"math.NA","work_id":"13d4f58b-ff7d-48aa-a4cf-a1c683362cbf","year":2015},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.327030Z"},"links":{"cited_paper":"/paper/1502.05366","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:6505a263a84258d86c2e4cd002b5cc4aaa9ecc591b4df6feb2f82c6c75ebee46","observation_id":"910fe790-be67-4c51-a11d-2a325a3eaa25","resolution":{"observed_at":"2026-08-08T11:51:10.737815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-08T11:51:10.336035Z","title":"Glue: A multi-task benchmark and analysis platform for natural language under- standing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.336035Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:3ccbd1f2f579c6be46d95a5e03364c1d3733a81fc8c2fdb24a533762bf6beb29","observation_id":"69f927ee-778f-4ee1-8fb2-f988c66b1cb6","resolution":{"observed_at":"2026-08-08T11:51:10.336035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.682974Z","title":"Pufferfish: Communication- efficient models at no extra cost","venue":null,"work_id":"2c9009b3-6fa6-4b55-bca7-9bafa797209f","year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.344163Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:3ed48c9f445514a90a9409e401dda58badfa2f7c23af945062d73296793fb805","observation_id":"70d69d17-4c1b-4d6f-bd02-2a9155093fbb","resolution":{"observed_at":"2026-08-08T11:51:11.689185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.665112Z","title":"Cuttlefish: Low-rank model training without all the tuning","venue":null,"work_id":"d8d4f255-d9fa-40ab-965e-afbc1a296eda","year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.350927Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:b3af936f3c451c30be418517759a6f61343c0c315547728495f26f97d80d202b","observation_id":"92cd651b-c34c-4aeb-946f-19324625ff71","resolution":{"observed_at":"2026-08-08T11:51:11.670340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05000","last_updated":"2024-07-16T07:32:23Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T08:37:21Z","title":"LoRA-GA: Low-Rank Adaptation with Gradient Approximation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05000","snapshot_observed_at":"2026-08-08T11:51:10.356322Z","title":"Lora-ga: Low-rank adaptation with gradient approxima- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.356322Z"},"links":{"cited_paper":"/paper/2407.05000","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:2f59bf746392f9ece6a6bba668189112ba3f807f11d15468c3222f8a1b6e1fde","observation_id":"16c7bea6-2db8-42e7-8c08-7b110304cfd2","resolution":{"observed_at":"2026-08-08T11:51:10.356322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01796","last_updated":"2025-08-22T12:21:30Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T20:23:35Z","title":"Implicit Regularization Makes Overparameterized Asymmetric Matrix Sensing Robust to Perturbations","version":2},"cited_work":{"arxiv_id":"2309.01796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.01796","snapshot_observed_at":"2026-08-08T11:51:10.660710Z","title":"Implicit Regularization Makes Overparameterized Asymmetric Matrix Sensing Robust to Perturbations","venue":"cs.LG","work_id":"38d0b4b5-1e38-4f60-85ab-cdc96a384362","year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.361596Z"},"links":{"cited_paper":"/paper/2309.01796","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:b89868470d1efbf4809a04b8b8ed3767cd077d34b3c6b38619c80610355c655e","observation_id":"6ba59ee3-fbbb-4d8e-9613-eca5e0f47e52","resolution":{"observed_at":"2026-08-08T11:51:10.670710Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04151","last_updated":"2024-01-08T14:26:49Z","snapshot_observed_at":"2026-08-06T19:03:51.857938Z","submitted_at":"2024-01-08T14:26:49Z","title":"Chain of LoRA: Efficient Fine-tuning of Language Models via Residual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04151","snapshot_observed_at":"2026-08-08T11:51:10.367578Z","title":"Chain of lora: Efficient fine-tuning of language models via residual learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.367578Z"},"links":{"cited_paper":"/paper/2401.04151","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:382ee344addcd077beff70134277b080a3177e3e2781cf5d78874ac672e4f291","observation_id":"4d2440e1-5467-40fe-a287-2a3902ad38b2","resolution":{"observed_at":"2026-08-08T11:51:10.367578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.648946Z","title":"Towards theoretically inspired neural initialization optimization","venue":null,"work_id":"fd8b2a4f-0d66-4236-b579-5cc1b0475c9f","year":2022},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.373841Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:657a9794272414c96dc3e8bc7b3531472bb888934f35db788cce444d7be00330","observation_id":"e22cd51e-d268-492c-94dd-c342b7f3b830","resolution":{"observed_at":"2026-08-08T11:51:11.654365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.631181Z","title":"Global convergence of gradient descent for asymmetric low-rank matrix factorization","venue":null,"work_id":"56767b2b-4d88-4e2c-971c-db920e3ac2cf","year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.380158Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:70eb7a1d0282f7a848b510bd725da0727c9f0cf65f038d9febfd7ad6319c4df5","observation_id":"4b5debd4-1245-4c42-9332-da9fb09804c8","resolution":{"observed_at":"2026-08-08T11:51:11.636740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-08T11:51:10.387445Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.387445Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:6ef9a3b9f9dde7eba15778880dbad7a412787e22576e237bc3e9ef59178bfa77","observation_id":"78c3e74a-8cac-4703-a39b-3ee0c80e60a6","resolution":{"observed_at":"2026-08-08T11:51:10.387445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17513","last_updated":"2024-03-18T02:13:24Z","snapshot_observed_at":"2026-07-06T16:39:04.459332Z","submitted_at":"2023-10-26T16:08:33Z","title":"The Expressive Power of Low-Rank Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17513","snapshot_observed_at":"2026-08-08T11:51:10.397272Z","title":"The expressive power of low-rank adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.397272Z"},"links":{"cited_paper":"/paper/2310.17513","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:536de71cf5d3379b957d22cbd79a3f40a97e427595e8e01b8e27eadf093aac7e","observation_id":"ecc18705-64e5-405e-b2f4-86c2f65579a2","resolution":{"observed_at":"2026-08-08T11:51:10.397272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-08T11:51:10.406460Z","title":"Adalora: Adaptive budget allocation for parameter- efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.406460Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:4756beefd45079f2d16055e347e378dae3ae07d31b3767f21e8826b6e85112b9","observation_id":"5757111b-d92f-4edb-bf8e-3df4cc52fd73","resolution":{"observed_at":"2026-08-08T11:51:10.406460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:10.413134Z","title":"Gradinit: Learning to initialize neural networks for stable and efficient training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.413134Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:964258c99e76fdb6ba38ab37766b586e2c1f6d720eabf847fbc73b54ea6c59d9","observation_id":"41f64ce0-11a0-45e9-8d5a-32f7248d4bc7","resolution":{"observed_at":"2026-08-08T11:51:10.413134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16842","last_updated":"2024-02-27T18:06:29Z","snapshot_observed_at":"2026-07-06T17:35:41.168780Z","submitted_at":"2024-02-26T18:59:12Z","title":"Asymmetry in Low-Rank Adapters of Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16842","snapshot_observed_at":"2026-08-08T11:51:10.421410Z","title":"Asymmetry in low-rank adapters of foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.421410Z"},"links":{"cited_paper":"/paper/2402.16842","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:833b8804dac3beb0658da4b3337f14655d6d67a41f31079aff9100436f22b2fc","observation_id":"b2e6ad81-fa2c-45ab-a33c-de9b21d48279","resolution":{"observed_at":"2026-08-08T11:51:10.421410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.596349Z","title":null,"venue":null,"work_id":"dd18df75-bc46-42de-8a13-9a945b7b68c8","year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.429022Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:efce5a1c9e0ba7fe622711a262d1e1df118950f2e1da582b4d69e2edf6bbff1d","observation_id":"1e53aac3-b5e1-4557-b4bc-ae6ee6a44433","resolution":{"observed_at":"2026-08-08T11:51:11.603534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.577600Z","title":null,"venue":null,"work_id":"53171fc4-600e-4aa6-addf-3d9808a9337e","year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.435196Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:4c9680abc9375c643cca03d0f6eb9df7e752bb3f367ad16caa0c679dd6fc499e","observation_id":"131178c3-9cca-4d28-836a-90e9ce0af0e3","resolution":{"observed_at":"2026-08-08T11:51:11.584401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.559449Z","title":null,"venue":null,"work_id":"4d8b7fc7-148d-494a-9f52-32c4f564ec93","year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.441859Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:c47d612f94d217115ef70f2af4ec3c6493f31a024c4ad70f465ad93c0f60877d","observation_id":"262c365c-d727-4536-b9ea-61b17775ad5c","resolution":{"observed_at":"2026-08-08T11:51:11.565162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.541649Z","title":null,"venue":null,"work_id":"a02d2c45-9a4a-48e0-9646-2908b39eb52a","year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.449915Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:1afddb25158220f243570d37b42754a488628acd6376861d42188140db10d790","observation_id":"55955c17-825e-4802-9410-c4b1071fafd8","resolution":{"observed_at":"2026-08-08T11:51:11.546646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:51:11.523789Z","title":"tilde” variables as those from Asymmetric LoRA, while the without “tilde","venue":null,"work_id":"d6d9a1d8-7c28-437d-bf93-72afdc0659ee","year":null},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:10.457246Z"},"links":{"citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:0b2c92580c9d13e8c6375ea27cc63a5d3a8a18daee36fa92d6a20569a6125fa6","observation_id":"f485d9bc-e6d3-4c50-b59a-beb6fc29c47c","resolution":{"observed_at":"2026-08-08T11:51:11.529347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":43,"verified_exact":5,"verified_fuzzy":13},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2502.07739."}