{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:XNMM5OL5MC2243TSBKK7GMLEXI","short_pith_number":"pith:XNMM5OL5","schema_version":"1.0","canonical_sha256":"bb58ceb97d60b5ae6e720a95f33164ba0918302b4e54ce9d7e1b059bf2f924db","source":{"kind":"arxiv","id":"2506.05713","version":2},"attestation_state":"computed","paper":{"title":"Come Together, But Not Right Now: A Progressive Strategy to Boost Low-Rank Adaptation","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Kede Ma, Qiushi Huang, Shuhao Chen, Wei Li, Xiequn Wang, Xuehao Wang, Yanbin Wei, Ying Wei, Yuhe Nie, Yulong Zhang, Yu Zhang, Zhan Zhuang","submitted_at":"2025-06-06T03:33:06Z","abstract_excerpt":"Low-rank adaptation (LoRA) has emerged as a leading parameter-efficient fine-tuning technique for adapting large foundation models, yet it often locks adapters into suboptimal minima near their initialization. This hampers model generalization and limits downstream operators such as adapter merging and pruning. Here, we propose CoTo, a progressive training strategy that gradually increases adapters' activation probability over the course of fine-tuning. By stochastically deactivating adapters, CoTo encourages more balanced optimization and broader exploration of the loss landscape. We provide "},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2506.05713","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2025-06-06T03:33:06Z","cross_cats_sorted":[],"title_canon_sha256":"f85dd26bda94617f11f3c4bd4e13905633a573227b92bd72abecb87c8d5d3520","abstract_canon_sha256":"58e7542c39fe96b34c930900e043b804d40bb3efd8ef14bbd7aff8c460081176"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:44:06.867180Z","signature_b64":"jOpFhaUEVimjvd9B03B8J9AVgSqknlDtdk+liTMKVtGR8UT1eVJwBDyjXaL83DrBWJ1DKDsLdE+9Mtw1m6IvAQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"bb58ceb97d60b5ae6e720a95f33164ba0918302b4e54ce9d7e1b059bf2f924db","last_reissued_at":"2026-07-05T11:44:06.866637Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:44:06.866637Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Come Together, But Not Right Now: A Progressive Strategy to Boost Low-Rank Adaptation","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Kede Ma, Qiushi Huang, Shuhao Chen, Wei Li, Xiequn Wang, Xuehao Wang, Yanbin Wei, Ying Wei, Yuhe Nie, Yulong Zhang, Yu Zhang, Zhan Zhuang","submitted_at":"2025-06-06T03:33:06Z","abstract_excerpt":"Low-rank adaptation (LoRA) has emerged as a leading parameter-efficient fine-tuning technique for adapting large foundation models, yet it often locks adapters into suboptimal minima near their initialization. This hampers model generalization and limits downstream operators such as adapter merging and pruning. Here, we propose CoTo, a progressive training strategy that gradually increases adapters' activation probability over the course of fine-tuning. By stochastically deactivating adapters, CoTo encourages more balanced optimization and broader exploration of the loss landscape. We provide "},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2506.05713","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2506.05713/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2506.05713","created_at":"2026-07-05T11:44:06.866700+00:00"},{"alias_kind":"arxiv_version","alias_value":"2506.05713v2","created_at":"2026-07-05T11:44:06.866700+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2506.05713","created_at":"2026-07-05T11:44:06.866700+00:00"},{"alias_kind":"pith_short_12","alias_value":"XNMM5OL5MC22","created_at":"2026-07-05T11:44:06.866700+00:00"},{"alias_kind":"pith_short_16","alias_value":"XNMM5OL5MC2243TS","created_at":"2026-07-05T11:44:06.866700+00:00"},{"alias_kind":"pith_short_8","alias_value":"XNMM5OL5","created_at":"2026-07-05T11:44:06.866700+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI","json":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI.json","graph_json":"https://pith.science/api/pith-number/XNMM5OL5MC2243TSBKK7GMLEXI/graph.json","events_json":"https://pith.science/api/pith-number/XNMM5OL5MC2243TSBKK7GMLEXI/events.json","paper":"https://pith.science/paper/XNMM5OL5"},"agent_actions":{"view_html":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI","download_json":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI.json","view_paper":"https://pith.science/paper/XNMM5OL5","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2506.05713&json=true","fetch_graph":"https://pith.science/api/pith-number/XNMM5OL5MC2243TSBKK7GMLEXI/graph.json","fetch_events":"https://pith.science/api/pith-number/XNMM5OL5MC2243TSBKK7GMLEXI/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI/action/timestamp_anchor","attest_storage":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI/action/storage_attestation","attest_author":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI/action/author_attestation","sign_citation":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI/action/citation_signature","submit_replication":"https://pith.science/pith/XNMM5OL5MC2243TSBKK7GMLEXI/action/replication_record"}},"created_at":"2026-07-05T11:44:06.866700+00:00","updated_at":"2026-07-05T11:44:06.866700+00:00"}