{"as_of":"2026-08-05T19:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4b472c8a7fb75c4feeaa8ec5b9a28779cdc0ad1f1977aa40957ef1848d73e85","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T11:23:55.146868Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.03209/citation-record","integrity":"/paper/2606.03209/integrity","json":"/paper/2606.03209/citation-record.json","paper":"/paper/2606.03209"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:1b290246252708f8786f9298e412ff3d093640c8643c4666469d97d582e402cb","observation_id":"edb4f29f-3fc3-4d5a-8514-37e4bd31f312","resolution":{"observed_at":"2026-07-02T01:56:28.081264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Intrinsic Dimensionality Explains the Effectiveness of Language Model Fine-Tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:8a948157586a191590196848e9a797b5020b0395ca02b21cc2164e3bc3afec1c","observation_id":"499944fe-89b2-4f51-8c26-11adc3af3a8c","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Aketi, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:964aca81b79e1bd3d14fdfaed2fa1b5d0fabe5538286e3149e855e05c815776d","observation_id":"2902d937-64cd-4b87-a3da-6bf9194218ee","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Greedy Layerwise Learning Can Scale To ImageNet","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:d403c9284bf68f346e34d28cad3f234d0a8f400aeb2384fe338bc1c6f0683f4e","observation_id":"f417ed73-6f8d-4235-8afc-7ce4a08976a4","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Greedy Layer-Wise Training of Deep Networks","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:ee142ff4ff06c1cacfba69bdde2dd5a5ef1432d6a94160e30c7f82056edfbbb7","observation_id":"246fa214-184e-464e-a32d-318d1fea9898","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Boyd, Arpita Ghosh, Balaji Prabhakar, and Devavrat Shah","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:22feaffbc24d660ddd0de015f85a746361371ec69897d487f1c2428bc11a717e","observation_id":"93c9543e-03e0-40e3-b834-b7f145f06a7f","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"On the Importance and Applicability of Pre-Training for Federated Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:7f2f5bda60b6748261e66952dd87259dc2347dd7edfe1434dbe46cc77980a1b0","observation_id":"7d48b0fd-487f-4678-befd-a1480f7bafb0","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:56ea81c4135423bcb652078e0e1dd7e40cdd478d918da1c28eb26cd2456fa10f","observation_id":"46b2fa0f-9d01-4ab6-8285-86f7fd6fcb18","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06174","last_updated":"2016-04-22T19:21:36Z","snapshot_observed_at":"2026-08-04T13:01:58.606241Z","submitted_at":"2016-04-21T04:15:27Z","title":"Training Deep Nets with Sublinear Memory Cost","version":2},"cited_work":{"arxiv_id":"1604.06174","doi":"10.48550/arxiv.1604.06174","metadata_source":"pith","pith_arxiv_id":"1604.06174","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Deep Nets with Sublinear Memory Cost","venue":"cs.LG","work_id":"f2c5c287-a500-40e4-a136-e7e3172db1d7","year":2016},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/1604.06174","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:8856a4b35a1c27040286490fccaf3ff3da051f2ecfeb85988212392ce8b20ead","observation_id":"93f5c017-941c-4746-bcba-144a9f781e2a","resolution":{"observed_at":"2026-07-02T01:56:28.067578Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Chiang, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:e504a97fc4a62117871a77cc4c5cd3449c1bfd8f32c08ebdbd5e31448ed723e8","observation_id":"6afc004f-ad51-41f0-a026-a7968ce858a7","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Heterogeneous LoRA for Federated Fine-tuning of On-Device Foundation Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:6854316628554895fd7538034cccf078b8fdccf0e3a67ae164a89360d9b8e56d","observation_id":"d5c00897-7d43-48c3-b485-40a5c0ac450b","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Epidemic Learning: Boosting Decentralized Learning with Randomized Communication","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:80a25978c35e08c6a42416f73f55d0a11bb7677a5cd9a7524c994ad989d8825e","observation_id":"4797dc6a-ee3a-4a7f-a48d-c1a9a8215204","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:553fa3c838fd14434e73b5c12a0f90f21f0d620dbb0acfbf4ac36c6ef4dd6fe0","observation_id":"99422e78-2985-4668-9368-f4a06b634015","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:9263f90a50c7ef0fa0a45146b61e32f60c691f15fb3407be46bcae8faa5e0335","observation_id":"096aa649-2f75-4af4-b16d-41a079ee9135","resolution":{"observed_at":"2026-07-02T01:56:28.119012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Cross-Gradient Aggregation for Decentralized Learning from Non-IID Data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:89a492299eb4bffa17d9f86aaa7ccc8cf6ab446fdeaf8b82049a9cd967949a62","observation_id":"6967a7cb-5021-4109-997d-55763777e53e","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Decentralized low-rank fine- tuning of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:df79095284def3cc1db176816a7d336c271e5b1638e507a72b8c8f971c31765d","observation_id":"f56364f2-8f27-4b5b-a9e7-24a9126809f0","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Robust Decentralized Learning With Local Updates and Gradient Tracking.IEEE Transactions on Networking, 33(4):2036–2048, 2025","venue":null,"work_id":null,"year":2036},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:9fd490bf5f4a022358ebc54fc32af025322844b30c52f31dc7da568f11e2c224","observation_id":"925890e9-16e6-4a66-8cda-a790efedce2d","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Selective Aggregation for Low-Rank Adaptation in Federated Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:0ed66418b7fe5dd17c444f615d73b30c042c7d2eb0fa53ff2efb400fe17823a4","observation_id":"800e4c2f-83b0-4e88-a615-601a0b8dc824","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Parameter-Efficient Transfer Learning for NLP","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:86a5035182a320c87e67572c523fd057d21ce69447be8654d3fea554bfc7471a","observation_id":"6e32fde0-5fb4-4878-a899-0024c0de3d9f","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:bef59b5c0caeaa4899f991190656597c8b3bc0685281e42531fcbeddf7f350b6","observation_id":"d87f1f29-4343-4487-bc4a-66b93f660bf2","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:e2ea7f2effda14689c8b88e1d7bfeedf3e2dc5894b5153a8f9b7b0a786e0f27c","observation_id":"35b3e6bd-360d-4959-b44b-062795d8e287","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02556","last_updated":"2024-04-30T01:58:16Z","snapshot_observed_at":"2026-07-06T16:27:31.403609Z","submitted_at":"2023-10-04T03:30:24Z","title":"NOLA: Compressing LoRA using Linear Combination of Random Basis","version":2},"cited_work":{"arxiv_id":"2310.02556","doi":"10.48550/arxiv.2310.02556","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NOLA: Networks as Linear Combination of Low Rank Random Basis.arXiv preprint arXiv:2310.02556, 2023","venue":"arXiv (Cornell University)","work_id":"d3a74051-b450-4e79-a52b-bbf8dd8ef39e","year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2310.02556","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:f36419bfb405e334afb6ed73c2342ea9c6bc1ea2d626afb516ddad72f6526ce0","observation_id":"c47f0dbe-2f79-4864-ac73-5e82eeb64ae4","resolution":{"observed_at":"2026-07-02T01:56:28.063989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:cc7bb932364df6c803ef0627c9a357b3f82bc634a059dc15bb6e34da93fe011d","observation_id":"c63b60f6-376f-46dd-9dac-55960b958d0d","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:112d7224e75fc6b63da135a330c8fe365474737ce82ad12eddbbcddc1a27622c","observation_id":"81c553a7-60b3-4e46-805b-39df7d2ea10c","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:28e2740e99684216f4fd54f377fb99c2492d0a31b27119d4b91cc89721fe9ce8","observation_id":"5cde7efa-de9a-4cab-89f6-2452acffec15","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Measuring the Intrinsic Dimension of Objective Landscapes","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:2db77ab2a3d3ac101ea5a3df7287f4871487eb37f968c595991c2eccac22187e","observation_id":"6aaafc06-c130-4f0d-ad58-bf2f4a7507e8","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:5201024465f5e642d22bec6ca00386c896caabeef1a83161f14f5634a05ecbf1","observation_id":"0215f415-f062-4123-880b-44cfaab6b01c","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"ReLoRA: High-Rank Training Through Low-Rank Updates","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:8b5edb6baeec4447f95e9794ff6abe353ded1fc36869133909de0245cbc11e24","observation_id":"db2a7a79-8dd5-4b4c-b8ef-bdfac76117c8","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Can Decentralized Algorithms Outperform Centralized Algorithms? A Case Study for Decentralized Parallel Stochastic Gradient Descent","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:b2346dfeffb64d0fcb656ce9a5e7123cf76dbe1c989688b9833ce3a6f7996f42","observation_id":"cae1bb0a-eb37-4725-bf3f-ef44bcb2c44a","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Stich, and Martin Jaggi","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:c3fd8895f5fa874185d71dc31d175cba516dd1b464e110973d6e6b6bfff16185","observation_id":"f72ed552-06e7-40bb-a1ee-b50333309b07","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"HiFT: A Hierarchical Full Parameter Fine-Tuning Strategy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:ab380e13a971ef021f4462dd8129b84c9400a522d93ddfa730ea267b059dd7b6","observation_id":"ea95a2e3-5252-45d5-9988-d6743ff225e4","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Lu and L","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:92b5e9acac62fe0d2aa468345318ad3fd37bea345fe13cf1be00aab2ed29ef7e","observation_id":"96d8b2f5-9138-4aa3-847e-d2dff7ba3e81","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:cb218467b82f559e26218a73bb77eb31a398725ddcebcf4d6e55f21665685d56","observation_id":"42ff8eab-7d19-4c49-aa4e-a03f5e8d62fc","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Full Parameter Fine-tuning for Large Language Models with Limited Resources","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:e1a4f77e41aec4a7b971776bc1aacaf1cc67fb5efb10bda103a4d5c8a4542020","observation_id":"eddbb560-413c-489c-9b7d-15d15061085c","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Lee, Danqi Chen, and Sanjeev Arora","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:b1cb428d4140aed21e4f3ae3180d3e0f95d53c671f7846a7601ca58a74425238","observation_id":"b3751456-ad08-43b7-b6a5-c3de41305498","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Communication-Efficient Learning of Deep Networks from Decentralized Data","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:9595e1b138fe87260f11ad2957b19cafb6414dd31d00a63a302901666e5f005c","observation_id":"5ebc4753-c534-4a31-9eb5-dfe55832fe91","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:4a9090aed632c15feb5af26d5455af24187826eb887dd4257528ccfa2942ccc0","observation_id":"3f4f07e5-4d8e-4f7d-a5d9-b0dc727508c0","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14999","last_updated":"2023-04-28T17:39:49Z","snapshot_observed_at":"2026-07-06T15:21:19.790554Z","submitted_at":"2023-04-28T17:39:49Z","title":"Empirical Analysis of the Strengths and Weaknesses of PEFT Techniques for LLMs","version":1},"cited_work":{"arxiv_id":"2304.14999","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.14999","snapshot_observed_at":"2026-07-02T01:56:28.086389Z","title":"Empirical analysis of the strengths and weaknesses of peft techniques for llms","venue":null,"work_id":"bad1210a-2146-4545-8a5e-f32570d7784a","year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2304.14999","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:7702c322b35c157fb9c83316da7a18fa29210e71c344951893e122defe400bb9","observation_id":"0702b669-d931-47a0-b526-7cb75794843a","resolution":{"observed_at":"2026-07-02T01:56:28.089097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Pu and A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:1f976154457968945275ba8484b9dfba3478d8bce54f70174b5aa5a13dc01898","observation_id":"243030a8-e3f5-4ee5-858d-ada832ed4220","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07925","last_updated":"2026-07-06T13:54:37Z","snapshot_observed_at":"2026-07-09T23:18:04.026227Z","submitted_at":"2024-06-12T06:44:59Z","title":"FDLoRA: Personalized Federated Learning of Large Language Model via Dual LoRA Tuning","version":2},"cited_work":{"arxiv_id":"2406.07925","doi":"10.48550/arxiv.2406.07925","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fung, Hailong Yang, and Depei Qian","venue":"arXiv (Cornell University)","work_id":"87013e14-45f8-468f-b148-72bb4919e6a8","year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2406.07925","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:1608fefc49d278a71167c37deede84fca82ca07e61ddeea3bb9b71c1283fdfd2","observation_id":"35b1f831-9c27-400e-bf4e-8eb7c0ec1ce7","resolution":{"observed_at":"2026-07-07T03:18:45.476301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Federated full-parameter tuning of billion-sized language models with communication cost under 18 kilobytes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:d3cac6e1ad5f1b485f7c37305a32aa6204b8f12bf9db1f3db9d19ac774bc8054","observation_id":"5718fe5e-6929-42f4-a5c3-d7f8a66a4f65","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:bfa220c15db6f4806c8998e54df5371a22d85cf2f46f609789d3ffbfe1b8f008","observation_id":"ecac5325-29dd-4201-aec0-a8e3155242ee","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"ZeRO-Offload: Democratizing Billion-Scale Model Training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:2108f1da649e9071b327818b98879dae138b2fa2d3ad26060644af1d55aefa95","observation_id":"b2d4cd61-3c3b-4a90-aa2b-61a77e37f6bd","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Waite, Shreyan Ganguly, Aditya Balu, Chinmay Hegde, and Soumik Sarkar","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:89b090b9e365688e5d6aefd9a5377f77a50033e5abe01c7d98cec13abd27a3ae","observation_id":"a02269d3-0f54-4ced-8c3e-ce026859e7c7","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Scaman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:25dfae7dcc1bbab054160f6444fcec5b2dc0edd1d5e3e6785d9a7137e84b18f9","observation_id":"8b9a892e-82d0-4695-b589-b9ab565b49d2","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Scaman, F","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:8ec964b8f68ff59c7d3f2e4658b226c602f0ffdfcb3eb934eeaf0d4ed0e7ebfe","observation_id":"b561d55e-ef1a-410b-94fe-9466a5a48b99","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:6a5ff0932e3a4160dd3cc787e222f7959faea6a891a9745af0c76c1eb1665a0c","observation_id":"6b0f07c4-042a-493f-ad6f-77fd3d2d4e54","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Ferret: Federated full-parameter tuning at scale for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:4ec95562ea77c7c8ff9a7ac9a7191dd579df7a4cc9ebe9fb3e4ecad73440b268","observation_id":"45fbaf60-721b-4091-8115-3ff65399e6b7","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Improving LoRA in Privacy-preserving Federated Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:9c827badedb2da87f39d76d68ed48d4db5d50e891eb2a4158da5457fc8e001c6","observation_id":"1757ec6f-8f0d-4e06-903b-9bf88f9d5b5d","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Takezawa, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:08418f758c0e615c71d7f5e53811e37f60472c1bca99a379297f70dc136e98d1","observation_id":"4fe63e29-8975-445d-8861-38d7ed692cad","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:ba00c1502129136c3b38670704c8f220fe2bf05fbbfb59ea0653d0531ee678ca","observation_id":"901a72aa-8946-4625-95a2-9ffec0e06775","resolution":{"observed_at":"2026-07-02T01:56:28.071202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Convergence of A Block Coordinate Descent Method for Nondifferentiable Minimization.Journal of Optimization Theory and Applications, 109(3):475–494, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:aae616c9be1330d14c35b62efdadf63f1325023510ad7bc00beadd4ffbc06a54","observation_id":"c5095d82-4530-4e6a-906b-99885b440ca8","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Vaswani, N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:db5d41dc1af05d0ede845f115d95199336c69442ccef5fb7f244f8176b473b52","observation_id":"56bcd9f1-6013-4239-bcb7-c9313cdd84ca","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"ROSS: RObust decentralized Stochastic learning based on Shapley values.IEEE Transactions on Networking, 34:2911–2926, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:7ef2bc77baca998ecd10332ad83e16ac77c1ca083fb1b760c963ca39b77a02ff","observation_id":"e1ef07ac-90b4-4d1d-9b89-91044e1fe4dc","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"PDSL: Privacy-Preserved Decen- tralized Stochastic Learning with Heterogeneous Data Distribution","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:9202c03a1774387672067b2c85fb851a24dff5d73387f0b2fc93576a1a4512c1","observation_id":"703fbc64-efc2-4597-9afd-c9c092642795","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:ad9c194fdd1b3f195c16c3ab3c6f49729e83ddf3dbc0a865b4a6788d17d88fd4","observation_id":"7e351643-4507-4a5e-bf71-f796140208ee","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Flexora: Flexible Low-Rank Adaptation for Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:bd9d13bf399c03745802357b080bc8fbb01eba45c7ce25dc152d5b2bebe254ce","observation_id":"2279315b-b694-40cb-9ef8-ce8c9784af46","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Lawrie, and Benjamin Van Durme","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:60075edb9f860b503d57779836ddc158e15ac7b0f75a564ed90eed52a1b4c192","observation_id":"5ffd6e22-83d8-4096-a0dd-8f142c183f5b","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Coordinate Descent Algorithms.Mathematical Programming, 151(1):3–34, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:c7c75f4003fe9c252ca454bd21a71ce89a02ccfe1210fe67423e57b555111322","observation_id":"41c7ae74-6d09-461d-bb8f-6d8d458a92f4","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04151","last_updated":"2024-01-08T14:26:49Z","snapshot_observed_at":"2026-07-06T17:13:00.434583Z","submitted_at":"2024-01-08T14:26:49Z","title":"Chain of LoRA: Efficient Fine-tuning of Language Models via Residual Learning","version":1},"cited_work":{"arxiv_id":"2401.04151","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.04151","snapshot_observed_at":"2026-07-02T01:56:28.082849Z","title":"Chain of lora: Efficient fine-tuning of language models via residual learning","venue":null,"work_id":"31988210-4c1b-4ee7-bfc9-f392c89f021a","year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2401.04151","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:353cfee83f717ff6a5ad7cf5cae502918813aa06c102b52875baff6887a1549d","observation_id":"f9e8e486-ad04-4021-bd09-540f1ee3dc7a","resolution":{"observed_at":"2026-07-02T01:56:28.084885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:41670262e34473d1cb1ed4270fca5c253bb5eaa892311b4265a0c55a405f341d","observation_id":"46c1c874-9ad8-4735-b691-e0f5ffad9904","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:77d9ca7f8a06bedee5b07a8f5ac65a06d59e85188ff3dc9273e96e599faa2c13","observation_id":"6c1989f7-e407-4890-95df-51150072719f","resolution":{"observed_at":"2026-07-02T01:56:28.078106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:a37b4a76bf954340ae338be2ab92822095b1c1f5b692c371a86962eb6729bfa8","observation_id":"eb55767a-bf5e-4040-a08d-61906581f9e4","resolution":{"observed_at":"2026-07-02T01:56:28.092665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"On the Linear Speedup Analysis of Communication Efficient Momentum SGD for Distributed Non-Convex Optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:2814feea7de71ae258795ad53bd8f1802098569c33018fb12351a100bb8f99ce","observation_id":"030de760-fecf-43e4-a1e9-2648233bcaff","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"When Scaling Meets LLM Fine- tuning: The Effect of Data, Model and Finetuning Method","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:da77be8771f6d22dad165cac9e3d588589db0a73eef8e1d9dc3940d6340bff4b","observation_id":"f670caea-572b-4e04-ad2a-7941e58fb3e0","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":"2308.03303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-07-04T19:10:05.832087Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","venue":"cs.CL","work_id":"caf23d24-5176-4330-bd2a-6cf699d152cd","year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:9f86731e06c74a3ef716713f0b1b20eca04dbff76b330e0baabab274da74181b","observation_id":"cd70d297-c054-4ca4-8849-2c017704d3e5","resolution":{"observed_at":"2026-07-02T01:56:28.096334Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Zhang, X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:e5ca4c63cdbc4749858ca77393aec63e1751e3964c8a2b5453b782a738a88d8f","observation_id":"ebd3aef3-1b68-4171-8ee7-49aebeaab99e","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"NET- FLEET: Achieving Linear Convergence Speedup for Fully Decentralized Federated Learning with Heterogeneous Data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:b6d65708934a855e1daeb8e1839a6ccc1f1421d307cb1dd9dd0c697bfa79fe30","observation_id":"2ddb099d-ce0f-4474-91f4-c54bca9053d4","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Kingma, Yinyu Ye, Zhi-Quan Luo, and Ruoyu Sun","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:d7963801ceff2aa39c7a44005fb7715cb18b94eec217f7bc573cbea07858dd20","observation_id":"5b201741-d27c-44ce-a82d-15ab76f03edb","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Enhancing Storage and Computational Efficiency in Federated Multimodal Learning for Large-Scale Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:392bd72491d8202cac3d372737d22456e87cc50789161d29fc7644e1f284aded","observation_id":"89af02eb-2b78-484f-80da-9131fdae1f1c","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"FedPrompt: Communication- Efficient and Privacy-Preserving Prompt Tuning in Federated Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:71afa7042b31e4d6cb075b17b5cf28590517219549897395d044db38c2da93c2","observation_id":"c20a25dc-5121-498b-b0be-af3b72b11b0b","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Galore: Memory-efficient LLM training by gradient low-rank projection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:680728e062d5dc37c37c104c762d36c5aef5d49943cde9343e3ca12ccdfd2f93","observation_id":"eeae4342-fe8a-4f76-b143-c84633c397ef","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T11:23:55.146868Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:ce6e7d4a867d7d59aa01aade0fef8f556db2632a0a3fe6941172a350f00a0ee0","observation_id":"04051c6e-c5e4-4a91-accf-bb33f2d7a60c","resolution":{"observed_at":"2026-06-28T11:23:55.146868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0289.8086","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T01:56:28.098007Z","title":"Bullish” (positive) or “Bearish","venue":null,"work_id":"cff7bfd2-c196-40db-a2c8-53b1609781c0","year":null},"citing_paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T11:23:55.146868Z"},"links":{"citing_paper":"/paper/2606.03209"},"observation_digest":"sha256:29ec371c0bc7b87c1d76db98a8c3e7ff223f7dce3307e248e5bdc3ce3e8bec63","observation_id":"be66033f-9cd3-494f-939d-b578cd2fa4eb","resolution":{"observed_at":"2026-07-02T01:56:28.099904Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.03209","last_updated":"2026-06-02T06:08:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:43:31.629075Z","submitted_at":"2026-06-02T06:08:31Z","title":"DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":62,"verified_exact":10,"verified_fuzzy":0},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2606.03209."}