{"as_of":"2026-08-08T13:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:521e07e146838d02cf08c5e8ba0e0a24290ceb7c8cb0cd93e9cf58301c7753bb","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T18:56:25.791922Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.10239/citation-record","integrity":"/paper/2502.10239/integrity","json":"/paper/2502.10239/citation-record.json","paper":"/paper/2502.10239"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.697842Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.697842Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:86621389109b915f0f3464089af0e579738c6dac34f924af4d2c160d6881578d","observation_id":"a804e73d-6fa0-4549-8585-3b433f8d1a8c","resolution":{"observed_at":"2026-08-07T18:56:25.697842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.270418Z","title":"Fedrolex: Model-heterogeneous federated learning with rolling sub-model extraction","venue":null,"work_id":"28c1cb30-e61c-4450-8d72-3862872cb380","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.702394Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:f089e6b88e6c7025d333cff278c486ab24e418d84598283c169f681925367100","observation_id":"4afa8e17-0b37-47df-bcfc-14f804bdaeb5","resolution":{"observed_at":"2026-08-07T18:56:26.273343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.262548Z","title":"SL o RA : Federated parameter efficient fine-tuning of language models","venue":null,"work_id":"fba7ff9e-e597-4475-81ec-5ad50436df1b","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.705894Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:74840f94e62ddbcd00d47101b0256430f40fcd718a4a452005976e19e7ebfc63","observation_id":"baaaafbe-3cb9-4fa8-b0bd-5557c35acf55","resolution":{"observed_at":"2026-08-07T18:56:26.265334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08587","last_updated":"2022-02-17T11:07:55Z","snapshot_observed_at":"2026-08-05T18:06:18.533236Z","submitted_at":"2022-02-17T11:07:55Z","title":"Gradients without Backpropagation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08587","snapshot_observed_at":"2026-08-07T18:56:25.709239Z","title":"G., Pearlmutter, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.709239Z"},"links":{"cited_paper":"/paper/2202.08587","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:bb950b9c0331a5f768e947fbfd33c9d4f70cb7dcc7585c201875c041e49615eb","observation_id":"ca7f3293-642e-43ab-915e-7c7db1915219","resolution":{"observed_at":"2026-08-07T18:56:25.709239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.712904Z","title":"R., Angeli, G., Potts, C., and Manning, C","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.712904Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:7b2e2784e75d15e637ad2ca57c1a006c602af970be7e12261ca06a65589ddb7e","observation_id":"c3c154d4-5c78-44e0-a9c5-9e1b15da5ec2","resolution":{"observed_at":"2026-08-07T18:56:25.712904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.253602Z","title":"A zeroth-order block coordinate descent algorithm for huge-scale black-box optimization","venue":null,"work_id":"95001638-1367-4d0a-8f89-40852825e34b","year":2021},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.716229Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:6291ec4e6f678b76dcb6335b8b11272dd9f90d577fe775aa8a05393278347db5","observation_id":"b111fcc0-357b-497e-ab65-1fab460ac67b","resolution":{"observed_at":"2026-08-07T18:56:26.256666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07210","last_updated":"2019-01-08T16:01:46Z","snapshot_observed_at":"2026-08-07T23:08:05.957777Z","submitted_at":"2018-12-18T07:31:18Z","title":"Expanding the Reach of Federated Learning by Reducing Client Resource Requirements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.07210","snapshot_observed_at":"2026-08-07T18:56:25.719468Z","title":"B., and Talwalkar, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.719468Z"},"links":{"cited_paper":"/paper/1812.07210","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:77720acc7f2537db8b66e7ba3132f05ab78cf5084ea3d99416beb8f695aa6fd9","observation_id":"99c0d48f-f243-4c4c-8cd9-24a0b41acb8f","resolution":{"observed_at":"2026-08-07T18:56:25.719468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.723112Z","title":"B ool Q : Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.723112Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:a0102b0ef048075c7b2ee28aba102f68adbb0cbd836c04af8ecf1160df7ee886","observation_id":"112bf96f-f486-404d-99bd-479b88f844c8","resolution":{"observed_at":"2026-08-07T18:56:25.723112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.245207Z","title":"N., and Zhou, Y","venue":null,"work_id":"01dc037b-234a-4740-90bf-4087f1eabc0e","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.725734Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:9f25bd5bfb8e0633b7b61d45ee5688d2afeba6ee21b96db9ec1cac0157212e05","observation_id":"99ba409e-2fa9-40fb-8625-d2138e26cbf5","resolution":{"observed_at":"2026-08-07T18:56:26.248034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12195","last_updated":"2024-07-21T11:01:00Z","snapshot_observed_at":"2026-08-01T19:26:12.995868Z","submitted_at":"2023-01-28T13:34:36Z","title":"BAFFLE: A Baseline of Backpropagation-Free Federated Learning","version":3},"cited_work":{"arxiv_id":"2301.12195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12195","snapshot_observed_at":"2026-08-07T18:56:26.083057Z","title":"BAFFLE: A Baseline of Backpropagation-Free Federated Learning","venue":"cs.LG","work_id":"f9899aad-d38f-415a-8ae3-c5a7cf9b9ae9","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.728238Z"},"links":{"cited_paper":"/paper/2301.12195","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:c2e705383398ee5f0be7bb09388882e6e2fe4e68a07c6d5d5782da6724fc97f6","observation_id":"83ae8fe5-4fdb-490a-ba51-17ec8c88d8c1","resolution":{"observed_at":"2026-08-07T18:56:26.086301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.236123Z","title":"Making pre-trained language models better few-shot learners","venue":null,"work_id":"8bbe7b24-c929-4276-b49d-c9d1bc4f5846","year":2021},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.730951Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:d28e7636af5a40582b9cf8fc27a94fb09d6da8c3c91c6db11e1d4f76bb8e47b9","observation_id":"ae4e5af4-3bae-48d6-8401-5fd62c6a89fd","resolution":{"observed_at":"2026-08-07T18:56:26.239619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.227140Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":"0da42e20-13a8-4544-acfd-d58bb2ed6dfa","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.733575Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:b95cf6a2a36c70b35222747a6c14e85331ba474a82905bb95a250bbbec623176","observation_id":"7ae281c4-0daf-4fd3-b02b-6b1b3b661666","resolution":{"observed_at":"2026-08-07T18:56:26.230551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.736092Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.736092Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:a67e3f05ab7f7f94e5f9281f32ab1440809bebd9e68098303900668aa35f0389","observation_id":"e76563ae-c4b3-41fc-996c-eef5fdc14266","resolution":{"observed_at":"2026-08-07T18:56:25.736092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15861","last_updated":"2025-06-02T23:58:41Z","snapshot_observed_at":"2026-07-06T18:19:33.945119Z","submitted_at":"2024-05-24T18:07:05Z","title":"Achieving Dimension-Free Communication in Federated Learning via Zeroth-Order Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15861","snapshot_observed_at":"2026-08-07T18:56:25.738618Z","title":"Achieving dimension-free communication in federated learning via zeroth-order optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.738618Z"},"links":{"cited_paper":"/paper/2405.15861","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:66707f090a8c6235455fdd4fd2c686eac4f8c2edc70837c5022c1f7c9475f7db","observation_id":"ec52d13b-8c53-41d3-909a-9585e84126d7","resolution":{"observed_at":"2026-08-07T18:56:25.738618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.218075Z","title":"On the convergence of zeroth-order federated tuning for large language models","venue":null,"work_id":"bb80593c-4211-4ebd-b0b6-1ece806e177c","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.741331Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:3579e3f07ef1633ac82cbdf3d727b30eba6d23e076d8c41a712cbb010c0440ad","observation_id":"0573a939-d2d1-484c-8668-af2af531dc9c","resolution":{"observed_at":"2026-08-07T18:56:26.221401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T18:56:25.744241Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.744241Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:fdfab8a3984d5067ff1e95e9a3be5912b4a073045307f37b144a3b4ef700bc73","observation_id":"542c8775-7e0d-4e58-8b0c-95110b477550","resolution":{"observed_at":"2026-08-07T18:56:25.744241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.208995Z","title":"D., Chen, D., and Arora, S","venue":null,"work_id":"b12562e7-0498-4bf2-89b3-b81014f86fa0","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.748033Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:1ed9cec31a759058740e81b355da96dbbb88c789a3bb8565739f5a3178467e33","observation_id":"22b1d21e-5e63-4a02-871c-eb11e623aa0a","resolution":{"observed_at":"2026-08-07T18:56:26.212047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.751311Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.751311Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:a386e026b4072e1085c86706299533d29329402249448f8294777920773c2a5d","observation_id":"f607d714-8a9d-40a5-8185-73e49022648f","resolution":{"observed_at":"2026-08-07T18:56:25.751311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.194161Z","title":"Black-box generalization: Stability of zeroth-order learning","venue":null,"work_id":"80f5f61e-da63-4dfa-9032-790c667c5751","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.754547Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:027f050be69b7ef767c4bf87f13298f2bff9e00439a8745feb67bacc1ebaf509","observation_id":"d515c248-a362-4a4e-8fee-20e8b908e014","resolution":{"observed_at":"2026-08-07T18:56:26.197495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15551","last_updated":"2024-10-22T13:32:59Z","snapshot_observed_at":"2026-08-03T13:03:28.655617Z","submitted_at":"2024-05-24T13:37:48Z","title":"Thinking Forward: Memory-Efficient Federated Finetuning of Language Models","version":2},"cited_work":{"arxiv_id":"2405.15551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15551","snapshot_observed_at":"2026-08-07T18:56:25.919701Z","title":"Thinking Forward: Memory-Efficient Federated Finetuning of Language Models","venue":"cs.LG","work_id":"ff9c503f-4420-4cfa-a768-0d1400cf3fc5","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.758042Z"},"links":{"cited_paper":"/paper/2405.15551","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:dc5d8abc464537dc7247eb834b8f2eb72fa5102a57e6d209aae92a65765ee603","observation_id":"7dd17cb2-150d-4f3d-bc22-38a21740f023","resolution":{"observed_at":"2026-08-07T18:56:25.923898Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.184346Z","title":"Aggregating capacity in fl through successive layer training for computationally-constrained devices","venue":null,"work_id":"151cf4df-4a11-46ff-bcfe-b4ed7d718104","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.761967Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:4cc2d9d6deafe16429dbe8e2cd3ab83f387e7bf2b362c2d2103714dcb6036d76","observation_id":"6e039505-fcb6-47d0-a741-07a2fa020ae5","resolution":{"observed_at":"2026-08-07T18:56:26.187931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.174889Z","title":"Federated learning for computationally constrained heterogeneous devices: A survey","venue":null,"work_id":"8ad1ca3e-abcf-4387-a8c4-631b47653f1f","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.765269Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:7d96640719b20c602bb30ef5905ccf16d2c588d5c4eb9956be47d628b13c94fd","observation_id":"3433cf1c-7853-436b-830e-2d7fa4cee584","resolution":{"observed_at":"2026-08-07T18:56:26.178270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.768674Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.768674Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:e078fd763632e84f53a6144f0e1ee905c03c49ecf449bb269a5e26740ce53dde","observation_id":"19f6ef8b-e32f-496f-96e2-629da07d62bc","resolution":{"observed_at":"2026-08-07T18:56:25.768674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.163785Z","title":"Federated full-parameter tuning of billion-sized language models with communication cost under 18 kilobytes","venue":null,"work_id":"bb89acba-6d90-4dd3-81c7-b75eeb833362","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.771856Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:cf2ab177c1368d35d99d7ba19491d7d8897f69b604c7ccf7df32d151f3b5948d","observation_id":"aafa219e-5b2c-492d-bd21-36e4b66055bb","resolution":{"observed_at":"2026-08-07T18:56:26.167833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.152702Z","title":null,"venue":null,"work_id":"402d1dbe-840d-4517-8d24-6d0669ffd270","year":2020},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.775068Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:9f6e2d202289aa74691f5f74798f7955d945ecd9b2055bc8e60f83ec0aa13dd6","observation_id":"638aad1e-bdd0-4ef6-afca-80fca62c70cb","resolution":{"observed_at":"2026-08-07T18:56:26.156503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.778192Z","title":"D., Ng, A","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.778192Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:e2af3e6d496b9bc5680bc8c2fe1bd0b2ca8d00625b043b8fbee931ab9425f1fd","observation_id":"567397c8-6538-4c19-90d5-9e3f9b55a08a","resolution":{"observed_at":"2026-08-07T18:56:25.778192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.134659Z","title":null,"venue":null,"work_id":"2d01c49d-9f75-4bbf-b2b0-da010f132516","year":1992},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.781567Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:0fe15cd7db13274550c63ad6012f1ab956021138de00161a9b98d79f08c8e6ab","observation_id":"3079c42e-094a-4f4a-a9a8-ef00d831b47a","resolution":{"observed_at":"2026-08-07T18:56:26.138569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02876","last_updated":"2020-01-31T05:36:19Z","snapshot_observed_at":"2026-08-04T17:00:21.940834Z","submitted_at":"2019-06-07T03:09:23Z","title":"Compressing RNNs for IoT devices by 15-38x using Kronecker Products","version":5},"cited_work":{"arxiv_id":"1906.02876","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.02876","snapshot_observed_at":"2026-08-07T18:56:25.903944Z","title":"Compressing RNNs for IoT devices by 15-38x using Kronecker Products","venue":"cs.LG","work_id":"1e502778-d683-43c4-a81b-9929b76d687e","year":2019},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.785505Z"},"links":{"cited_paper":"/paper/1906.02876","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:8837d4f488afbd28f82fa018291b7a93dd5e00d8835bad440cfaa548ef489049","observation_id":"72a4e809-3c9b-4feb-9910-74cef78935f9","resolution":{"observed_at":"2026-08-07T18:56:25.909284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.124223Z","title":"Progfed: effective, communication, and computation efficient federated learning by progressive training","venue":null,"work_id":"c6e7da50-4e47-42d9-a3bf-d6d1b6abbbfc","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.788892Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:b43a484e7b456b6c4198974330816fbc771d24c8c697da34f38c4b2c4bfb17d5","observation_id":"f2019943-4e9b-4a09-9902-960778133100","resolution":{"observed_at":"2026-08-07T18:56:26.127830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.113398Z","title":"FwdLLM : Efficient federated finetuning of large language models with perturbed inferences","venue":null,"work_id":"02684710-66cc-4c6c-a923-07ff84578c2b","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.791922Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:0988069d6b3c7720b8b0d73f885a65a23abf07d34e970fa1da9b3693587c5054","observation_id":"9a8765f3-f07f-454d-8c6e-896dd2650a09","resolution":{"observed_at":"2026-08-07T18:56:26.117193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:47:41.623584Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":14},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2502.10239."}