{"as_of":"2026-08-07T22:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6eea8733b2646f4e87530fcb1d92f3af2b02e9ce1975d7d90dbcca70eddeb07e","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:20:44.314849Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05977/citation-record","integrity":"/paper/2506.05977/integrity","json":"/paper/2506.05977/citation-record.json","paper":"/paper/2506.05977"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:41.025430Z","title":"Bert: Pre- training of deep bidirectional transformers for language under- standing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.025430Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:d4bb7390d8b03e8f55ab2db0c817dd5006115bf3b056fef66732d07331c88c0b","observation_id":"8e7989be-275f-4eba-afb3-4cdfd5a77e07","resolution":{"observed_at":"2026-08-07T10:20:41.025430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.885531Z","title":"Lan- guage models are few-shot learners,","venue":null,"work_id":"48826dd1-2706-440e-930a-2bfc8814ce9c","year":1901},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.078671Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:bd896230d1087931926ae88e8994a010b1d8ea24093c46f421724e499d5f2c01","observation_id":"6a073708-2e4c-491a-bc7c-bd40cd4ff01b","resolution":{"observed_at":"2026-08-07T10:20:44.889053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.876332Z","title":"Privacy-preserving deep learning,","venue":null,"work_id":"52e9f0be-3da2-474b-9af3-5e823b40a30d","year":2015},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.145376Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:4968eed709fa11c84b9c7cd479f840685067d7d8063060f25df24f2d85272e7b","observation_id":"6b588d7f-2cc0-4fd1-9418-3e63beed8d31","resolution":{"observed_at":"2026-08-07T10:20:44.879825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08815","last_updated":"2022-05-06T10:05:52Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T11:04:49Z","title":"FedNLP: Benchmarking Federated Learning Methods for Natural Language Processing Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08815","snapshot_observed_at":"2026-08-07T10:20:41.197763Z","title":"Fednlp: Benchmarking federated learning methods for natural language processing tasks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.197763Z"},"links":{"cited_paper":"/paper/2104.08815","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:578b92178b0457273c3599ffb2216af4c9847eaff386aeddd1d397bc9a24c879","observation_id":"fca55663-de64-493e-b8c3-5b7e5d46e2d2","resolution":{"observed_at":"2026-08-07T10:20:41.197763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:41.253080Z","title":"Parameter- efficient transfer learning for nlp,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.253080Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:a8cc49e7e6b0063e4f000687b918e1cf5aac3f282d62b60ccffb201719609d3e","observation_id":"9b42795e-291e-402c-81ba-8abbaa9a1e1d","resolution":{"observed_at":"2026-08-07T10:20:41.253080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10162","last_updated":"2023-05-08T19:50:56Z","snapshot_observed_at":"2026-07-06T13:12:05.091944Z","submitted_at":"2022-05-20T13:10:43Z","title":"FedAdapter: Efficient Federated Learning for Modern NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10162","snapshot_observed_at":"2026-08-07T10:20:41.314544Z","title":"Fedadapter: Efficient federated learning for modern nlp,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.314544Z"},"links":{"cited_paper":"/paper/2205.10162","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:92bc2ce860b57a5ed25da35ae52dd5404b27addf8953be09d74aa3aca83e019d","observation_id":"89a7bf9b-f8fd-4e85-8206-4f94cdac08d7","resolution":{"observed_at":"2026-08-07T10:20:41.314544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:41.370528Z","title":"Fedpetuning: When federated learning meets the parameter- efficient tuning methods of pre-trained language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.370528Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:b177b076ca16cfda532f3f3d269a7c7b0ecc58e4c5ad69c0ca77435d63f63dbd","observation_id":"4b0a628f-0c83-4bd0-ad1a-203bb36e1e16","resolution":{"observed_at":"2026-08-07T10:20:41.370528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.855244Z","title":"A continual learn- ing survey: Defying forgetting in classification tasks,","venue":null,"work_id":"b15f1f99-497e-4137-b6cd-cfc2173293cd","year":2021},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.434510Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:66be074e6059b17eb759ca4c68cd8d25f89b30a6debf4307eb0ee3ee118adc92","observation_id":"eb8d961e-2ddc-41d8-a4f3-e565eb5492f8","resolution":{"observed_at":"2026-08-07T10:20:44.858594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.846580Z","title":"Remind your neural network to prevent catastrophic forgetting,","venue":null,"work_id":"a34c18d9-fd15-4b89-a630-b9a23ab97661","year":2020},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.488208Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:4d4dcadd8869dbcb685f84edf7d31591db685f089ee6294990399d98f481ad91","observation_id":"5ea4babe-b910-4677-935c-3e6f87449425","resolution":{"observed_at":"2026-08-07T10:20:44.849415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.836814Z","title":"Rotate your networks: Better weight consoli- dation and less catastrophic forgetting,","venue":null,"work_id":"f45a3079-91d7-4e6e-bdba-814d1d850365","year":2018},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.522673Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:e4d93b4deda7b253f9eea633d36b7a5a1e036db200f58d89ca3d8d6d04bf5882","observation_id":"3ebcd6f0-38e6-4563-ace7-64afaa2034b3","resolution":{"observed_at":"2026-08-07T10:20:44.840223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:41.578519Z","title":"Universal statistics of fisher information in deep neural networks: Mean field approach,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.578519Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:2631a186b9e1643871bff22eea8df776206b0626b778dc565397f9d63aef2e19","observation_id":"ded8160d-0d67-42b8-a2ba-6c957ffa208a","resolution":{"observed_at":"2026-08-07T10:20:41.578519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07796","last_updated":"2019-10-17T09:53:16Z","snapshot_observed_at":"2026-07-06T08:30:13.270403Z","submitted_at":"2019-10-17T09:53:16Z","title":"Overcoming Forgetting in Federated Learning on Non-IID Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07796","snapshot_observed_at":"2026-08-07T10:20:41.635905Z","title":"Overcoming forgetting in federated learning on non-iid data,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.635905Z"},"links":{"cited_paper":"/paper/1910.07796","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:a1e94eafe4b74e9b29f51375a9ca6401ddd505971156e63aa294f05719eaafeb","observation_id":"c8c0f7a9-6a56-453f-85f7-aef880161bc1","resolution":{"observed_at":"2026-08-07T10:20:41.635905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00582","last_updated":"2022-07-21T12:33:15Z","snapshot_observed_at":"2026-07-06T06:42:35.645776Z","submitted_at":"2018-06-02T04:45:58Z","title":"Federated Learning with Non-IID Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.00582","snapshot_observed_at":"2026-08-07T10:20:41.687790Z","title":"Feder- ated learning with non-iid data,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.687790Z"},"links":{"cited_paper":"/paper/1806.00582","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:5fc53b45a0b609e429becd2566b08c948b777e00b8c93271ef4c9d90459f0883","observation_id":"2116c57e-c612-49f0-8795-ba86b3bf6e38","resolution":{"observed_at":"2026-08-07T10:20:41.687790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.04977","last_updated":"2021-03-09T03:03:49Z","snapshot_observed_at":"2026-08-06T02:25:34.414976Z","submitted_at":"2019-12-10T20:55:41Z","title":"Advances and Open Problems in Federated Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.04977","snapshot_observed_at":"2026-08-07T10:20:41.755889Z","title":"Advances and open problems in federated learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.755889Z"},"links":{"cited_paper":"/paper/1912.04977","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:351b044104ea95449623d068c69d4581d33852379d7b54e252c3110e1fb98790","observation_id":"adba4859-13bd-4ec5-a6a3-bb73439f9cc2","resolution":{"observed_at":"2026-08-07T10:20:41.755889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.822314Z","title":"Fed- erated multi-task learning under a mixture of distributions,","venue":null,"work_id":"1f5f8512-170a-4f19-a55a-0f459433b1f9","year":2021},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.806989Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:3643cfb21c7f5cb4685634fc2c58bf5cccc49fcc0b7dd5d6b70c44e847ec42f2","observation_id":"e2c72a2d-3c79-4ae4-862a-0038ff48902d","resolution":{"observed_at":"2026-08-07T10:20:44.825717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.809931Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":"9d172d7e-31b2-42e9-a2f8-bd555c05aa7b","year":2020},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.873617Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:94af23f49c9a6fdd43dab79eb29f3bc5e882cca2df4b1b364c37a007c602b611","observation_id":"93d733b5-db75-4118-8e0e-f5c9ae87a175","resolution":{"observed_at":"2026-08-07T10:20:44.814584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.799258Z","title":"Keystrokesniffer: An off-the-shelf smart- phone can eavesdrop on your privacy from anywhere,","venue":null,"work_id":"c12857f6-f95d-430b-8ccc-ffea68e9f387","year":2024},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.925537Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:8476d9d489149ab4000511ddb93e4b031f8817ea45356bed225b22c22dd9f751","observation_id":"93329547-11f0-4ce7-b709-9fa372773a61","resolution":{"observed_at":"2026-08-07T10:20:44.803090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.788135Z","title":"Communication-efficient learning of deep networks from decentralized data,","venue":null,"work_id":"12914326-2027-471a-a9b6-a94f05f3b6ad","year":2017},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:41.997397Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:5858462ba19d1d442f028357320357bd85019ac439b5d0f9135a3a6b69f5235e","observation_id":"690f84a7-5171-4871-8036-9acbe11b0ec1","resolution":{"observed_at":"2026-08-07T10:20:44.792289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:42.048299Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.048299Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:bf3e961d8e6a689bd524587985c1619bfdf39c6f65e9093d39d3e86abe36e79a","observation_id":"aa5cf4f8-74f8-4510-b600-24c55d6b977e","resolution":{"observed_at":"2026-08-07T10:20:42.048299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.770630Z","title":"Feder- ated continual learning via knowledge fusion: A survey,","venue":null,"work_id":"c3bb3760-f8c5-40b3-a9b3-616fb5dc1ecc","year":2024},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.119834Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:90265260d84f1d33dd6893231401d512ae0158d2d7fe74761f4c0957e89c44ee","observation_id":"5d0e08a3-511f-43b8-8cae-6e8fa67abea7","resolution":{"observed_at":"2026-08-07T10:20:44.774279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T10:20:42.186295Z","title":"Roberta: A ro- bustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.186295Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:084471480400ff5d24058ab0490c7b8ebc58a3cf0d8e66a9f07cb855989dce99","observation_id":"aee33326-37ac-472a-9e96-898b35157382","resolution":{"observed_at":"2026-08-07T10:20:42.186295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.759412Z","title":"Mrpc: Maximizing network lifetime for reliable routing in wireless environments,","venue":null,"work_id":"1ce1c18e-2108-4066-b7ee-9785df248ca8","year":2002},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.245562Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:cb9180bcdaec45ac119f40c231d45814df6401962f43898f89793edea107169b","observation_id":"90fd6c84-ddfe-4a3f-ada3-36ee8318e6e2","resolution":{"observed_at":"2026-08-07T10:20:44.763032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:42.335506Z","title":"The pascal recognising textual entailment challenge,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.335506Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:bff8c5d4687b776a1ddd2f510e1deca33551e0c53fe692f69302380e2721273b","observation_id":"2cc60a94-7886-4b0b-b371-a5c180a0b30d","resolution":{"observed_at":"2026-08-07T10:20:42.335506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:42.440764Z","title":"Recursive deep models for semantic compo- sitionality over a sentiment treebank,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.440764Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:02e716db89cae55eb07dd66ccb37ffcf79fec813b9d36aef6a415e87e8a19611","observation_id":"0e54edf6-f099-4f05-befb-ac9e3306a783","resolution":{"observed_at":"2026-08-07T10:20:42.440764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-07T10:20:42.549323Z","title":"Squad: 100,000+ questions for machine comprehension of text,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.549323Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:f989391f740bab1b81e59dac5c9b2c16722d9d15487d8c41b9c1d77b1d86e765","observation_id":"2a3b7248-61b6-49bd-9f84-f71d314bdd0f","resolution":{"observed_at":"2026-08-07T10:20:42.549323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06335","last_updated":"2019-09-13T17:26:20Z","snapshot_observed_at":"2026-08-02T11:40:53.964079Z","submitted_at":"2019-09-13T17:26:20Z","title":"Measuring the Effects of Non-Identical Data Distribution for Federated Visual Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06335","snapshot_observed_at":"2026-08-07T10:20:42.666302Z","title":"Measuring the effects of non- identical data distribution for federated visual classification,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.666302Z"},"links":{"cited_paper":"/paper/1909.06335","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:0a33bfcbc1d3ab3384f1b27697b07547a124da4f7b7b44eb8ce1c45d5ba02e73","observation_id":"ab838895-184c-486e-a8de-16ee990b13d6","resolution":{"observed_at":"2026-08-07T10:20:42.666302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.736229Z","title":"Finch: Enhancing federated learning with hierarchical neural architecture search,","venue":null,"work_id":"074bd925-ceaf-4183-b368-6863527e8ee0","year":2023},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.775828Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:d0cfc7ce75ad59828a83eae7cf1f88dde1f9ff7cdfa9fac4d670f479b4ae0399","observation_id":"ad331533-cc8e-46a6-aab7-7f4770f9b7cd","resolution":{"observed_at":"2026-08-07T10:20:44.739904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.724729Z","title":"A continual learning survey: Defy- ing forgetting in classification tasks,","venue":null,"work_id":"9d40c235-6f13-4634-9804-c9948d6c3b83","year":2022},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.900985Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:46d074e8203d82b168ab3d533b6994e24a74e18a1482056553cad96d4d777e57","observation_id":"9d2af3fd-6ed9-4981-a7c4-d32749725bf9","resolution":{"observed_at":"2026-08-07T10:20:44.728566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.04686","last_updated":"2020-07-09T10:29:19Z","snapshot_observed_at":"2026-07-06T09:36:49.009695Z","submitted_at":"2020-07-09T10:29:19Z","title":"Greedy Transition-Based Dependency Parsing with Discrete and Continuous Supertag Features","version":1},"cited_work":{"arxiv_id":"2007.04686","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.04686","snapshot_observed_at":"2026-08-07T10:20:44.466581Z","title":"Greedy Transition-Based Dependency Parsing with Discrete and Continuous Supertag Features","venue":"cs.CL","work_id":"7401e943-f5d1-4a02-9ea8-92445fadcba5","year":2020},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:42.998098Z"},"links":{"cited_paper":"/paper/2007.04686","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:555ba3cb9ab1a4e6d829b1fe0876763f5d59ab395b74582c84a123d1abc8cf85","observation_id":"ff7b2292-ec87-43d5-ba5e-28afb7217eb7","resolution":{"observed_at":"2026-08-07T10:20:44.566498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.712334Z","title":"Docker: lightweight linux containers for consis- tent development and deployment,","venue":null,"work_id":"2ec66927-4887-4bfb-b519-03f5d49246c6","year":2014},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.121543Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:58ce4f79e3826bbe68f2d5d42bc7e45714ab322ea011b00f6715c3f88d9ff538","observation_id":"53cbfe32-4bc5-48a5-b1cb-65eb060fa411","resolution":{"observed_at":"2026-08-07T10:20:44.716858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-07T10:20:43.291216Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.291216Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:cdeaacaec59e9dce38af607f2cfbd912fc358903909fe312bbd0f8b505b45138","observation_id":"01095f96-b86c-496b-aca8-ed5a018ec02e","resolution":{"observed_at":"2026-08-07T10:20:43.291216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.700272Z","title":"Gropp, E","venue":null,"work_id":"b523e37b-b2f5-4888-bd3d-fc317851ec77","year":1999},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.437095Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:2c41e4ed254af98bbb10c8b62c21cd8f569a9a4bfa40b4943ce480605b74208b","observation_id":"e0d3681a-2d60-4ec2-9a7a-98c6aeb252dd","resolution":{"observed_at":"2026-08-07T10:20:44.704760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:43.520276Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.520276Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:eb497e46de9bbc1e1b40cbcbfd2577f38351f721b241a8acdc265454b3447b90","observation_id":"f57db4d1-6fbe-4756-8eda-15e7d7c738e6","resolution":{"observed_at":"2026-08-07T10:20:43.520276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T10:20:43.616080Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.616080Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:676cf738ed40d47b4bb7f4ae8004ea9f8e80077458ea2147ad7396c4e9d5e607","observation_id":"4dcfed52-858a-4f1e-b498-cc52ccd61a0f","resolution":{"observed_at":"2026-08-07T10:20:43.616080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:43.783083Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.783083Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:052bb81e8622e87a9c994536cb34964dc6b437cf4667659abd58aee88b0eb103","observation_id":"713c8e8d-d4c2-45e3-82de-a8dd93c1fd5e","resolution":{"observed_at":"2026-08-07T10:20:43.783083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.673179Z","title":"Eu general data protection regulation,","venue":null,"work_id":"95e7a953-5128-4b89-a126-1c8ed8051814","year":2016},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.865100Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:f2e69716ffa044847c9a70b686250d76a01d3a6b4b15589343ae3969c404edd3","observation_id":"40d2ae4b-c086-4361-bcca-a158e2e9bef9","resolution":{"observed_at":"2026-08-07T10:20:44.676969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-07T10:20:43.982783Z","title":"The power of scale for parameter-efficient prompt tuning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:43.982783Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:45882eaaf0fcfcf2adb983680cf6022491b14ba40ae52e5816c5dd63e75773cf","observation_id":"49b84c43-d161-48f0-9f9b-af49f49bac73","resolution":{"observed_at":"2026-08-07T10:20:43.982783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.662680Z","title":"Adaptive local update and neural composition for accelerating federated learning in heterogeneous edge networks,","venue":null,"work_id":"5fb7398e-c26c-4f89-9d15-f806325aff48","year":2025},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:44.153436Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:d44bb651ad8d1ed7d4e2e7d2054d1bb50018b9e8b792c1ec74a15d6c756e0aaf","observation_id":"2319d893-5c46-425a-b189-d2fb0896da3c","resolution":{"observed_at":"2026-08-07T10:20:44.666383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:20:44.651951Z","title":"Enhancing semi-supervised federated learning with progressive training in heterogeneous edge computing,","venue":null,"work_id":"37548215-408f-4dfa-bc82-a164769c01d3","year":2024},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:44.263005Z"},"links":{"citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:10bb375f308ed1262144af62373f31ac76e1fc17da396e8f3da02c5e47cf8ed2","observation_id":"ec7708fc-e3db-44c7-931c-8a71dc61a8cc","resolution":{"observed_at":"2026-08-07T10:20:44.655677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09979","last_updated":"2024-03-08T13:13:54Z","snapshot_observed_at":"2026-07-06T17:03:02.786273Z","submitted_at":"2023-12-15T17:45:06Z","title":"LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09979","snapshot_observed_at":"2026-08-07T10:20:44.314849Z","title":"Loramoe: Revolutionizing mixture of experts for maintaining world knowledge in language model alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:20:44.314849Z"},"links":{"cited_paper":"/paper/2312.09979","citing_paper":"/paper/2506.05977"},"observation_digest":"sha256:65823481ed38ba7ff19e4282a45296084656c683c2e206e8c17620e09ecf3ded","observation_id":"f3dd5a99-7c92-4c8a-8c42-7393d198d7ce","resolution":{"observed_at":"2026-08-07T10:20:44.314849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05977","last_updated":"2025-06-06T10:59:11Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:10:50.554198Z","submitted_at":"2025-06-06T10:59:11Z","title":"Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.05977."}