{"as_of":"2026-08-08T10:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4d3afb9e32b27b6e635664568408537fb0ba726acdb18f43c34b96ec7a159f83","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:09:16.082796Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:01:46.458539Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:51:07.429970Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"cited_work":{"arxiv_id":"2506.00495","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00495","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Floe: Fisher-based layer selection for efficient sparse adaptation of low-rank experts","venue":null,"work_id":"b326173b-5a35-4b60-ab02-d122997a90e7","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2506.00495","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e6a0a88b2776d663767386fa429e69efb5109c9cae207c46f5afe9230c96c858","observation_id":"cf0213bb-963b-4605-99a1-ce6dd3a2fdce","resolution":{"observed_at":"2026-05-11T18:51:07.433669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00495","snapshot_observed_at":"2026-08-02T09:01:46.458539Z","title":"arXiv preprint arXiv:2506.00495 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19391","last_updated":"2026-07-02T19:01:59Z","snapshot_observed_at":"2026-08-06T10:12:22.643827Z","submitted_at":"2026-07-02T19:01:59Z","title":"LAARA: Layer-Aware Adaptive Rank Allocation for Parameter-Efficient Fine-Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T09:01:46.458539Z"},"links":{"cited_paper":"/paper/2506.00495","citing_paper":"/paper/2607.19391"},"observation_digest":"sha256:461bfc2e2022b5610fbc182cc73a6ae79b1958f7e514cb775327dd90956504a9","observation_id":"5d6a5c94-e727-46c0-9243-badeb91d54df","resolution":{"observed_at":"2026-08-02T09:01:46.458539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00495/citation-record","integrity":"/paper/2506.00495/integrity","json":"/paper/2506.00495/citation-record.json","paper":"/paper/2506.00495"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:20.493158Z","title":"Optuna: A next- generation hyperparameter optimization framework","venue":null,"work_id":"66caef55-4968-4eab-ba2b-768c06fd2a7b","year":2019},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.634049Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ffde43491c1701126a1500ca497960f904bc14fa2b5f0e3c31867fd17200f391","observation_id":"7683bbbb-542d-4a21-99f3-248b5425294d","resolution":{"observed_at":"2026-08-07T12:09:20.579934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:20.320689Z","title":"Lawyer-instruct, 2024","venue":null,"work_id":"5f6279a1-e188-491d-a756-3de93f7a438e","year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.693806Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:b419361fd9db1461bda81a9e5e5fe41a7a1d1838761b99724a9d7d2596c7b970","observation_id":"0ad25361-6050-4fc0-9571-b5c1b08b8c91","resolution":{"observed_at":"2026-08-07T12:09:20.398749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07507","last_updated":"2023-05-22T18:20:54Z","snapshot_observed_at":"2026-08-08T08:04:45.541488Z","submitted_at":"2023-05-12T14:21:38Z","title":"LeXFiles and LegalLAMA: Facilitating English Multinational Legal Language Model Development","version":2},"cited_work":{"arxiv_id":"2305.07507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.07507","snapshot_observed_at":"2026-08-07T12:09:17.736596Z","title":"LeXFiles and LegalLAMA: Facilitating English Multinational Legal Language Model Development","venue":"cs.CL","work_id":"e0f3c1a5-0477-447a-9ceb-93d74aacb57d","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.782813Z"},"links":{"cited_paper":"/paper/2305.07507","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:7490ec48d9b022d5794a2371a7bc1e9541e8d756e375c4079d50985b060eff23","observation_id":"1ef382ed-9a9a-40cb-b28a-92d33167cddd","resolution":{"observed_at":"2026-08-07T12:09:17.823694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:20.107375Z","title":"Code alpaca: An instruction-following llama model for code generation","venue":null,"work_id":"68822eb1-f400-4d8e-bd8d-365d6a301b00","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.847185Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:cc9262fa17fba252b14748c64ce3d24766facb1385ce194cf863c49124c5cd76","observation_id":"c6c3ea2a-3dc2-47b0-84d3-79e2ede3326e","resolution":{"observed_at":"2026-08-07T12:09:20.209464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T12:09:11.903523Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.903523Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:2321f58b9aca3d2364322e52d45e86813a4ba84f33bf24944962b53f82002c1e","observation_id":"b66aaec8-d160-43ba-bfb3-e2c5a3e8e6e6","resolution":{"observed_at":"2026-08-07T12:09:11.903523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12307","last_updated":"2024-03-08T15:26:38Z","snapshot_observed_at":"2026-07-06T16:21:57.649550Z","submitted_at":"2023-09-21T17:59:11Z","title":"LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12307","snapshot_observed_at":"2026-08-07T12:09:12.021487Z","title":"Longlora: Efficient fine-tuning of long-context large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.021487Z"},"links":{"cited_paper":"/paper/2309.12307","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:575b21fffab970d275bb5279c408013b4a80d95f35a063ba68f76d4240a71145","observation_id":"2d0ef40b-9c6f-4ca2-9015-ee2215dd5902","resolution":{"observed_at":"2026-08-07T12:09:12.021487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T12:09:12.137416Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.137416Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:50b1dca2edc9023b003c840929da215052ae5a7b8d61dad921718a67fa977706","observation_id":"c09ad824-72cd-46f1-aca0-212920c393dc","resolution":{"observed_at":"2026-08-07T12:09:12.137416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11696","last_updated":"2023-11-20T11:56:25Z","snapshot_observed_at":"2026-08-04T08:07:45.481643Z","submitted_at":"2023-11-20T11:56:25Z","title":"Sparse Low-rank Adaptation of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11696","snapshot_observed_at":"2026-08-07T12:09:12.204135Z","title":"Sparse low-rank adaptation of pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.204135Z"},"links":{"cited_paper":"/paper/2311.11696","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:7d7136161472f16c5af685bc365fc8ee2d88fb08af0bfe2e5854a19b432c83d2","observation_id":"ea3c9c56-9ebb-4ecf-9443-872ff52aae0f","resolution":{"observed_at":"2026-08-07T12:09:12.204135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09979","last_updated":"2024-03-08T13:13:54Z","snapshot_observed_at":"2026-07-06T17:03:02.786273Z","submitted_at":"2023-12-15T17:45:06Z","title":"LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09979","snapshot_observed_at":"2026-08-07T12:09:12.260399Z","title":"Loramoe: Alleviate world knowledge forgetting in large language models via moe-style plugin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.260399Z"},"links":{"cited_paper":"/paper/2312.09979","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:57eb2e3a22629e9cd2e8c2446ffc8e086f2437e7ee93e731e4900fe756e2a754","observation_id":"82c30370-8b25-41b2-81ec-59f267d1155f","resolution":{"observed_at":"2026-08-07T12:09:12.260399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16710","last_updated":"2024-10-18T04:02:31Z","snapshot_observed_at":"2026-08-08T01:15:44.293937Z","submitted_at":"2024-04-25T16:20:23Z","title":"LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16710","snapshot_observed_at":"2026-08-07T12:09:12.308512Z","title":"Layer skip: Enabling early exit inference and self-speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.308512Z"},"links":{"cited_paper":"/paper/2404.16710","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:833966ef780a7639ea3a2188179434e119e5597f4c598304100f6c0117a77d09","observation_id":"0113ec4d-12cc-47a3-a9ee-8541f257414a","resolution":{"observed_at":"2026-08-07T12:09:12.308512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.891037Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":"de62d5fd-9653-4d0e-a858-8e019b756893","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.426724Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:d1ef723f0b2db6a64d3d63ceae8e551123b1a4f45505aaaf42aa9da63268ee42","observation_id":"13e82321-11c0-4552-aca1-724394c2d4d1","resolution":{"observed_at":"2026-08-07T12:09:19.998930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.673368Z","title":"MoLA: MoE LoRA with layer-wise expert allocation","venue":null,"work_id":"636c9e06-e516-4c72-8835-49edc3e6f4b2","year":2025},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.548266Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ceec497b32398d00f9bc2fa47c620738f5e1b10dbb07ca79aa4eb84ceecca27a","observation_id":"99355fc6-1aec-49fa-933d-c834be2ef5b3","resolution":{"observed_at":"2026-08-07T12:09:19.761730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12354","last_updated":"2024-07-04T18:33:00Z","snapshot_observed_at":"2026-08-03T17:12:16.534784Z","submitted_at":"2024-02-19T18:33:49Z","title":"LoRA+: Efficient Low Rank Adaptation of Large Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12354","snapshot_observed_at":"2026-08-07T12:09:12.683982Z","title":"Lora+: Efficient low rank adaptation of large models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.683982Z"},"links":{"cited_paper":"/paper/2402.12354","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:006e09cef308186411b5e560d3d6e34229356e34b130f51b775ceda3645168cd","observation_id":"a7539167-998f-4850-97f6-2d71c6791861","resolution":{"observed_at":"2026-08-07T12:09:12.683982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T12:09:12.747324Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.747324Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:e147b978c35968f80ca8fa2a5b11f0e51111fcbffabfec4f42d96871c2e80377","observation_id":"35191f7c-ee29-4acb-b4d7-5ac735ccebf7","resolution":{"observed_at":"2026-08-07T12:09:12.747324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T12:09:12.828043Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.828043Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:1a8e74a2fd7ecad12c267ca6652462a1ea3097647e48b2535318828d99938d1c","observation_id":"65d3186f-8a03-4440-a8e6-a798f8ac1388","resolution":{"observed_at":"2026-08-07T12:09:12.828043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-07-06T15:58:08.777051Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-07T12:09:12.947347Z","title":"Lorahub: Efficient cross-task generalization via dynamic lora composition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.947347Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:daa158a31e56e1c69455fb3568814dcf48bca0c7ece4ec63e021ee45218cb113","observation_id":"59efa1c4-7256-4603-85e4-1dddbf36c5c0","resolution":{"observed_at":"2026-08-07T12:09:12.947347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.039183Z","title":"Adaptive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.039183Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:83572dbbbeb47396b88b1a39c40cdfd281835d8e98f43d2a728d045c3c247eca","observation_id":"6ff322d2-0b8e-4641-885d-63f033c2b1e1","resolution":{"observed_at":"2026-08-07T12:09:13.039183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.497778Z","title":"Identifying and mitigating vulnerabilities in llm-integrated applications","venue":null,"work_id":"4fdfbe71-6462-4b35-9f5e-c7ad4213658b","year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.137198Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:bd3fc5e4bcbff9cdc347e35a5b7b768f345bb0f117ddb5b6d555df97a6f40e3f","observation_id":"8d115b63-0b99-4016-91a5-b56091d284de","resolution":{"observed_at":"2026-08-07T12:09:19.538346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12130","last_updated":"2024-05-20T15:48:32Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T15:48:32Z","title":"MoRA: High-Rank Updating for Parameter-Efficient Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12130","snapshot_observed_at":"2026-08-07T12:09:13.194756Z","title":"Mora: High-rank updating for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.194756Z"},"links":{"cited_paper":"/paper/2405.12130","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:99efc639c1533d3c72ea11ed931dc6c38320e04fc60879d41704ab765c44185b","observation_id":"15d9fede-8697-47c9-b17f-cd54e020620f","resolution":{"observed_at":"2026-08-07T12:09:13.194756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06354","last_updated":"2023-07-02T12:28:46Z","snapshot_observed_at":"2026-08-07T00:32:55.572406Z","submitted_at":"2023-02-13T13:38:46Z","title":"Less is More: Selective Layer Finetuning with SubTuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06354","snapshot_observed_at":"2026-08-07T12:09:13.253965Z","title":"Less is more: Selective layer finetuning with subtuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.253965Z"},"links":{"cited_paper":"/paper/2302.06354","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:a275a31a1637fba15ba6f9166e50e59bf77b8e899aab7eecd72726075812735a","observation_id":"7073d266-c72e-4a0b-999c-6545f0ca91c1","resolution":{"observed_at":"2026-08-07T12:09:13.253965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11454","last_updated":"2024-01-16T18:59:22Z","snapshot_observed_at":"2026-07-06T16:34:38.718198Z","submitted_at":"2023-10-17T17:59:46Z","title":"VeRA: Vector-based Random Matrix Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11454","snapshot_observed_at":"2026-08-07T12:09:13.327298Z","title":"Vera: Vector-based random matrix adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.327298Z"},"links":{"cited_paper":"/paper/2310.11454","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:76d2d10624c1fc6872d307e129b7ed61c63b370f4b3fd7704aaf079c6c36a604","observation_id":"476400f6-a7f8-4adc-94f1-13ad6cadf667","resolution":{"observed_at":"2026-08-07T12:09:13.327298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.415948Z","title":"Optimal brain damage","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.415948Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:70821055608bcec4f4763d6ff2d856665c192c0c1481444ec698bef4d3cb725d","observation_id":"e4011ca0-94cc-44f0-af08-36b777fe1ee2","resolution":{"observed_at":"2026-08-07T12:09:13.415948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11466","last_updated":"2023-06-06T05:58:11Z","snapshot_observed_at":"2026-07-06T14:08:22.637175Z","submitted_at":"2022-10-20T17:59:15Z","title":"Surgical Fine-Tuning Improves Adaptation to Distribution Shifts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11466","snapshot_observed_at":"2026-08-07T12:09:13.508685Z","title":"Surgical fine-tuning improves adaptation to distribution shifts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.508685Z"},"links":{"cited_paper":"/paper/2210.11466","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:c87d263d8542a3f0db92e2012b92dbd24396167fde6b791e216a5d9674c3c969","observation_id":"7424c8fc-b454-4235-843c-f4c8b92703db","resolution":{"observed_at":"2026-08-07T12:09:13.508685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.295348Z","title":"Conditional adapters: Parameter-efficient transfer learning with fast inference","venue":null,"work_id":"7bfe3a2b-a048-4e3c-ae46-df7c60e6e4ba","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.599639Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:6937f4fc0792ffb51f031f3145471c07b444b7212f8962c96e01eb5965ce0880","observation_id":"267a91a9-8fc1-4630-b922-1050960b6381","resolution":{"observed_at":"2026-08-07T12:09:19.390243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-07T12:09:13.680914Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.680914Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:e69f7883a0275d75facfe6a91d3d0a0f93ee5b8c1e2c23216e8fa5a55eada8af","observation_id":"8ac650bd-c276-4e7d-bf25-c907bf2df1a4","resolution":{"observed_at":"2026-08-07T12:09:13.680914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-07-06T10:29:18.734092Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-07T12:09:13.790010Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.790010Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:622a6b42724ce1984c20ea61baefc66e2bd4d3792096dad101f6e55e4c513ae2","observation_id":"e75d4cba-4d09-4444-882b-d743e9294843","resolution":{"observed_at":"2026-08-07T12:09:13.790010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.856626Z","title":"Chatdoctor: A medical chat model fine-tuned on a large language model meta-ai (llama) using medical domain knowledge","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.856626Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:66a395bc42a4c7eb90045535ca75fb0aa7434cbb21a81ecbaeb6e7590f706d4d","observation_id":"f50f1ee1-0d78-4e8a-98ff-fce668dbe521","resolution":{"observed_at":"2026-08-07T12:09:13.856626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.966715Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.966715Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ad6ee0fe9c4f0a28c75f97db1b318a8f2f5fd46555629fef90128ba4a49f4d03","observation_id":"463410fe-f299-4cda-b946-f65651bcc183","resolution":{"observed_at":"2026-08-07T12:09:13.966715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-07T12:09:14.018675Z","title":"Dora: Weight-decomposed low-rank adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.018675Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:273df80843be3792675f2c5c6211b83141d1fdca8df5ff912d5e9ac6beda16a6","observation_id":"7720f447-ffda-46b3-8793-79ddcecee064","resolution":{"observed_at":"2026-08-07T12:09:14.018675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-03T22:14:53.516423Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-07T12:09:14.108874Z","title":"P-tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.108874Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:3421dc0305bb913bc3664904915a90794ab735df7935014d747ccd806414732a","observation_id":"63c044d9-1594-43df-a25e-72eaea3b12f8","resolution":{"observed_at":"2026-08-07T12:09:14.108874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.194630Z","title":"Gpt understands, too","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.194630Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:d01c5cd1fed25e55d0aa8ad46b2b29e23b49cf63e9228e5d6c51d25852126bf3","observation_id":"bc2d7b63-5914-4398-b325-88cd06979c10","resolution":{"observed_at":"2026-08-07T12:09:14.194630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16187","last_updated":"2024-04-15T13:25:05Z","snapshot_observed_at":"2026-08-08T05:35:09.830014Z","submitted_at":"2024-03-24T15:09:55Z","title":"ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16187","snapshot_observed_at":"2026-08-07T12:09:14.299953Z","title":"Alora: Allocating low-rank adaptation for fine-tuning large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.299953Z"},"links":{"cited_paper":"/paper/2403.16187","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:7ff09747b4ad6c6988f3fee76ee6673e86e174ceda82c7f9bbc54efef1a19ab7","observation_id":"eebf33fb-65d8-42ba-a3b5-b570debd78e9","resolution":{"observed_at":"2026-08-07T12:09:14.299953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.992445Z","title":"The flan collection: Designing data and methods for effective instruction tuning","venue":null,"work_id":"1564b0a2-78bb-43ff-83ce-eeee295d6bef","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.426059Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:631a2649935d62601d7c44744651ba287a4d1c034a64744f28de183cb1a10ca8","observation_id":"9cb5dd07-0a0e-4f7c-b738-0b78eb777066","resolution":{"observed_at":"2026-08-07T12:09:19.120563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.816999Z","title":"Llm-pruner: On the structural pruning of large language models","venue":null,"work_id":"508ffa67-0c63-4165-a3ae-a7b8826479fe","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.492378Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:511380030329cfd34d1730452f1903da6da1b8c34ec4200d9c5374f706ab2248","observation_id":"6bce41b6-6fd3-42ea-b72f-9ccd78d319ae","resolution":{"observed_at":"2026-08-07T12:09:18.911647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-03T21:03:39.746617Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-07T12:09:14.600815Z","title":"Pissa: principal singular values and singular vectors adaptation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.600815Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:96c772ddb1caa4b42d00b7c1fe9fe7bdd3d6efa321df75eac685839f91ebf16a","observation_id":"d99fac71-411c-43cb-ab37-0d7cb3741954","resolution":{"observed_at":"2026-08-07T12:09:14.600815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.620287Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm, 2023","venue":null,"work_id":"73b0a2da-a917-43db-8bb4-8e709fe32b50","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.697383Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:95d5e2eaad7fb840aa0f26776eb7e275ce79a0fea9790f598367d58abdf991e9","observation_id":"7b01ed15-55f5-4760-930e-2c6724856a38","resolution":{"observed_at":"2026-08-07T12:09:18.721469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.439710Z","title":"Multi-head adapter routing for cross-task generalization","venue":null,"work_id":"496da4a1-7a59-4c5e-9ce0-2dd66f7eff78","year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.739016Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:a38f23a99624269cdb1cad350c44042d634a92de75f97784c6dc089cc2bb9675","observation_id":"9b2ca90e-7073-4e19-bd7d-a2da2c2c71a6","resolution":{"observed_at":"2026-08-07T12:09:18.521590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17919","last_updated":"2024-12-25T19:03:23Z","snapshot_observed_at":"2026-07-06T17:51:28.420385Z","submitted_at":"2024-03-26T17:55:02Z","title":"LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17919","snapshot_observed_at":"2026-08-07T12:09:14.828645Z","title":"Lisa: Lay- erwise importance sampling for memory-efficient large language model fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.828645Z"},"links":{"cited_paper":"/paper/2403.17919","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:73eddf97328bc7ae5926a4c10cb840d787e530215d921f1c8e5ce837c15a1e73","observation_id":"4582706e-1f12-4388-9402-9a06cb53819c","resolution":{"observed_at":"2026-08-07T12:09:14.828645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09578","last_updated":"2024-04-12T23:15:51Z","snapshot_observed_at":"2026-08-04T19:55:50.190412Z","submitted_at":"2023-11-16T05:29:39Z","title":"Tied-Lora: Enhancing parameter efficiency of LoRA with weight tying","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09578","snapshot_observed_at":"2026-08-07T12:09:14.911036Z","title":"Tied-lora: Enhacing parameter efficiency of lora with weight tying","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.911036Z"},"links":{"cited_paper":"/paper/2311.09578","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:065fc1820a85111ef55cb89347fdb89a207c4b38f531f3e052bcf60206c2a1f5","observation_id":"4f3e6791-b887-4ff9-9fb4-2a6882427481","resolution":{"observed_at":"2026-08-07T12:09:14.911036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.291225Z","title":"On the effect of dropping layers of pre-trained transformer models","venue":null,"work_id":"2fad24e2-22f1-4749-a4f0-e71d6ae5c931","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.988464Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ccb26adf70449bb1dc61d71f0dbada3f6c7795e809cf5e8d908577a48a9a077f","observation_id":"74c9f7c5-94c6-444c-bb2b-412accc9cf35","resolution":{"observed_at":"2026-08-07T12:09:18.356371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-07T12:09:15.073697Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.073697Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:cbf0b993e621b6f81fc3821cd14963bfdb1674991ce8d9f56d47e3457bee033f","observation_id":"e8c1a75d-c3e5-43c2-8d75-b59da1c84211","resolution":{"observed_at":"2026-08-07T12:09:15.073697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T12:09:15.147892Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.147892Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:dc7377caec58549030624c03569477a4a798d517ea383d92438cb81b1405fbaa","observation_id":"538c6522-9b89-4391-8dac-dcca1108c594","resolution":{"observed_at":"2026-08-07T12:09:15.147892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T12:09:15.248008Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.248008Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:9551e8045e286f5f0ce152164aa254e3292e10b57f81fd6adbd7eed898d52730","observation_id":"6ad5e942-e6d5-46a9-a548-b12eff57d5fa","resolution":{"observed_at":"2026-08-07T12:09:15.248008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19245","last_updated":"2024-05-23T15:06:02Z","snapshot_observed_at":"2026-08-05T08:36:16.990741Z","submitted_at":"2024-04-30T04:01:09Z","title":"HydraLoRA: An Asymmetric LoRA Architecture for Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19245","snapshot_observed_at":"2026-08-07T12:09:15.315090Z","title":"Hydralora: An asymmetric lora architecture for efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.315090Z"},"links":{"cited_paper":"/paper/2404.19245","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:d052985cf54f2c25850802c8e8555e14538d841a5bfa2b5531e7ceac9adae431","observation_id":"482b0006-63b8-4908-af19-71a8acc16119","resolution":{"observed_at":"2026-08-07T12:09:15.315090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:09:15.426608Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.426608Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:5f9e5db1df87163264a382a3f2a6249991d757aff4fe16af456c3ae54d75a34b","observation_id":"61b5f1ca-7afa-479a-87cf-bedd8617bc80","resolution":{"observed_at":"2026-08-07T12:09:15.426608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07558","last_updated":"2023-04-19T04:28:24Z","snapshot_observed_at":"2026-07-06T14:05:06.502938Z","submitted_at":"2022-10-14T06:29:22Z","title":"DyLoRA: Parameter Efficient Tuning of Pre-trained Models using Dynamic Search-Free Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07558","snapshot_observed_at":"2026-08-07T12:09:15.530983Z","title":"Dylora: Parameter efficient tun- ing of pre-trained models using dynamic search-free low-rank adaptation.arXiv preprint arXiv:2210.07558, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.530983Z"},"links":{"cited_paper":"/paper/2210.07558","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:5a3dc7763c3781e0cd3dafe15305be4c4477f3f89546739d62192ddb9499b7e8","observation_id":"d672f9e3-34e0-439c-90d1-0522e1fd63e4","resolution":{"observed_at":"2026-08-07T12:09:15.530983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.155205Z","title":"Eigendamage: Structured pruning in the kronecker-factored eigenbasis","venue":null,"work_id":"7685f599-6dd2-44d8-999b-912453e18d1c","year":2019},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.640336Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:9bda9676997d88d95ddb4291b96f0ef8a15aa3ddb9f5a86e940b6ecc28eb2055","observation_id":"7de5f910-32d8-4ab3-8de0-cd873ccf9534","resolution":{"observed_at":"2026-08-07T12:09:18.206008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12410","last_updated":"2022-11-02T02:47:17Z","snapshot_observed_at":"2026-08-07T19:57:36.466885Z","submitted_at":"2022-05-24T23:41:22Z","title":"AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12410","snapshot_observed_at":"2026-08-07T12:09:15.732927Z","title":"Adamix: Mixture-of-adapter for parameter-efficient tuning of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.732927Z"},"links":{"cited_paper":"/paper/2205.12410","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:90984a3fcd5c23bbc7f0422c26ccd74599383da6ab6fb5b742510bb1e1aa545a","observation_id":"dab70a53-010a-4440-aa7a-6607e60ae327","resolution":{"observed_at":"2026-08-07T12:09:15.732927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:17.934408Z","title":"Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M","venue":null,"work_id":"d3af7813-f126-438a-942e-19d0333f34ea","year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.809137Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:d856a74ab3179dadb1a4840a0e7c0ee6c678be5ca6c7165ed4de4017897037aa","observation_id":"f43b12e6-3060-43a9-ad56-6a47d15013d5","resolution":{"observed_at":"2026-08-07T12:09:18.033356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15477","last_updated":"2023-10-24T03:08:58Z","snapshot_observed_at":"2026-07-06T16:37:35.396777Z","submitted_at":"2023-10-24T03:08:58Z","title":"CRaSh: Clustering, Removing, and Sharing Enhance Fine-tuning without Full Large Language Model","version":1},"cited_work":{"arxiv_id":"2310.15477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.15477","snapshot_observed_at":"2026-08-07T12:09:16.342202Z","title":"CRaSh: Clustering, Removing, and Sharing Enhance Fine-tuning without Full Large Language Model","venue":"cs.CL","work_id":"55582a46-1e81-485c-a4f3-d96c63389056","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.900942Z"},"links":{"cited_paper":"/paper/2310.15477","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ac15a03da82da50fcd28dfa9754a17bd163156b778421537c95695e013d5d220","observation_id":"b202b104-fc60-40bd-ac11-596a10c6a66a","resolution":{"observed_at":"2026-08-07T12:09:16.407359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-08-07T12:09:15.974806Z","title":"Lora-fa: Memory-efficient low-rank adaptation for large language models fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.974806Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ba9bade123dba6047e22d748feba019be7ce4531758cfdc466a65fb8ae014959","observation_id":"6f6c7e3b-f613-4e7b-aa57-f37df9495d79","resolution":{"observed_at":"2026-08-07T12:09:15.974806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-07T12:09:16.082796Z","title":"Adalora: Adaptive budget allocation for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:16.082796Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:6f608c506d594169930f592ddb30b2d421b747eb020649c378c921e8a325885a","observation_id":"f82c49eb-4f3b-4c9e-89a4-ce18d4b775f1","resolution":{"observed_at":"2026-08-07T12:09:16.082796Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T01:16:03.657287Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2506.00495."}