{"as_of":"2026-08-10T15:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70e5ff6a8b884096bbade1732f3b73e7d1791fde99b3c3ea95e43bb89c2c9218","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T20:29:52.739918Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T20:33:50.303976Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00089","snapshot_observed_at":"2026-08-03T20:33:50.303976Z","title":"Ensembles of low-rank expert adapters.arXiv preprint arXiv:2502.00089, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19636","last_updated":"2026-07-06T06:25:19Z","snapshot_observed_at":"2026-08-08T22:45:21.878235Z","submitted_at":"2025-11-24T19:12:26Z","title":"Exploring the Rashomon Set for Concept-Based Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T20:33:50.303976Z"},"links":{"cited_paper":"/paper/2502.00089","citing_paper":"/paper/2511.19636"},"observation_digest":"sha256:6ab051d5745d33e671e2379612533ae56450582be341e20d38c2b18ceff24a6b","observation_id":"c208dc31-24bb-4ee2-9f80-76def4a089ef","resolution":{"observed_at":"2026-08-03T20:33:50.303976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00089","snapshot_observed_at":"2026-07-13T14:28:05.261852Z","title":"Ensembles of low-rank expert adapters.arXiv preprint arXiv:2502.00089, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T14:28:05.261852Z"},"links":{"cited_paper":"/paper/2502.00089","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:ebd0f317e1864197b35d2ac5678d31a87a3abddecd83b8e7b1f38ea2d7d607fa","observation_id":"0aa871c7-f9d5-4276-8a00-57dc50b14254","resolution":{"observed_at":"2026-07-13T14:28:05.261852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00089","snapshot_observed_at":"2026-07-15T11:44:19.622453Z","title":"Ensembles of low-rank expert adapters.arXiv preprint arXiv:2502.00089, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-15T11:44:19.622453Z"},"links":{"cited_paper":"/paper/2502.00089","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:bbb12da700473e274457214eda1d00738d40dd262d587fcbb76ae7c2373082cd","observation_id":"16142635-e0b4-43e3-9817-15c30ef8b62c","resolution":{"observed_at":"2026-07-15T11:44:19.622453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00089/citation-record","integrity":"/paper/2502.00089/integrity","json":"/paper/2502.00089/citation-record.json","paper":"/paper/2502.00089"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.428081Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.428081Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:f29ef97d1a04914fb88ddb99a1bfa8d7adb153f3d5da061680a8d6a083c4b1e7","observation_id":"ce4f5266-1bc4-4744-beac-e60c46cab8a5","resolution":{"observed_at":"2026-08-09T20:29:52.428081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01013","last_updated":"2024-06-18T20:53:08Z","snapshot_observed_at":"2026-07-06T18:24:13.721696Z","submitted_at":"2024-06-03T05:46:53Z","title":"Scalable Ensembling For Mitigating Reward Overoptimisation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01013","snapshot_observed_at":"2026-08-09T20:29:52.433029Z","title":"Ahmed, Rafael Rafailov, Stepan Sharkov, Xuechen Li, and Sanmi Koyejo","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.433029Z"},"links":{"cited_paper":"/paper/2406.01013","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:aa436fb1b3357eddc069e457d31ef491bbc91ebe562992ef41ce3da6184b602f","observation_id":"fa0abb0b-2e59-43a7-9370-2ffd3772e800","resolution":{"observed_at":"2026-08-09T20:29:52.433029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.437054Z","title":"Mathqa: Towards interpretable math word problem solving with operation-based formalisms","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.437054Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:0e0bf7f15b0af9ec3f0eb4d2d50380d32e2b60d89488acfd1c5e4b32ccb225ac","observation_id":"5ef1cf7b-0d0c-45ab-a16f-3a5f68f86770","resolution":{"observed_at":"2026-08-09T20:29:52.437054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.440416Z","title":"Introducing the next generation of claude, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.440416Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:65283d47df0dcf00714cefc00e21236fbe270a764c359c30d00feda64272f083","observation_id":"b48e0211-7139-49e0-8145-4077185689f8","resolution":{"observed_at":"2026-08-09T20:29:52.440416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.443648Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.443648Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:3e40390347983abecc8e76ba142cff9cd0e33a14fc70cfcb30772050755b5631","observation_id":"da01a1a5-1bb9-4f3d-96e1-029216abe860","resolution":{"observed_at":"2026-08-09T20:29:52.443648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06204","last_updated":"2025-04-09T13:54:59Z","snapshot_observed_at":"2026-08-07T19:39:57.333135Z","submitted_at":"2024-06-26T16:34:33Z","title":"A Survey on Mixture of Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06204","snapshot_observed_at":"2026-08-09T20:29:52.446821Z","title":"A survey on mixture of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.446821Z"},"links":{"cited_paper":"/paper/2407.06204","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:8e995430853bfbc6f26bcb593d4577222edfff97c55200df5b396ca31d79abdc","observation_id":"daab8f34-6662-4ebc-8252-d1ae459ae696","resolution":{"observed_at":"2026-08-09T20:29:52.446821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.450520Z","title":"SWAD: domain generalization by seeking flat minima","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.450520Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:e66aad2330f599951b712ac5536c33cd8380f890a9d2eb7bd8b9df697b7e05e2","observation_id":"c5eb933d-b16b-47b9-b586-9b5e3759add4","resolution":{"observed_at":"2026-08-09T20:29:52.450520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-08-10T11:59:11.481480Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-09T20:29:52.453840Z","title":"Frugalgpt: How to use large language models while reducing cost and improving performance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.453840Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:549853f0966b010bb363a6260af65fa050279b649914d5561f48a4faafff134b","observation_id":"2b5d2ca7-e53d-47c3-904a-ae6c85636a54","resolution":{"observed_at":"2026-08-09T20:29:52.453840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16160","last_updated":"2024-01-30T15:44:58Z","snapshot_observed_at":"2026-07-06T17:21:51.054477Z","submitted_at":"2024-01-29T13:48:36Z","title":"LLaVA-MoLE: Sparse Mixture of LoRA Experts for Mitigating Data Conflicts in Instruction Finetuning MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16160","snapshot_observed_at":"2026-08-09T20:29:52.457508Z","title":"Llava-mole: Sparse mixture of lora experts for mitigating data conflicts in instruction finetuning mllms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.457508Z"},"links":{"cited_paper":"/paper/2401.16160","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:7599b82215b087847295e47058078f9b442d8078e7f550fdccb210022de12dd5","observation_id":"a2d2d0da-7e76-4c93-933f-53743e5ca750","resolution":{"observed_at":"2026-08-09T20:29:52.457508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.462198Z","title":"Peters, Alexander Fraser, and Jesse Dodge","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.462198Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:3f5da182c3ee495dc42d3f89b1f04830f2edb201cf12067be032386ce531e664","observation_id":"8e9b286f-9497-484a-9a12-0218651c126a","resolution":{"observed_at":"2026-08-09T20:29:52.462198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T20:29:52.465421Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.465421Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:115eb13b0ea0a7b8afee4bf254ba41ef198ca8bd19aa72e28c821a81f7dc4038","observation_id":"eed38dbd-5641-4175-b2e7-07ca7ce34c59","resolution":{"observed_at":"2026-08-09T20:29:52.465421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.468954Z","title":"Free dolly: Introducing the world's first truly open instruction-tuned llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.468954Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:f48dc001a8238d2cdcdfaaa0399795740966d2dd5ac0e82c095368aeed050f28","observation_id":"d11ba599-da2a-4aa5-8252-c7c1da034b32","resolution":{"observed_at":"2026-08-09T20:29:52.468954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.471873Z","title":"Reward model ensembles help mitigate overoptimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.471873Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:7337bfacd2a45aabb16315a01d58e549dc920f8ffce5586b74d5c7fddeaa2943","observation_id":"52eb552f-d309-45d9-8622-c7cc5cd9b0db","resolution":{"observed_at":"2026-08-09T20:29:52.471873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-09T20:29:52.475481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.475481Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:49dfb4796121819187806f8ae04ed594d3e90fb765afc01ef000e8a2bfa91758","observation_id":"ea811c9a-5cbf-427c-95a3-db9d9f8ba141","resolution":{"observed_at":"2026-08-09T20:29:52.475481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.479022Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.479022Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:68b7858a1f5e65cbddedfea30589d0b9fc7b0c749eb007b83f342fde539a40b9","observation_id":"c089f7db-4841-47df-8480-858f522f1c63","resolution":{"observed_at":"2026-08-09T20:29:52.479022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.481975Z","title":"Mixture-of-domain-adapters: Decoupling and injecting domain knowledge to pre-trained language models' memories","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.481975Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d84a31a07e71b5a6c0caa4152eb65e1e761be6f3d6f8d2bf5a8350e315f45931","observation_id":"75787ab6-8b8a-4d01-bae3-2897c5f93ff7","resolution":{"observed_at":"2026-08-09T20:29:52.481975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09979","last_updated":"2024-03-08T13:13:54Z","snapshot_observed_at":"2026-07-06T17:03:02.786273Z","submitted_at":"2023-12-15T17:45:06Z","title":"LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09979","snapshot_observed_at":"2026-08-09T20:29:52.485134Z","title":"Loramoe: Revolutionizing mixture of experts for maintaining world knowledge in language model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.485134Z"},"links":{"cited_paper":"/paper/2312.09979","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:7a68d7f5463194ca7b51eaf059deef6e1aa0532aeafee8609c9e1ae917159e76","observation_id":"e3a637e1-35b2-4df7-9f5b-31d681fe4ca0","resolution":{"observed_at":"2026-08-09T20:29:52.485134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14227","last_updated":"2024-07-16T01:49:19Z","snapshot_observed_at":"2026-07-06T16:36:39.306005Z","submitted_at":"2023-10-22T08:11:51Z","title":"Revisiting Deep Ensemble for Out-of-Distribution Detection: A Loss Landscape Perspective","version":2},"cited_work":{"arxiv_id":"2310.14227","doi":"10.48550/arxiv.2310.14227","metadata_source":"pith","pith_arxiv_id":"2310.14227","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Revisiting Deep Ensemble for Out-of-Distribution Detection: A Loss Landscape Perspective","venue":"cs.LG","work_id":"ba0cd1ce-b2db-441e-a179-14894ba11a5d","year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.488681Z"},"links":{"cited_paper":"/paper/2310.14227","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:33bb4d5fc623d509901565dc40235d21ad7ecc06f244f3541cd7b0d9137c0a5c","observation_id":"04037a29-20bb-4b9b-ae99-3901e37990a9","resolution":{"observed_at":"2026-08-09T20:29:53.247374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.492204Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.492204Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:af8fc637039f73500953cde4acb7213067576a0ada81c746f98154a8b44aec74","observation_id":"b9913db2-58a8-43c3-9e0f-1a9622dbf947","resolution":{"observed_at":"2026-08-09T20:29:52.492204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02757","last_updated":"2020-06-25T03:57:04Z","snapshot_observed_at":"2026-08-02T23:41:42.474354Z","submitted_at":"2019-12-05T17:48:18Z","title":"Deep Ensembles: A Loss Landscape Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02757","snapshot_observed_at":"2026-08-09T20:29:52.495313Z","title":"Deep ensembles: A loss landscape perspective","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.495313Z"},"links":{"cited_paper":"/paper/1912.02757","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:afb7a1d43d36c42e6aac085d8cb31afad9d1be86ede7d3fe000859ed7eaf1768","observation_id":"7360fbcf-18d8-46a8-9b60-7ecb94eb1e0f","resolution":{"observed_at":"2026-08-09T20:29:52.495313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-07-06T17:29:34.813390Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-09T20:29:52.498584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.498584Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:0239403bbc3e3e6e69014c33d48079f7a90dc2e6127bfb68050d446dc87831c6","observation_id":"219de549-f39a-4315-830a-41ec686e4afe","resolution":{"observed_at":"2026-08-09T20:29:52.498584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-09T20:29:52.501887Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.501887Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:dbc307694d032bdc5387c651c77d8bda58f4a730462481f3b7c5104005a0e18c","observation_id":"bde71bd4-8008-4b76-ab0a-9827f38b06e6","resolution":{"observed_at":"2026-08-09T20:29:52.501887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.505309Z","title":"Vetrov, and Andrew Gordon Wilson","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.505309Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:096a982814c5200953d672e83f478880530712c273944e613ab7c95b2f06e5af","observation_id":"522e88fc-5c50-40bc-a787-320266f2ffad","resolution":{"observed_at":"2026-08-09T20:29:52.505309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T20:29:52.508264Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.508264Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:fbc962bbf213c0df348198081c62442205a22e0c3401975aa0fe2eb6fd1d9ffb","observation_id":"bae4d753-f69b-4c02-9db5-e5baafb8e83b","resolution":{"observed_at":"2026-08-09T20:29:52.508264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-09T20:29:52.511701Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.511701Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:08877c76e0f099fc89fbb41b796bde01b49bd32e6a9d6f3dd009e73c3dfe58d6","observation_id":"4944b39b-c71c-4113-b73d-6d01a33f18e2","resolution":{"observed_at":"2026-08-09T20:29:52.511701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07472","last_updated":"2022-03-14T20:13:21Z","snapshot_observed_at":"2026-08-09T19:34:15.546075Z","submitted_at":"2022-03-14T20:13:21Z","title":"Uncertainty Estimation for Language Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07472","snapshot_observed_at":"2026-08-09T20:29:52.515236Z","title":"Uncertainty estimation for language reward models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.515236Z"},"links":{"cited_paper":"/paper/2203.07472","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:a6ec6093b8f44020dd442dd8ac6520191a8cb19f1b13ecbe4d026261c4874e21","observation_id":"11a1646e-738f-431d-9388-6f4b2f9f3556","resolution":{"observed_at":"2026-08-09T20:29:52.515236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12379","last_updated":"2024-07-04T02:55:57Z","snapshot_observed_at":"2026-07-06T17:05:27.005904Z","submitted_at":"2023-12-19T18:11:19Z","title":"Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12379","snapshot_observed_at":"2026-08-09T20:29:52.518494Z","title":"Kwok, and Yu Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.518494Z"},"links":{"cited_paper":"/paper/2312.12379","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d396d9f1f263715af56840e0577927cd36ae46921023e421a60836b997ab5acb","observation_id":"330c7b39-7a2d-4561-a535-c75dbba72d11","resolution":{"observed_at":"2026-08-09T20:29:52.518494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.522364Z","title":"Training independent subnetworks for robust prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.522364Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:2623d4b5739f0806e5b133db223ff13e17a6bf341bfd1e422a0c1d097ce13960","observation_id":"a5007fa0-89d8-4d57-aa1e-1a9e5338b101","resolution":{"observed_at":"2026-08-09T20:29:52.522364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.525499Z","title":"Towards a unified view of parameter-efficient transfer learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.525499Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:baf14c4ae778aec3d304a829697f261aec7dabc0dd2c1040b50ab646562fb67c","observation_id":"f81ea23a-e43a-4e56-ad42-9ceef57deffb","resolution":{"observed_at":"2026-08-09T20:29:52.525499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.528349Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.528349Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:0a7203a33e4cb8dc434d98ec77da331f5f93c73bfcc84165451adb1cc629c41c","observation_id":"1dbc343f-09de-4fe5-8140-91aac38ebb9d","resolution":{"observed_at":"2026-08-09T20:29:52.528349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.531280Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.531280Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:e8bda9fbad462d62d2934f3d8ce2801cdb4c2e4054ee36548c1b3f0df1a0e106","observation_id":"ac90a528-bc1f-4117-9047-186361e9a44c","resolution":{"observed_at":"2026-08-09T20:29:52.531280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.534020Z","title":"Parameter-efficient transfer learning for NLP","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.534020Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:105b9100b7814f99b1c807fe40016ce4073876a6cdccb64b65d40774ed580b18","observation_id":"9d57f71d-88ef-4b8b-be37-e10895254d81","resolution":{"observed_at":"2026-08-09T20:29:52.534020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.536981Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.536981Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:855b6922389094427dfadba93ef6a38d06fb4e8c484977fc59a42713eeb1bf8f","observation_id":"3262c07c-d364-49ef-95d2-8b19b01a085e","resolution":{"observed_at":"2026-08-09T20:29:52.536981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.540054Z","title":"Lorahub: Efficient cross-task generalization via dynamic lo RA composition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.540054Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:c5fc210ea168ffcaf6ab9cd45bc197e3b135fe8f1d981811398843b97ffa30ae","observation_id":"30381e0a-201e-42d8-b831-508be7f2ec4a","resolution":{"observed_at":"2026-08-09T20:29:52.540054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-09T20:29:52.542880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.542880Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:9ac2b61bfa4780b7eb73a18228e8122ed71768380d5ecb986d3eb08e69e1d63b","observation_id":"14196ecc-a9a8-4d3b-8ba8-349529718b72","resolution":{"observed_at":"2026-08-09T20:29:52.542880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.546083Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.546083Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:cd198c0063a7fbe0a1447adae63b5ad73f990cd59d0d98b3c5f389f819ea89f0","observation_id":"1ec9bfd6-56b1-40b2-9eaf-fef93ff2d37b","resolution":{"observed_at":"2026-08-09T20:29:52.546083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.401699Z","title":"Johnson and Joram Lindenstrauss","venue":null,"work_id":"b1f8ec19-9c83-4225-ac17-0a8c43008c89","year":1984},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.549048Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:82ecb6cd2f69e115c75917e3b2054179f140e90ec5a082864b5823070d95ed25","observation_id":"93b1fc98-ff5e-40b0-864d-f1da243e1d5c","resolution":{"observed_at":"2026-08-09T20:29:54.404164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.551811Z","title":"Jordan and Robert A","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.551811Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:daf7267748daec2c36677e1bb0da6215065a6c428924b919037c53fdd99f8126","observation_id":"70d78b06-f48b-4767-9d51-4fb53ab41f91","resolution":{"observed_at":"2026-08-09T20:29:52.551811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.393450Z","title":"Random indexing of text samples for latent semantic analysis","venue":null,"work_id":"2d47acd1-24b2-4e24-b738-5296b9d6532e","year":2000},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.555059Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d885617016acd317c0ad25326aae0fdb6f968f02f75739c0c4d2ecd0b18b18a2","observation_id":"c0a6108f-32b9-42e7-89f0-6d55b7c7a60e","resolution":{"observed_at":"2026-08-09T20:29:54.396282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T20:29:52.557866Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.557866Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:4d37595d0a8185aa843ecc94b947458bad7c0867548f98d9d1356a42c002cc14","observation_id":"de08f253-3d36-43d3-acae-e6382cfd06a0","resolution":{"observed_at":"2026-08-09T20:29:52.557866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.384267Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":"8eabbf54-4f80-47d6-8f41-586ac7d46f2e","year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.560979Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:f9151652c03f4d1747f3d476f451cd75e5e3b9f96cf467baffd5657f5da10d62","observation_id":"8a542c76-bf69-4b19-9353-70ff405a97af","resolution":{"observed_at":"2026-08-09T20:29:54.387564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.375657Z","title":"Simple and scalable predictive uncertainty estimation using deep ensembles","venue":null,"work_id":"4496aab6-12c7-43c8-a07f-1aca97edad01","year":2017},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.564081Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:8bc0e77f4e298fedcdd2879561ad4185c0979a271c3f3dbf208170fc02c4249a","observation_id":"8623d1a8-ad23-487d-9646-62c653c170a2","resolution":{"observed_at":"2026-08-09T20:29:54.378893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15159","last_updated":"2024-07-20T02:26:49Z","snapshot_observed_at":"2026-08-07T09:36:34.166140Z","submitted_at":"2024-04-22T02:15:52Z","title":"MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15159","snapshot_observed_at":"2026-08-09T20:29:52.567106Z","title":"Mixlora: Enhancing large language models fine-tuning with lora based mixture of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.567106Z"},"links":{"cited_paper":"/paper/2404.15159","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:0ec4565cead282e56ba7f5fe766a6b99ae53d22c093f89b0ff6d56b7c74bc598","observation_id":"e0cd3d2e-e0da-44e2-80b3-c4226be6dc78","resolution":{"observed_at":"2026-08-09T20:29:52.567106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.570248Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.570248Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:6e687a224063bd447654ddfa566d3f064fd25cee2864ae2c3fd3fc455ac95eeb","observation_id":"228ee2fd-a548-47c1-a310-2062c0950ea7","resolution":{"observed_at":"2026-08-09T20:29:52.570248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.365725Z","title":"MUB en: Benchmarking the uncertainty of molecular representation models","venue":null,"work_id":"0db11dbd-aee0-4038-816a-0cf9b85d85b2","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.573344Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d38ef8340a807d2097509c44a638fd141c21038d8e61923172534f3a78ba4c7c","observation_id":"bfa686ed-3616-4250-bfef-c8ffde77e596","resolution":{"observed_at":"2026-08-09T20:29:54.369098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.146805Z","title":"When MOE meets llms: Parameter efficient fine-tuning for multi-task medical applications","venue":null,"work_id":"68369360-b1c1-4d0f-b8c0-e42825b9b96c","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.576188Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:05718daaa898dc069061ba9f898d0deac66d4029e28504154ada7aae30141b19","observation_id":"ced6b897-0ea2-410b-af40-48ab51b8ec87","resolution":{"observed_at":"2026-08-09T20:29:54.150565Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.356158Z","title":"Deep ensembling with no overhead for either training or testing: The all-round blessings of dynamic sparsity","venue":null,"work_id":"558db76f-2cc5-4994-9b83-5ae8a75e69cc","year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.579090Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:2b2da1c38461fe73380722425e8e3fe1b1e90986119a76c5be943c77696625d3","observation_id":"3cad6110-dc0e-4293-9e67-71eb0ab7fa90","resolution":{"observed_at":"2026-08-09T20:29:54.359656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08985","last_updated":"2025-05-27T06:29:38Z","snapshot_observed_at":"2026-08-10T10:38:47.971174Z","submitted_at":"2024-04-13T12:14:58Z","title":"T-REX: Mixture-of-Rank-One-Experts with Semantic-aware Intuition for Multi-task Large Language Model Finetuning","version":2},"cited_work":{"arxiv_id":"2404.08985","doi":"10.48550/arxiv.2404.08985","metadata_source":"pith","pith_arxiv_id":"2404.08985","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"T-REX: Mixture-of-Rank-One-Experts with Semantic-aware Intuition for Multi-task Large Language Model Finetuning","venue":"cs.LG","work_id":"1e77a1fb-ed26-442f-8e83-68f5e54cc5aa","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.582018Z"},"links":{"cited_paper":"/paper/2404.08985","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:9cf6066c9e93f52de12bcc6a4e2e002d6fd789f4bf1e39ced982e2a4b2c07a41","observation_id":"a3aeb5f0-4d5c-406c-a15d-2d6cb603ce32","resolution":{"observed_at":"2026-08-09T20:29:53.160683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14115","last_updated":"2025-02-24T07:59:00Z","snapshot_observed_at":"2026-08-01T14:34:04.237282Z","submitted_at":"2024-06-20T08:58:58Z","title":"Take the essence and discard the dross: A Rethinking on Data Selection for Fine-Tuning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14115","snapshot_observed_at":"2026-08-09T20:29:52.585304Z","title":"Take the essence and discard the dross: A rethinking on data selection for fine-tuning large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.585304Z"},"links":{"cited_paper":"/paper/2406.14115","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:f0f4d7b24632dad751785578d91923d4548a6882893c1883d9228c441528d9b3","observation_id":"7fbec777-d88e-4967-8fa6-bfd54a73eddd","resolution":{"observed_at":"2026-08-09T20:29:52.585304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.347297Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":"9de283c7-d3d2-4c9e-a0e4-092ba6948d77","year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.588891Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:39d095fc837b9deb8dfb853be8538ad9cb1a4fa4da8da2c7cb3e7411a435b353","observation_id":"37a13d7e-4059-46e1-8c26-6615b30f967b","resolution":{"observed_at":"2026-08-09T20:29:54.350369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06089","last_updated":"2024-07-08T16:29:08Z","snapshot_observed_at":"2026-08-10T07:13:23.169291Z","submitted_at":"2024-07-08T16:29:08Z","title":"Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06089","snapshot_observed_at":"2026-08-09T20:29:52.592292Z","title":"Merge, ensemble, and cooperate! A survey on collaborative strategies in the era of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.592292Z"},"links":{"cited_paper":"/paper/2407.06089","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:88d62097282985c2326aff26dbab6fdd71a363a1c539aedb135d5b00855b5b68","observation_id":"c78b2b07-1f10-425c-bbd7-584080f5fb2b","resolution":{"observed_at":"2026-08-09T20:29:52.592292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12851","last_updated":"2024-02-20T09:30:48Z","snapshot_observed_at":"2026-07-06T17:32:44.565172Z","submitted_at":"2024-02-20T09:30:48Z","title":"MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12851","snapshot_observed_at":"2026-08-09T20:29:52.595718Z","title":"Moelora: Contrastive learning guided mixture of experts on parameter-efficient fine-tuning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.595718Z"},"links":{"cited_paper":"/paper/2402.12851","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:c9c4e303140d8c981155f08d30212eda0e535500f699fc137b82e548d712b0e0","observation_id":"155a85db-4f02-43dc-b155-c36fa0ef3c6b","resolution":{"observed_at":"2026-08-09T20:29:52.595718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.338644Z","title":"Learning to route among specialized experts for zero-shot generalization","venue":null,"work_id":"1b196dac-a269-4fe4-a397-64c1e6e15dc1","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.598914Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:cf362455251965b2eb50feacc7ee59ca1f080eec836020c9c4692131dbfa0a63","observation_id":"3d6b8da7-c3e4-485b-b03d-94b2bab62048","resolution":{"observed_at":"2026-08-09T20:29:54.341831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.330027Z","title":"Introducing ChatGPT , 2022","venue":null,"work_id":"10ebc346-3919-4718-9201-e5ac44f30de0","year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.601951Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:cfe532fd7b706f1a619f9f7cb5b07d52170255935ea4775f6ddca2cf3a0c89f2","observation_id":"9bad2658-d80b-456b-b3bb-d9ae0d348df9","resolution":{"observed_at":"2026-08-09T20:29:54.332998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T20:29:52.604978Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.604978Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:4fe8888f90b9eeec05164cd9c02cfb47a488ceb0801f4408bd9d70f84a42acba","observation_id":"d273fd88-257d-4ed0-bca3-1ff8f86ca0bb","resolution":{"observed_at":"2026-08-09T20:29:52.604978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.608068Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.608068Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:2ba8032a32d67ed61fe28d715cbfd87f9ab353daae4566196b0ca93c4ccc0c95","observation_id":"6f683a8c-fa75-414c-93b7-3cad1c72a191","resolution":{"observed_at":"2026-08-09T20:29:52.608068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12915","last_updated":"2024-07-07T08:16:28Z","snapshot_observed_at":"2026-07-06T18:17:25.642584Z","submitted_at":"2024-05-21T16:38:13Z","title":"G-DIG: Towards Gradient-based Diverse and High-quality Instruction Data Selection for Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12915","snapshot_observed_at":"2026-08-09T20:29:52.611083Z","title":"G-DIG: towards gradient-based diverse and high-quality instruction data selection for machine translation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.611083Z"},"links":{"cited_paper":"/paper/2405.12915","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:2794901fbbb6f72ab0aaf0adf8e1adce7d3d4b7b21485c27d3e98377e91d9e31","observation_id":"47c97993-45c2-4a4b-b850-d5115425a42f","resolution":{"observed_at":"2026-08-09T20:29:52.611083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.614620Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.614620Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:a0b2a4508b86077232867b7c32ec92c2b006ab3f200911fa5ddd414cd16fa29c","observation_id":"318d2815-6425-4ce7-9406-e8669a337880","resolution":{"observed_at":"2026-08-09T20:29:52.614620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05970","last_updated":"2023-04-12T16:47:15Z","snapshot_observed_at":"2026-08-05T11:48:57.735383Z","submitted_at":"2023-04-12T16:47:15Z","title":"Boosted Prompt Ensembles for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05970","snapshot_observed_at":"2026-08-09T20:29:52.617739Z","title":"Zhang, Andrew Wang, and Jimmy Ba","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.617739Z"},"links":{"cited_paper":"/paper/2304.05970","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:c3209c1b04cacfa12c1e01e094343efebe79d79ca0b37249c882170a4efc8d53","observation_id":"e91e97fd-03fa-49f6-924d-7e2b461390b5","resolution":{"observed_at":"2026-08-09T20:29:52.617739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.316387Z","title":"Estimating training data influence by tracing gradient descent","venue":null,"work_id":"fc57f8c2-3144-4314-8f0e-f72809da48a0","year":2020},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.621054Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:6c4b25b39d2e78bc92e60abb7cf0a5830759ebfeb82ec9ebf6eb7da6868c032b","observation_id":"1b0e7393-5efb-4523-ad30-510d34c4b15d","resolution":{"observed_at":"2026-08-09T20:29:54.319710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.307299Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":"6a147e9e-c619-4386-a37c-acaabb722119","year":2018},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.623989Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:7de335d047c31f8d0c2b46acba4f01c24a966aca0f6227a476c80d6a8f43a025","observation_id":"73ae6b42-3076-4904-bd77-8b7241234763","resolution":{"observed_at":"2026-08-09T20:29:54.310975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.627301Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.627301Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:4a2f2411bd718a6302c5c74c997aa5fa84e3b78d3db13e3a281214e84cc4ea49","observation_id":"e9f06fc9-22b4-4378-baa8-495753da55cc","resolution":{"observed_at":"2026-08-09T20:29:52.627301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12709","last_updated":"2024-07-17T16:31:38Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T16:31:38Z","title":"MoME: Mixture of Multimodal Experts for Generalist Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12709","snapshot_observed_at":"2026-08-09T20:29:52.630453Z","title":"Mome: Mixture of multimodal experts for generalist multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.630453Z"},"links":{"cited_paper":"/paper/2407.12709","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:ae2796661bff3cfa2bf3f2c232e2e2b9cb8437f9f61ce8d6fdef3a15af8821c8","observation_id":"ec91bb9e-8b41-42af-aecf-1be086cbd02b","resolution":{"observed_at":"2026-08-09T20:29:52.630453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14705","last_updated":"2023-07-05T17:24:43Z","snapshot_observed_at":"2026-08-07T05:22:50.415514Z","submitted_at":"2023-05-24T04:22:26Z","title":"Mixture-of-Experts Meets Instruction Tuning:A Winning Combination for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14705","snapshot_observed_at":"2026-08-09T20:29:52.633684Z","title":"Zhao, Hongkun Yu, Kurt Keutzer, Trevor Darrell, and Denny Zhou","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.633684Z"},"links":{"cited_paper":"/paper/2305.14705","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:8a3d9a284c7ecc3215a9d8906210c1a322bb472b29a11d08f5497a54df14c906","observation_id":"252896bd-98e0-45a7-bac7-17ace2a2b049","resolution":{"observed_at":"2026-08-09T20:29:52.633684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09617","last_updated":"2023-05-16T17:11:29Z","snapshot_observed_at":"2026-08-03T08:52:05.725675Z","submitted_at":"2023-05-16T17:11:29Z","title":"Towards Expert-Level Medical Question Answering with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09617","snapshot_observed_at":"2026-08-09T20:29:52.636987Z","title":"Sara Mahdavi, Joelle K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.636987Z"},"links":{"cited_paper":"/paper/2305.09617","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:11ab6530eb32ae290b4d4f884210430edd629cb63b247c3a0332010c2b83c745","observation_id":"3e132591-f4cf-48da-b032-2dbb4bde7676","resolution":{"observed_at":"2026-08-09T20:29:52.636987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.640507Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.640507Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:cbf99b43795a6428c7ae3e6368203e171a3d4241e07975e29ab071bf10b55d33","observation_id":"5e9e2bf5-a21f-4e87-bbf3-d91d6b463f4c","resolution":{"observed_at":"2026-08-09T20:29:52.640507Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:53.878215Z","title":"Szymanski and Michael D","venue":null,"work_id":"cadb6511-14bb-47f9-ac6d-cc00bd8ed859","year":1993},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.643770Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:66f022e87493fbdabd51af79fa670986328057dfd54085ae6a1f5ffa12c7ea2a","observation_id":"5524c4ff-0713-4f5f-be0f-b47c78b1167c","resolution":{"observed_at":"2026-08-09T20:29:53.881509Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.647006Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.647006Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:6b39fc85eac5057c9365759723271fc2302af5fddc2cfb8d52c177b175bf26f5","observation_id":"fe9553f4-130c-4332-8992-3bdea05f66de","resolution":{"observed_at":"2026-08-09T20:29:52.647006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.292822Z","title":"Hydralo RA : An asymmetric lo RA architecture for efficient fine-tuning","venue":null,"work_id":"99b5ac07-8d13-4bfd-8d98-84a711452c9f","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.649939Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d43ce74ca8dacd0099e46f49832f01c26d9b0e5e329a94f2780f4fc2a5715a64","observation_id":"0fa2be66-c237-44a0-b41e-433f9d664cf0","resolution":{"observed_at":"2026-08-09T20:29:54.296033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-09T20:29:52.652861Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.652861Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:26ed50746f64fb055df458c6895dad324650341e8e826043cd53ddd9f3178573","observation_id":"32f02831-474e-420d-a835-9bd915c7c3f4","resolution":{"observed_at":"2026-08-09T20:29:52.652861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.07411","last_updated":"2022-07-15T11:39:37Z","snapshot_observed_at":"2026-08-09T02:14:50.535028Z","submitted_at":"2022-07-15T11:39:37Z","title":"Plex: Towards Reliability using Pretrained Large Model Extensions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.07411","snapshot_observed_at":"2026-08-09T20:29:52.656237Z","title":"Liu, Michael W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.656237Z"},"links":{"cited_paper":"/paper/2207.07411","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:b91b180f35838c3c2bf9d5d31832c3dbcb3a5a4b47bda9ceab67310810dde788","observation_id":"b655f270-66ed-4b96-8b26-b908581acecc","resolution":{"observed_at":"2026-08-09T20:29:52.656237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.659834Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.659834Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:b7ab278a30584e3b36e5e8e041a473ec308d3109ab66392cd26c4da0cf2004bd","observation_id":"4838c959-8044-4e42-94ce-ed943e6d7f11","resolution":{"observed_at":"2026-08-09T20:29:52.659834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.278339Z","title":"Xing, and Mikhail Yurochkin","venue":null,"work_id":"7d2dab14-e5f3-4ae1-86af-b6c9ad2cf870","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.662724Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:1eea14580705035992cba319955c91ffd83362618dfa528e9b46727eeab2c5d8","observation_id":"c4deece2-19b0-48c2-8ec7-ae2f2099e0da","resolution":{"observed_at":"2026-08-09T20:29:54.281694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00035","last_updated":"2023-10-04T19:13:35Z","snapshot_observed_at":"2026-07-06T16:25:42.545425Z","submitted_at":"2023-09-29T16:38:38Z","title":"LoRA ensembles for large language model fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00035","snapshot_observed_at":"2026-08-09T20:29:52.666094Z","title":"Lora ensembles for large language model fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.666094Z"},"links":{"cited_paper":"/paper/2310.00035","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:1adcb0fc4e6d5f677f5edc8ef3668caaa68befc54f24724444c60fd443176076","observation_id":"665cdd69-9629-416c-b285-a181b9b8ca41","resolution":{"observed_at":"2026-08-09T20:29:52.666094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.269451Z","title":"Le, Ed H","venue":null,"work_id":"7cc16370-6328-4cfb-ba10-f1421f3d44ec","year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.669618Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:dce9e789c1093388263a02648ab192d63974ae03d45c2f825e185a406674f30e","observation_id":"6de2b785-d27f-4e82-978c-18581096fedf","resolution":{"observed_at":"2026-08-09T20:29:54.272438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11501","last_updated":"2023-11-20T02:59:18Z","snapshot_observed_at":"2026-07-06T16:49:45.821983Z","submitted_at":"2023-11-20T02:59:18Z","title":"MultiLoRA: Democratizing LoRA for Better Multi-Task Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11501","snapshot_observed_at":"2026-08-09T20:29:52.672748Z","title":"Multilora: Democratizing lora for better multi-task learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.672748Z"},"links":{"cited_paper":"/paper/2311.11501","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:33e66ca1d838b72b93de121890f2ef626085134c42e987ba584de998e9d776b2","observation_id":"f685a2b4-33da-4227-b7ed-ea09131120f7","resolution":{"observed_at":"2026-08-09T20:29:52.672748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.260185Z","title":"Smith, Iz Beltagy, and Hannaneh Hajishirzi","venue":null,"work_id":"dc04781f-063f-42f2-8660-d2965ef74850","year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.676150Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d40b43a73edfb6649fb738ed0ba70118ffdc5d603ea831beac6ae89d554fdd5d","observation_id":"66f43f29-3afa-478a-8edd-dcd6d8fedeb8","resolution":{"observed_at":"2026-08-09T20:29:54.263404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.250790Z","title":"Gradient vaccine: Investigating and improving multi-task optimization in massively multilingual models","venue":null,"work_id":"a0ebff3a-aac0-445c-83c5-571aff2aa2d8","year":2021},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.679031Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:8a2d8d4cd66c2d900bbbbcc679404203cba12db2b6589ba73eabf0c810624fee","observation_id":"a8814d0e-08bd-4534-af23-bd9ed8defd32","resolution":{"observed_at":"2026-08-09T20:29:54.254376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.682088Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.682088Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:f69ec2b193fe38399297fee59cde47b621ec9c2f56146d8df20a522430ad9465","observation_id":"8df2b70e-c7da-41ac-9b3d-ba605d8fd06a","resolution":{"observed_at":"2026-08-09T20:29:52.682088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.236057Z","title":"Batched low-rank adaptation of foundation models","venue":null,"work_id":"6ab8542f-9fa9-44d0-9e0d-995b51510e6b","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.685125Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d1e576ff946fd75b76878c035434183aae77de0179d2b36cc3818c3813049f36","observation_id":"153b9411-ab4c-4775-b6b3-48279413ca10","resolution":{"observed_at":"2026-08-09T20:29:54.239238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13628","last_updated":"2024-04-21T11:59:53Z","snapshot_observed_at":"2026-08-10T12:22:41.612612Z","submitted_at":"2024-04-21T11:59:53Z","title":"Mixture of LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13628","snapshot_observed_at":"2026-08-09T20:29:52.688155Z","title":"Mixture of lora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.688155Z"},"links":{"cited_paper":"/paper/2404.13628","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d85d7566307a12f2cc4cdb30fca88c4c843c1868ba26522fdade04898ce32e89","observation_id":"ce3d3597-9675-4709-a4e1-71de7d977b07","resolution":{"observed_at":"2026-08-09T20:29:52.688155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-07T17:47:02.067367Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-09T20:29:52.691742Z","title":"LESS: selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.691742Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:91c1b2b35e3f11fc90e54bb5daa810a1235597302bffeb82f3a4e5f8c716825b","observation_id":"26a3a64c-2735-40c2-a3ad-a760e24418ad","resolution":{"observed_at":"2026-08-09T20:29:52.691742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.226477Z","title":"Data selection for language models via importance resampling","venue":null,"work_id":"7305a8db-c0b0-4d39-a6e3-e5a9d399b7dd","year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.695167Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:f2a50a9eae304ca9eaac8ec5178af7f0765e73b29e4bf0b713f88693ffb14e75","observation_id":"0266bacc-470c-4bbe-b75a-e999f8af8fbe","resolution":{"observed_at":"2026-08-09T20:29:54.229603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01739","last_updated":"2024-03-27T10:21:24Z","snapshot_observed_at":"2026-08-02T08:17:59.108390Z","submitted_at":"2024-01-29T12:05:02Z","title":"OpenMoE: An Early Effort on Open Mixture-of-Experts Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01739","snapshot_observed_at":"2026-08-09T20:29:52.698206Z","title":"Openmoe: An early effort on open mixture-of-experts language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.698206Z"},"links":{"cited_paper":"/paper/2402.01739","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:5ae4056d09e8e24a51e26b23b7dc5e373dbf3128657c24a30221ed1cd52f8898","observation_id":"a68125ae-7bb0-48d6-8dfa-5b5ccc2e12bf","resolution":{"observed_at":"2026-08-09T20:29:52.698206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.701666Z","title":"Fingpt: Open-source financial large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.701666Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:3fc3f3348d255bb17efbfb7d8094fbe374a539ae5ba4b45a22dd5f6bfc2e4f9d","observation_id":"a3be391e-0975-452f-8c13-a9b5d2a3f18b","resolution":{"observed_at":"2026-08-09T20:29:52.701666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19905","last_updated":"2025-03-15T03:59:43Z","snapshot_observed_at":"2026-08-09T08:44:09.096941Z","submitted_at":"2024-06-28T13:20:17Z","title":"Solving Token Gradient Conflict in Mixture-of-Experts for Large Vision-Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19905","snapshot_observed_at":"2026-08-09T20:29:52.704791Z","title":"Solving token gradient conflict in mixture-of-experts for large vision-language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.704791Z"},"links":{"cited_paper":"/paper/2406.19905","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:c0c36799dabc5fb0a401b4ed9719bbff99c96389ca38ad23ab523f132dfa4805","observation_id":"a26faf70-0d95-4a61-9943-32c52e770472","resolution":{"observed_at":"2026-08-09T20:29:52.704791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.217268Z","title":"Pushing mixture of experts to the limit: Extremely parameter efficient moe for instruction tuning","venue":null,"work_id":"8daa0d8a-e638-4a15-8290-f54d4ce7dab0","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.708097Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:cecf5239996b86afd9161739b9cb1ac3b28a1d2602ba55f28a9f4a9f9019e425","observation_id":"b03c7b85-402a-4693-b73a-cc29b205bb6c","resolution":{"observed_at":"2026-08-09T20:29:54.220634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16635","last_updated":"2024-10-22T06:19:20Z","snapshot_observed_at":"2026-08-09T21:05:20.159816Z","submitted_at":"2024-01-30T00:17:37Z","title":"Improving Reinforcement Learning from Human Feedback with Efficient Reward Model Ensemble","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16635","snapshot_observed_at":"2026-08-09T20:29:52.710948Z","title":"Improving reinforcement learning from human feedback with efficient reward model ensemble","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.710948Z"},"links":{"cited_paper":"/paper/2401.16635","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:5b436325f530b9ec406017ce7c8640cd5d00aed87ea5478bc38fa990d47f2509","observation_id":"3de8c0c6-f2f5-4cb8-809e-783491121bee","resolution":{"observed_at":"2026-08-09T20:29:52.710948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:53.612913Z","title":"Birch: an efficient data clustering method for very large databases","venue":null,"work_id":"506c7caa-4b97-4aef-aaac-33acc826b53d","year":1996},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.714160Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:1ce531709813799278b7dc51dd34bf19be0b0fb671c9a6d6a8e25a9ffe18ae04","observation_id":"1819ef8f-e35f-43c7-b936-5ad94cf48457","resolution":{"observed_at":"2026-08-09T20:29:53.616157Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10833","last_updated":"2024-09-28T23:58:10Z","snapshot_observed_at":"2026-07-06T18:31:40.910349Z","submitted_at":"2024-06-16T08:03:24Z","title":"A Comprehensive Survey of Scientific Large Language Models and Their Applications in Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10833","snapshot_observed_at":"2026-08-09T20:29:52.717760Z","title":"A comprehensive survey of scientific large language models and their applications in scientific discovery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.717760Z"},"links":{"cited_paper":"/paper/2406.10833","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:a6ed9696f7a51c32980bdba460010f4cf6c170bf21bac3375d28323eb7d92ba1","observation_id":"9b1ea579-96a8-41ae-bcbd-9bb1f0e7a697","resolution":{"observed_at":"2026-08-09T20:29:52.717760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.207807Z","title":"Lory: Fully differentiable mixture-of-experts for autoregressive language model pre-training","venue":null,"work_id":"2108fb53-8bdc-4c1f-81bf-2b7b07f32926","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.721081Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:abc589ad7b1c17e6f46a9873cd8fd312678cee61e2f634125aeca08fd3bb146c","observation_id":"09793fc3-92b9-46d2-927d-2587a7db07b0","resolution":{"observed_at":"2026-08-09T20:29:54.211304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:54.197742Z","title":"Exploring training on heterogeneous data with mixture of low-rank adapters","venue":null,"work_id":"2cf9b563-a810-4aa4-b3df-326e39030b83","year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.723920Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:d90c6e771fd1bb56f961dc02290cc9f1ef9c990028789f03ee48f6f45384b914","observation_id":"17a1e7b8-54aa-44c6-a3f6-c6a88719affc","resolution":{"observed_at":"2026-08-09T20:29:54.201175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-09T20:29:52.726760Z","title":"Llama-moe: Building mixture-of-experts from llama with continual pre-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.726760Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:60ac2607e20b9baba7ecfe3649fb2d37b26cdc34def5bd9c3441dea32dae9102","observation_id":"afe5027e-1a4e-4193-adb3-1f8d15406723","resolution":{"observed_at":"2026-08-09T20:29:52.726760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09179","last_updated":"2023-11-15T18:15:37Z","snapshot_observed_at":"2026-07-06T16:48:05.271182Z","submitted_at":"2023-11-15T18:15:37Z","title":"SiRA: Sparse Mixture of Low Rank Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09179","snapshot_observed_at":"2026-08-09T20:29:52.730022Z","title":"Sira: Sparse mixture of low rank adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.730022Z"},"links":{"cited_paper":"/paper/2311.09179","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:cced5917e9135bcad3c2386c16e65a4e8ff7de71d45cd33aee5cb7f7206c1e3e","observation_id":"21c3c7f4-ced9-49f8-a0d7-154830185a54","resolution":{"observed_at":"2026-08-09T20:29:52.730022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.733268Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.733268Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:7b3b342b0f566a300e957b85eb0d527ac14b07aa92aa00c1372355a7c86e8a6a","observation_id":"a0e0d2dc-4ea4-4b0e-8bbc-a95f59ee66cd","resolution":{"observed_at":"2026-08-09T20:29:52.733268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.736658Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.736658Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:2618f4842678c0f335106cebf1efe4751896292c1323ed948c052b325cb2306f","observation_id":"5e7e2a82-10f7-4383-8b86-9e288b3141bd","resolution":{"observed_at":"2026-08-09T20:29:52.736658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:29:52.739918Z","title":"The data points (solid and hollow circles) do not necessarily have a geometric correspondence to their gradient directions (arrows)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.739918Z"},"links":{"citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:031ab47afa2c1441abd505a3c5fb02aa4abb385591e4b50d8f05d2e199a6e8db","observation_id":"bf6278e7-2bc2-4f25-85ce-305c83e51e97","resolution":{"observed_at":"2026-08-09T20:29:52.739918Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":69,"verified_exact":5,"verified_fuzzy":21},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 3 inbound Pith citation observations for arXiv:2502.00089."}