{"as_of":"2026-08-15T03:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c72ffe241ba5f25587e79152a96253f8fca37626d5be3fe12231f9c211f62c1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:56:03.291027Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:39:37.939237Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-12T21:56:03.291027Z","title":"Higher layers need more lora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08212","last_updated":"2024-11-12T22:03:37Z","snapshot_observed_at":"2026-08-13T13:37:32.404749Z","submitted_at":"2024-11-12T22:03:37Z","title":"PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T21:56:03.291027Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2411.08212"},"observation_digest":"sha256:820450da9bbbac81b48327a5147b61d86d6d86a8f3e0fe799191768b34cebc34","observation_id":"6875668e-3c71-4789-b815-b9d95d5c4f20","resolution":{"observed_at":"2026-08-12T21:56:03.291027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-12T17:37:13.076797Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.00029","last_updated":"2025-02-05T10:01:29Z","snapshot_observed_at":"2026-08-14T07:13:46.626651Z","submitted_at":"2024-11-19T10:51:49Z","title":"Planning vs Reasoning: Ablations to Test Capabilities of LoRA layers","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T17:37:13.076797Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2412.00029"},"observation_digest":"sha256:84ec4984f2707a1ab6b71c87e3327d03aa894f63d82dc6144dd4f5553bf6408c","observation_id":"973c2bfd-6ec2-4ff1-9dc1-1cf1c6e73fc6","resolution":{"observed_at":"2026-08-12T17:37:13.076797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-11T17:48:13.389420Z","title":"Higher layers need more l ora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08587","last_updated":"2025-05-11T04:59:46Z","snapshot_observed_at":"2026-08-12T04:25:59.820438Z","submitted_at":"2024-12-11T18:06:44Z","title":"Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T17:48:13.389420Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2412.08587"},"observation_digest":"sha256:8530e9cc8ae2f65dd46da923a01d667fe25572a48764e0bdf13306f1021cb4c2","observation_id":"a4faa071-a776-4b66-9875-1c1b4d81dbda","resolution":{"observed_at":"2026-08-11T17:48:13.389420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-11T17:26:28.333943Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08946","last_updated":"2024-12-12T05:22:49Z","snapshot_observed_at":"2026-08-14T15:24:18.305131Z","submitted_at":"2024-12-12T05:22:49Z","title":"MoSLD: An Extremely Parameter-Efficient Mixture-of-Shared LoRAs for Multi-Task Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T17:26:28.333943Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2412.08946"},"observation_digest":"sha256:ba25afb182e8bf4caa5d56783291c75742b32a8399b4e91739dab6654c119187","observation_id":"c8e0c68a-df1f-49ca-be08-8d5bc520332e","resolution":{"observed_at":"2026-08-11T17:26:28.333943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-11T12:44:35.448889Z","title":"arXiv preprint arXiv:2402.08562 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14219","last_updated":"2025-01-22T03:33:25Z","snapshot_observed_at":"2026-08-13T23:36:29.207493Z","submitted_at":"2024-12-18T14:11:15Z","title":"A Survey on Inference Optimization Techniques for Mixture of Experts Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T12:44:35.448889Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2412.14219"},"observation_digest":"sha256:8a47580cd080bee5bd71b2a1bc5992ab1db351b611477a6a58d17a4a998be83b","observation_id":"8d1e3641-3c36-4981-96da-d70770bcdfdb","resolution":{"observed_at":"2026-08-11T12:44:35.448889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-10T23:46:33.124256Z","title":"Higher layers need more lora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20004","last_updated":"2024-12-28T04:00:42Z","snapshot_observed_at":"2026-08-13T07:39:26.510310Z","submitted_at":"2024-12-28T04:00:42Z","title":"Adaptive Parameter-Efficient Federated Fine-Tuning on Heterogeneous Devices","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T23:46:33.124256Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2412.20004"},"observation_digest":"sha256:0847b704b7781bd5e40e1f63a62958bd7627479b09dd377562ebb4b3488356f2","observation_id":"4b1fb75f-d861-4497-85dd-b25e8a759091","resolution":{"observed_at":"2026-08-10T23:46:33.124256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-09T20:29:52.498584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.498584Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:ac6cccf208ac3d342d7415a7567173a3d171f31d0db6e6fe242f1369235ce17f","observation_id":"219de549-f39a-4315-830a-41ec686e4afe","resolution":{"observed_at":"2026-08-09T20:29:52.498584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-09T00:26:05.227041Z","title":"Higher layers need more lora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-11T20:31:42.331464Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.227041Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:02d6ea8f1dc26ee16dea8b53fca28456638331e1bfba04b73543c6ca58ea5a88","observation_id":"5dd8a9dd-b79d-434c-9eaa-d518eef1847f","resolution":{"observed_at":"2026-08-09T00:26:05.227041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T15:21:52.933074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15471","last_updated":"2025-05-21T12:46:42Z","snapshot_observed_at":"2026-08-13T08:03:57.925322Z","submitted_at":"2025-05-21T12:46:42Z","title":"CoLA: Collaborative Low-Rank Adaptation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:21:52.933074Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2505.15471"},"observation_digest":"sha256:fe510375f3c422594a4f6a31dcaa455a64760facbb8ee4d115d76cf76d7bc855","observation_id":"51c2f830-08d3-45ef-b4a7-f781cdde3760","resolution":{"observed_at":"2026-08-07T15:21:52.933074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T14:33:13.776017Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18568","last_updated":"2025-05-24T07:16:55Z","snapshot_observed_at":"2026-08-13T06:30:58.396867Z","submitted_at":"2025-05-24T07:16:55Z","title":"Learning without Isolation: Pathway Protection for Continual Learning","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:13.776017Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2505.18568"},"observation_digest":"sha256:c97a7999f249b7120730eef828355ba22b79d4fc8d533e59b7929bb0ab807200","observation_id":"855d585b-ce32-4186-bbf4-4cdddc32c2b3","resolution":{"observed_at":"2026-08-07T14:33:13.776017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T13:52:09.698152Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20925","last_updated":"2025-05-27T09:15:03Z","snapshot_observed_at":"2026-08-13T17:28:58.536732Z","submitted_at":"2025-05-27T09:15:03Z","title":"Multi-objective Large Language Model Alignment with Hierarchical Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:09.698152Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2505.20925"},"observation_digest":"sha256:799a31c52e9fc3a3885cc40c96ee3d7569c9a223c509fbff8fb7e6312dceaba7","observation_id":"89ecd604-ec6d-4fef-925c-a1031a0a9541","resolution":{"observed_at":"2026-08-07T13:52:09.698152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T13:11:59.713966Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22582","last_updated":"2025-05-28T16:54:53Z","snapshot_observed_at":"2026-08-13T13:37:34.321991Z","submitted_at":"2025-05-28T16:54:53Z","title":"Less, but Better: Efficient Multilingual Expansion for LLMs via Layer-wise Mixture-of-Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:11:59.713966Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2505.22582"},"observation_digest":"sha256:e27ad88bdc7381cc6353248e4e2f15fd590014c64a1b08bb2c63922fe4553a13","observation_id":"43e56061-ea33-4ff6-9aa1-51984a9686c1","resolution":{"observed_at":"2026-08-07T13:11:59.713966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T10:18:23.973337Z","title":"Higher layers need more LoRA experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05713","last_updated":"2025-07-27T08:06:57Z","snapshot_observed_at":"2026-08-08T06:35:08.618663Z","submitted_at":"2025-06-06T03:33:06Z","title":"Come Together, But Not Right Now: A Progressive Strategy to Boost Low-Rank Adaptation","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:23.973337Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2506.05713"},"observation_digest":"sha256:fee28a07e91ba5605ca2ac651c989158e13d18122a26a79cfd434c0af896f64d","observation_id":"49ea7337-e05d-488f-b087-609f636cd751","resolution":{"observed_at":"2026-08-07T10:18:23.973337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T04:09:24.458205Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11638","last_updated":"2025-06-13T10:11:01Z","snapshot_observed_at":"2026-08-14T08:05:44.396132Z","submitted_at":"2025-06-13T10:11:01Z","title":"LoRA-Gen: Specializing Large Language Model via Online LoRA Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:09:24.458205Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2506.11638"},"observation_digest":"sha256:6f6bf96dc724cd6b7616f6f937cf39b7ab0e7233431578fd1dd52bb7b9665b38","observation_id":"498474b8-c946-4c7e-b815-d4b07503475d","resolution":{"observed_at":"2026-08-07T04:09:24.458205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T04:09:29.607588Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11672","last_updated":"2025-06-13T11:03:46Z","snapshot_observed_at":"2026-08-09T12:29:10.004034Z","submitted_at":"2025-06-13T11:03:46Z","title":"Dynamic Mixture of Curriculum LoRA Experts for Continual Multimodal Instruction Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:09:29.607588Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2506.11672"},"observation_digest":"sha256:87c7db9298bb6dc9e18f491234c00a283edacc4df4a7944691e16cda550330fb","observation_id":"927f035b-2bee-4582-9dcb-55fb6ccceaf5","resolution":{"observed_at":"2026-08-07T04:09:29.607588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-07T01:03:38.643395Z","title":"Higher layers need more lora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12213","last_updated":"2025-06-13T20:31:17Z","snapshot_observed_at":"2026-08-14T03:23:10.307896Z","submitted_at":"2025-06-13T20:31:17Z","title":"Fed-HeLLo: Efficient Federated Foundation Model Fine-Tuning with Heterogeneous LoRA Allocation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:38.643395Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2506.12213"},"observation_digest":"sha256:31b45e937ecdb984ff301c08a4db20eacd7246cf083d9f9d258fb58b829c852d","observation_id":"77c9ff5f-7e2f-42a9-8c68-e0658d24ca2f","resolution":{"observed_at":"2026-08-07T01:03:38.643395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2507.00029","last_updated":"2026-05-13T05:28:39Z","snapshot_observed_at":"2026-08-11T06:15:13.326412Z","submitted_at":"2025-06-17T14:58:54Z","title":"LoRA-Mixer: Coordinate Modular LoRA Experts Through Serial Attention Routing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T09:05:25.236355Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2507.00029"},"observation_digest":"sha256:8fa64e2fffd1ab691e3bb54452e341eb5892208df60ced59e161d8bbe6794cf3","observation_id":"a78cb53e-ecd8-4330-ae44-2a3b6dd8c1c7","resolution":{"observed_at":"2026-05-19T09:07:14.670777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-04T19:48:48.000837Z","title":"Higher layers need more lora experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09097","last_updated":"2025-09-11T02:16:34Z","snapshot_observed_at":"2026-08-14T03:30:32.107152Z","submitted_at":"2025-09-11T02:16:34Z","title":"DP-FedLoRA: Privacy-Enhanced Federated Fine-Tuning for On-Device Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T19:48:48.000837Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2509.09097"},"observation_digest":"sha256:07e7c55e946ffd2b15f65771127e3a2b35ca6650da928b58a339be441aa8a99c","observation_id":"fcf0ba43-3015-4667-9060-9320f7de9ee6","resolution":{"observed_at":"2026-08-04T19:48:48.000837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-02T19:55:05.756275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.00573","last_updated":"2026-06-04T02:39:00Z","snapshot_observed_at":"2026-08-04T08:08:12.263429Z","submitted_at":"2026-02-28T09:40:11Z","title":"CoMoL: Efficient Mixture of LoRA Experts via Dynamic Core Space Merging","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T19:55:05.756275Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2603.00573"},"observation_digest":"sha256:98ccf14ad420c5b9525a3c95a3708847e19f54f05e3f13ea01629ff4d9327604","observation_id":"e80d4de0-900f-4227-ab29-feaffb7d9317","resolution":{"observed_at":"2026-08-02T19:55:05.756275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-02T19:52:19.278388Z","title":"11 Song Han, Jeff Pool, John Tran, and William J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.00910","last_updated":"2026-07-31T16:56:57Z","snapshot_observed_at":"2026-08-14T20:04:41.559268Z","submitted_at":"2026-03-01T04:14:15Z","title":"Curvature-Weighted Capacity Allocation: A Minimum Description Length Framework for Layer-Adaptive Large Language Model Optimization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T19:52:19.278388Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2603.00910"},"observation_digest":"sha256:65d2db87921560e4e594b02d43f0c2dae022b635269ff741f10ab11ed3d650ef","observation_id":"e679ef0e-87d8-442a-a1c4-4af31310560f","resolution":{"observed_at":"2026-08-02T19:52:19.278388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-03T02:39:00.957520Z","title":"11 Song Han, Jeff Pool, John Tran, and William J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.00910","last_updated":"2026-07-31T16:56:57Z","snapshot_observed_at":"2026-08-14T20:04:41.559268Z","submitted_at":"2026-03-01T04:14:15Z","title":"Curvature-Weighted Capacity Allocation: A Minimum Description Length Framework for Layer-Adaptive Large Language Model Optimization","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T02:39:00.957520Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2603.00910"},"observation_digest":"sha256:8af121018d9da2cceb9c0b53000c99c4cd7e177ea90989ea8dd52f2306494d88","observation_id":"36cc4a16-0943-46c5-8820-9362d59c7c8a","resolution":{"observed_at":"2026-08-03T02:39:00.957520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-02T20:06:13.149301Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13282","last_updated":"2026-05-26T00:25:54Z","snapshot_observed_at":"2026-08-06T10:01:07.632998Z","submitted_at":"2026-02-27T16:02:16Z","title":"FedTreeLoRA: Reconciling Statistical and Functional Heterogeneity in Federated LoRA Fine-Tuning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T20:06:13.149301Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2603.13282"},"observation_digest":"sha256:79a5e93263dea1c509a44aab9d2db7ef2514a3d19a6958eb6e618e2fa04d189c","observation_id":"aee45ac8-fc38-4437-8a07-8712a4686690","resolution":{"observed_at":"2026-08-02T20:06:13.149301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2604.26340","last_updated":"2026-04-29T06:45:44Z","snapshot_observed_at":"2026-08-12T20:27:51.568788Z","submitted_at":"2026-04-29T06:45:44Z","title":"Adaptive and Fine-grained Module-wise Expert Pruning for Efficient LoRA-MoE Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T13:22:13.763578Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2604.26340"},"observation_digest":"sha256:d24907034d0206b99328d003b6c11b27339f8d135808079ee4c8ca122a4fecc2","observation_id":"d169aedd-df62-4284-9048-79828452feca","resolution":{"observed_at":"2026-05-12T09:01:24.524216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2605.07256","last_updated":"2026-05-08T05:24:51Z","snapshot_observed_at":"2026-08-11T13:33:56.822172Z","submitted_at":"2026-05-08T05:24:51Z","title":"TAS-LoRA: Transformer Architecture Search with Mixture-of-LoRA Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:33:09.642350Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2605.07256"},"observation_digest":"sha256:3f93cd68344397b99fb155a092d8d035807f2c0ec212afb67fd53388f5cb30d3","observation_id":"9c5db77a-31fa-47e5-89f7-550eaf5e78ea","resolution":{"observed_at":"2026-05-11T01:40:52.561959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2605.13161","last_updated":"2026-05-15T18:29:50Z","snapshot_observed_at":"2026-08-12T17:36:13.807329Z","submitted_at":"2026-05-13T08:24:55Z","title":"A$_3$B$_2$: Adaptive Asymmetric Adapter for Alleviating Branch Bias in Vision-Language Image Classification with Few-Shot Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T19:14:03.809826Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2605.13161"},"observation_digest":"sha256:8a358b3862609c6ca216b5637cf42738a17699f3778e700dc5b95441b5f1f98f","observation_id":"955d6fda-95a0-4afb-9952-f0d4d4d05953","resolution":{"observed_at":"2026-05-14T19:17:51.047946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2605.13161","last_updated":"2026-05-15T18:29:50Z","snapshot_observed_at":"2026-08-12T17:36:13.807329Z","submitted_at":"2026-05-13T08:24:55Z","title":"A$_3$B$_2$: Adaptive Asymmetric Adapter for Alleviating Branch Bias in Vision-Language Image Classification with Few-Shot Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T22:07:35.021986Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2605.13161"},"observation_digest":"sha256:fab63f8b0b27768736a61f415c3c4cab41c5ad3338b5bd7340de1c30493d1820","observation_id":"297a0cf2-0827-47cf-b808-ea44b4abd053","resolution":{"observed_at":"2026-05-20T22:09:07.097860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2605.18083","last_updated":"2026-05-18T08:59:08Z","snapshot_observed_at":"2026-07-06T23:28:59.503300Z","submitted_at":"2026-05-18T08:59:08Z","title":"A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAM$\\Delta$ Integration into Upcycled MoE","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T11:09:22.027588Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2605.18083"},"observation_digest":"sha256:1bfd730b1c0a260eeb928b965fee9efb58e738f56515a0fdea829bcff340f3ac","observation_id":"a056dbb3-2408-4111-9eec-fb364d9997a9","resolution":{"observed_at":"2026-05-20T11:13:13.610080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":"2402.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-07-04T06:39:37.939237Z","title":"Higher layers need more lora experts.arXiv preprint arXiv:2402.08562","venue":null,"work_id":"a105c3ba-0d5a-46e0-9c96-cbd9fa9c700d","year":2024},"citing_paper":{"arxiv_id":"2606.21645","last_updated":"2026-06-19T17:56:44Z","snapshot_observed_at":"2026-08-05T10:02:01.473600Z","submitted_at":"2026-06-19T17:56:44Z","title":"Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models","version":1},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-06-26T14:18:11.215278Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2606.21645"},"observation_digest":"sha256:9f709d122340f7f36be3add26bdd4ded2c16342fdf420afa0f3e30a547ed9a1b","observation_id":"447c60b5-f5cd-4bf7-b574-71ff431dd938","resolution":{"observed_at":"2026-07-04T06:39:37.940556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.08562/citation-record","integrity":"/paper/2402.08562/integrity","json":"/paper/2402.08562/citation-record.json","paper":"/paper/2402.08562"},"outbound":[],"paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T04:19:43.818069Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2402.08562."}