{"as_of":"2026-08-07T10:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bafb152c807bbad7d5948b4feb642698ea1c6dbf2eb7b886dbbd752158d69ca5","coverage":[{"denominator":124,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T13:40:50.908566Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.06166/citation-record","integrity":"/paper/2605.06166/integrity","json":"/paper/2605.06166/citation-record.json","paper":"/paper/2605.06166"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":"2308.12950","doi":"10.48550/arxiv.2308.12950","metadata_source":"pith","pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code Llama: Open Foundation Models for Code","venue":"cs.CL","work_id":"e73bffa4-7620-47ac-9327-259a60db52ca","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:ddb24ee02f5b58950c3b61cb7ffa0a4e25d7efcc42682eca599d6aee0167d1c8","observation_id":"89918a94-494d-41d8-a327-a7c36f488a00","resolution":{"observed_at":"2026-05-11T18:51:07.492271Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llemma: An open language model for mathematics","venue":null,"work_id":"0945c6e1-1fd8-40d3-af9c-7f7d2e42d98f","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e8bcd48b3f4c24d1f0793e57c73df9eb4493044137ed74c68c5a05b9cc358911","observation_id":"2b96264c-ffd6-4f02-a35e-3acf55c8c0d9","resolution":{"observed_at":"2026-05-26T12:17:18.108996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14070","last_updated":"2023-06-24T15:26:44Z","snapshot_observed_at":"2026-07-06T15:07:41.634914Z","submitted_at":"2023-03-24T15:29:16Z","title":"ChatDoctor: A Medical Chat Model Fine-Tuned on a Large Language Model Meta-AI (LLaMA) Using Medical Domain Knowledge","version":5},"cited_work":{"arxiv_id":"2303.14070","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14070","snapshot_observed_at":"2026-07-03T00:37:30.319056Z","title":"Chatdoctor: A medical chat model fine-tuned on llama model using medical domain knowledge","venue":null,"work_id":"1d4e8a97-1003-4a74-907b-cc0116ee1d1a","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2303.14070","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:6776448aa28333eaa142bc59fac0aa8f52e96e311161d47f096accb837ecb2b1","observation_id":"7c969739-741f-4208-b269-6ec855d327a3","resolution":{"observed_at":"2026-05-11T18:51:07.497023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"b4b3f035-e942-4279-85e7-513d4a8fe684","year":2022},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:5114d74978899bea3b4f074e5b13c940fed577d2348a570442e397eb65cd710d","observation_id":"92470023-da72-491e-afa9-b976441be1cd","resolution":{"observed_at":"2026-05-26T12:17:18.101675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QLoRA: Efficient finetuning of quantized LLMs","venue":null,"work_id":"71d00be2-ab0f-44f7-b23f-cdfc8298e3ec","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:69344ac4fc5f69ab0a00cc6867fa345b6610df7e95fdbac3883c55af1ecd16b6","observation_id":"f226b1aa-5ade-40b4-8542-9c4be168fbc0","resolution":{"observed_at":"2026-05-26T12:17:18.033598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20211","last_updated":"2026-04-19T06:58:04Z","snapshot_observed_at":"2026-07-06T21:30:46.863005Z","submitted_at":"2025-05-26T16:52:40Z","title":"PiCa: Parameter-Efficient Fine-Tuning with Column Space Projection","version":3},"cited_work":{"arxiv_id":"2505.20211","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20211","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PiCa: Parameter-Efficient Fine-Tuning with Column Space Projection","venue":"cs.LG","work_id":"b5a22a97-9d79-4da0-a593-1140a8c67996","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2505.20211","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e88d189cf9f5cfc548c896eee3630c0e4248f7ab60c3a5ab026909760d8ef376","observation_id":"8d569b51-4092-4c13-b556-ed97e9458c76","resolution":{"observed_at":"2026-05-11T18:51:07.449527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QWHA: Quantization-aware walsh-hadamard adapta- tion for parameter-efficient fine-tuning on large language models","venue":null,"work_id":"53db0448-9e19-47b5-ab50-8cff5e36275e","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:8e73d76892e4fa11bff2b6c2f68c073b3c70443d7b3f83f9532b5e99ec710b24","observation_id":"7416cd68-0f36-495a-aa68-495c57c6331c","resolution":{"observed_at":"2026-05-26T12:17:17.989262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient fine-tuning methods for pretrained language models: A critical review and assessment","venue":null,"work_id":"a0c0182d-83c8-48e9-9880-10d111f0494a","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:fc2781de2733e7c8fa09dc77a6a5f38173bc1b2aa830f3a87c822b26a641e346","observation_id":"7881de0b-e4ec-4655-b723-8b3f7deed8d8","resolution":{"observed_at":"2026-05-26T12:17:18.116948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient tuning with special token adaptation","venue":null,"work_id":"e4105e17-7451-47e1-a6b2-86ea0b460222","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:4b67329d70ad82dec286fc3efe3fa2ccdb35869781476dafa5b1adb0e5cfe8e3","observation_id":"139c5c5f-676f-4dd1-b9b1-d52b2771f7a8","resolution":{"observed_at":"2026-05-26T12:17:18.021254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multitask prompt tuning enables parameter-efficient transfer learning","venue":null,"work_id":"bab742de-ced9-4212-90c7-bfc14cdaeb86","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:a0f88fc108d8832c688fe48eb05d0fa5b2ce84d5bfe6287f2e1f4974669ff478","observation_id":"48f4c21c-0240-438d-9e14-6a8c139b33a9","resolution":{"observed_at":"2026-05-26T12:17:17.998234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Galore: Memory-efficient LLM training by gradient low-rank projection","venue":null,"work_id":"1bd1fc39-ffc9-4307-a924-f8c50b2114cb","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:41e719ad756c0820d78e86997744aee760f47abf4ecd70f828fead05212e7911","observation_id":"7bf84b4f-27b8-45b9-9ade-b2f373b34873","resolution":{"observed_at":"2026-05-26T12:12:18.487625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DoRA: Weight-decomposed low-rank adaptation","venue":null,"work_id":"160743f5-698f-4150-b915-37e0676f69ea","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:89d9bf20dca54bc8403de5b9c94ab8d5dbf16be6faa7ae4364146f07d7989af2","observation_id":"0132444b-33e5-4745-b30f-269805efd0ee","resolution":{"observed_at":"2026-05-26T12:12:18.490983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make pre-trained model reversible: From parameter to memory efficient fine-tuning","venue":null,"work_id":"90b0be3a-d9c3-4af0-be65-2e251dede6de","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:924b4f6233bed159b1658293a03568bc7243deb74395877509c4bdc343541035","observation_id":"0bf552d5-29a1-4260-8ed5-cb0402630aa4","resolution":{"observed_at":"2026-05-26T12:12:18.497128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SVFT: Parameter-efficient fine-tuning with singular vectors","venue":null,"work_id":"6fb64e68-14b2-440c-ac09-7a868d2af5e1","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:81112f57e4b104e0dcf023e4565d2c6949a26bd7db54bd3098c1d6e6993e106e","observation_id":"cffdcafe-5ec0-45ab-9845-35582f2bc84d","resolution":{"observed_at":"2026-05-26T12:12:18.499964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Increasing model capacity for free: A simple strategy for parameter efficient fine-tuning","venue":null,"work_id":"58cc1404-7ef4-4958-9fc8-9242d5e8d26e","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:205f6cad755334c3523d5acfdf7e30c4ac7082ebc8c140a5b6b57b26602e467c","observation_id":"c7bdf4d7-7a5d-49fd-8d87-0bce76dc4ecc","resolution":{"observed_at":"2026-05-26T12:12:18.477820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LESS: Selecting influential data for targeted instruction tuning","venue":null,"work_id":"a846c035-049d-43ba-9322-55c5997dee1e","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:c9e776c516b270bf01407390f623f28323a85f0acaa6d4354cc29c3ee70118c2","observation_id":"28a3dee9-4dae-4602-8100-5e898db53f11","resolution":{"observed_at":"2026-05-26T12:12:18.506004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Upweighting easy samples in fine-tuning mitigates forgetting","venue":null,"work_id":"0fdab91e-79c0-4099-95e2-7749ab3b0a46","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:d8a0f11b3f348286f7ec67597f531e077fbb06b36c5e30f479a5ebdd2b859272","observation_id":"cc493171-0578-4a97-ad6a-4512eb5c07b8","resolution":{"observed_at":"2026-05-26T12:17:18.121092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Skrull: Towards efficient long context fine-tuning through dynamic data scheduling","venue":null,"work_id":"46fe6f87-ec46-4a57-b049-02d9de41c3c0","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:1ecc4e25deddae159e5c92602ecdffb6bd9d8b8088d259c60a8278cab6d56e79","observation_id":"ba7c2cf1-fc06-4cba-aa50-6364c9c921e6","resolution":{"observed_at":"2026-05-26T12:12:18.420306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Difficulty is not enough: Curriculum learning for llms fine-tuning must consider utility","venue":null,"work_id":"86c2a74b-2eb7-4d66-8339-f1a8d18b116a","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:fda7f26b1ef4d9544d0c1a86522860b159898175753638c7a37d3bdbb2e94323","observation_id":"01d5fe9f-f963-41ce-b08c-d746f4de0b68","resolution":{"observed_at":"2026-05-26T12:12:18.345146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deft-ucs: Data efficient fine-tuning for pre-trained language models via unsuper- vised core-set selection for text-editing","venue":null,"work_id":"96bcbb76-744e-40a4-901a-5f243eefd3d1","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:5c541d09e7430f8573ee69cc88b617cdd918e3ba7e347ada5120d253516bdce3","observation_id":"dec6fa5d-57c1-4734-89b1-6f7e81ad87a3","resolution":{"observed_at":"2026-05-26T12:12:18.342209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DELIFT: Data efficient language model in- struction fine-tuning","venue":null,"work_id":"93b2afcc-3567-4ba6-97a5-f67df03ea686","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:896b39edf4ce40aca4d2a8e805bd9a4a6ae8ff029dafe53819e62160f1c001b9","observation_id":"1c1947d3-5aa3-4215-92fe-9c3e05d5685e","resolution":{"observed_at":"2026-05-26T12:12:18.347994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task-specific skill localization in fine-tuned language models","venue":null,"work_id":"80e45f5d-66e7-46f8-b3f7-0f26dc023d4b","year":2023},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:41c586cc424e89a05d60ca9a7393e4372202e3be38e4d4138a2fd6a69a87db0f","observation_id":"ed268af7-c418-4feb-8518-fb27ad75c007","resolution":{"observed_at":"2026-05-26T12:12:18.353632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sparse is enough in fine-tuning pre-trained large language models","venue":null,"work_id":"39bb7fda-0112-418b-b726-33a16fbd04b4","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:3bfc9d7f42fa0a6d59dc1b09b18300dbee447f02809437f669d68dbbe41a62ba","observation_id":"d4055f8d-0240-4570-9954-c04dbe493611","resolution":{"observed_at":"2026-05-26T12:12:18.331645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"S$^{2}$FT: Efficient, scalable and generalizable LLM fine-tuning by structured sparsity","venue":null,"work_id":"984a7302-2f19-4cdb-bd7f-e85b592de292","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:efbd66fe77effc4f582a94d4c4b90afdcc1c99cfd4961e8e2c5e66ddd6213030","observation_id":"7d99548f-0716-49f2-b87c-529bb10fbecc","resolution":{"observed_at":"2026-05-26T12:12:18.325163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LISA: Layerwise importance sampling for memory-efficient large language model fine-tuning","venue":null,"work_id":"dc1a3dfb-2de2-4707-afcf-136fc5dccdf5","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:0a6aa5b4f3ae10f07a31055cbc8eb81eb3acfa594ee11a546162a56055b36a4e","observation_id":"3381605a-0984-4300-a049-1e6274ced326","resolution":{"observed_at":"2026-05-26T12:12:18.509231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SMT: Fine-tuning large language models with sparse matrices","venue":null,"work_id":"1d1f2230-5ef7-41ff-8c7e-d402f9c65a99","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:724715b75509594835d0d55ee69a6d2b3a043e4e1ac69de26d94d31a0cfe53bf","observation_id":"1d164f14-a5ad-460e-a573-66cefa1005fe","resolution":{"observed_at":"2026-05-26T12:17:18.073276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LIFT the veil for the truth: Principal weights emerge after rank reduction for reasoning-focused supervised fine-tuning","venue":null,"work_id":"4a11625a-3bd2-47c6-bc42-1f4b5384cad4","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:4b93369dcf4c803b52278e8422e3ac6bdfcbc6bbe99afc91afd4a2cc58f016ea","observation_id":"731bfbd5-acc9-4f77-8d1e-09437f454a46","resolution":{"observed_at":"2026-05-26T12:12:18.318651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pay attention to small weights","venue":null,"work_id":"c9eeea88-65fe-468a-a679-2d0668238125","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:08c002e70eee7236d14cf16f26d874aec7dd6adbb18f1b6be02d0effe205710c","observation_id":"e70eb35c-227f-415c-bc71-94ee5d3c8f74","resolution":{"observed_at":"2026-05-26T12:17:17.993506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.15103","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.575777Z","title":"Jerry Liu","venue":null,"work_id":"be1bcddb-4d80-4c6e-94eb-0a6cd0f0ccf2","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:55d89c404a6797d3aa6aef61bf8bcbc4ce89569660b2079f372c2cbb59019940","observation_id":"fa7c2943-6b3d-4e29-926b-10ccd408a94f","resolution":{"observed_at":"2026-05-11T18:51:07.462583Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gast: Gradient-aligned sparse tuning of large language models with data-layer selection","venue":null,"work_id":"55b6f4ed-a754-4122-857d-13f424628ad2","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:b83956bcc76d80d8e6e657e01c43b7bec38577208d35d5740e80b6e8933367cb","observation_id":"8d539e49-d752-4538-9d02-5fed955331a4","resolution":{"observed_at":"2026-05-26T12:17:18.085372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FisherSFT: Data-efficient supervised fine-tuning of language models using information gain","venue":null,"work_id":"70b463a7-1a0e-4f36-ad32-c749e7982671","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:aeefeb3bb80dbe4ae8395fe9618dccef23ed648ee67a95c07c831cc24c72159d","observation_id":"1a7a411b-c0b4-4028-b713-2479d85c0f7c","resolution":{"observed_at":"2026-05-26T12:12:18.315250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Boosting multi-domain fine-tuning of large language models through evolving interactions between samples","venue":null,"work_id":"797c028f-3705-4280-a726-f30326da50d5","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e4384937d6bb167bd25cae7e10b7eb2caac918795c030c1bd3c480b97443f45d","observation_id":"96a7464a-cedf-4a98-bf25-6f2574f51c89","resolution":{"observed_at":"2026-05-26T12:12:18.321664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Joint selection for large-scale pre-training data via policy gradient-based mask learning","venue":null,"work_id":"3ef43226-dec6-4f57-8fbd-e59b66e7585d","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:518e079ed51fa70082829d090cccbcd6b879a5d82ae4c70c8b6574a2747e8dbc","observation_id":"ff725076-b30a-4925-aba5-916a354748a8","resolution":{"observed_at":"2026-05-26T12:12:18.328445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.18584","last_updated":"2026-05-16T01:08:46Z","snapshot_observed_at":"2026-08-02T09:38:59.455163Z","submitted_at":"2026-02-20T19:44:24Z","title":"GIST: Targeted Data Selection for Instruction Tuning via Coupled Optimization Geometry","version":2},"cited_work":{"arxiv_id":"2602.18584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.18584","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gist: Targeted data selection for instruction tuning via coupled optimization geometry","venue":null,"work_id":"733260f5-ea03-4d30-8c32-f2ab4904797c","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2602.18584","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:84873413a36236635c4b14239a6364b982942e683e11b6ba18973b38b1883707","observation_id":"936ee5ac-eeb7-4045-aef5-3041bc7d0bbb","resolution":{"observed_at":"2026-05-20T00:02:09.973489Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SPICE: Submodular penalized information–conflict selection for efficient large language model training","venue":null,"work_id":"c42a5287-f988-4ee4-9071-6a883937a242","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:8aad8cc63170af9e545b0a0df005cae222691a615c2779609c09e28e1238bea9","observation_id":"018ab265-2dca-49b9-bf32-2e8ba52fbf5b","resolution":{"observed_at":"2026-05-26T12:12:18.339169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tuning layernorm in attention: Towards efficient multi-modal LLM finetuning","venue":null,"work_id":"f008144a-bca4-4149-bc18-a060fc11262e","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:69e5cf7f268f575461767db291a72a8767763a32e310a1bf66670e9f110f5a57","observation_id":"e9dbd2cd-abdd-4ea5-b390-42f644717438","resolution":{"observed_at":"2026-05-26T12:12:18.312363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SparseloRA: Accelerating LLM fine-tuning with contextual sparsity","venue":null,"work_id":"4488c46d-4042-4c66-8af1-b2cb5e6da2f7","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:8a01c5d300deb5805d441b9104d465cc8ca0ad65ce0a9056b1353a3b400669da","observation_id":"f36ec71c-1d54-4629-9640-41e36af9cc1b","resolution":{"observed_at":"2026-05-26T12:12:18.306225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tr-pts: Task-relevant parameter and token selection for efficient tuning","venue":null,"work_id":"804c5737-ec1c-4cc2-b314-1ad385406380","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:5681382a7e8aee967226d0a21ea5184f7e0074788ed931ab3e83d9a25686fe62","observation_id":"9200c31e-d192-4cfa-a397-5594ae32d57b","resolution":{"observed_at":"2026-05-26T12:12:18.335341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AI progress should be measured by capability-per-resource, not scale alone: A framework for gradient-guided resource allocation in LLMs","venue":null,"work_id":"404298e2-c8fa-4dce-906c-363157223abc","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:b68a9623b3c8f666a2cb6a035d7359aa4f8cb3ff6222b96c7242322829733447","observation_id":"3fc3ae67-59d5-45cb-8a10-641ae5e35b2c","resolution":{"observed_at":"2026-05-26T12:12:18.361819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating forgetting in LLM fine- tuning via low-perplexity token learning","venue":null,"work_id":"3c9d84f9-8485-412f-bdba-0469b7582d62","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:cfea404ec485a9119bd8fe4aa3eae9d572900187d4794f4dc0bd6f1949e15f74","observation_id":"5526dc4a-c7b2-4805-9601-171a0d585343","resolution":{"observed_at":"2026-05-26T12:12:18.428330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the loss of context awareness in general instruction fine-tuning","venue":null,"work_id":"0b8021d2-e58e-4b8c-b248-7a0dd0eb4ce7","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e33912267709df5ad2cfeba85b7853de892b679f208893e3077e191507de8a91","observation_id":"141930e2-7668-4499-bc22-837c63e18056","resolution":{"observed_at":"2026-05-26T12:17:18.068415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mapping post-training forgetting in language models at scale","venue":null,"work_id":"55844fe3-e141-4d80-86da-e85479e816f4","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:f6b80364f244b9ef8e5c20a4ec0107cd96ea1f1d853abb57d829fcf89ec0c706","observation_id":"cdc8b943-c92a-4876-895f-bd19b1a6a77d","resolution":{"observed_at":"2026-05-26T12:17:18.141890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Don’t make it up: Preserving ignorance awareness in LLM fine-tuning","venue":null,"work_id":"421c4bf6-cf48-4a34-9a78-f1b44b7135d9","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:1011f2f4296d8f331755c5c49dabeb7c72eb1b9c983b04d3e1e784340731ea63","observation_id":"45ce195f-8ccb-449d-817a-c62d8be942ad","resolution":{"observed_at":"2026-05-26T12:17:17.970373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SFT doesn’t always hurt general capa- bilities: Revisiting domain-specific fine-tuning in LLMs","venue":null,"work_id":"f0c4945a-4450-473e-9e50-82f2bf9cf242","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:ee93c18bbc3dbf55dcfed2d19813c7f99b1cfdaaf602e0628a05bd5e9e1315cd","observation_id":"f1e6a252-e3f6-4986-a9b9-50330a5e6f11","resolution":{"observed_at":"2026-05-26T12:12:18.481331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating catastrophic forgetting in large language models with forgetting-aware pruning","venue":null,"work_id":"2af597e0-6f52-4e6f-817f-8a66b6124ed5","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:d751d57763473080f5ecdbe25f76b58238bdfa001a20896e0c12bdf8a8190d1f","observation_id":"be094fb0-7b19-4450-963f-5f609540d75a","resolution":{"observed_at":"2026-05-26T12:12:18.466746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magicoder: Empowering code generation with OSS- instruct","venue":null,"work_id":"9a56c39e-ba87-4d22-a7f5-c7e1bf1b346e","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:c2ac649ddd89cecde6bb6fd6a474061acb9e1f9440126fe5c36b4083560082ef","observation_id":"f1e5faa6-b8f2-4021-8b97-7274fad22695","resolution":{"observed_at":"2026-05-26T12:12:18.456019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":"d8346fa5-29e7-49fb-afc9-b9cba507ae0c","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:1c7d860d3cdd26c7c0918b99a78a8d783a88613cb143f718fe25d04551e1b295","observation_id":"a1759239-91b2-4e47-84f0-0f50df48186b","resolution":{"observed_at":"2026-05-26T12:12:18.462759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lofit: Localized fine-tuning on LLM representations","venue":null,"work_id":"884ad973-5403-4440-bc03-6e01e76db41f","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:9650286710794b50b3e5571d8ff6bf500e6dcada19cce1db1b508b4aa0c98060","observation_id":"f60765c9-4e67-499e-ab64-220b92507306","resolution":{"observed_at":"2026-05-26T12:12:18.485019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16405","last_updated":"2024-02-02T14:53:14Z","snapshot_observed_at":"2026-08-07T04:07:00.490666Z","submitted_at":"2024-01-29T18:43:49Z","title":"Scaling Sparse Fine-Tuning to Large Language Models","version":2},"cited_work":{"arxiv_id":"2401.16405","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.16405","snapshot_observed_at":"2026-06-28T17:22:25.160984Z","title":"Scaling sparse fine-tuning to large language models","venue":null,"work_id":"58935267-7552-460e-b8ec-ac482726f047","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2401.16405","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:08c609e55dd018bef6ee801d0791d31b4c3317dd90f280bc22a228610466a4c4","observation_id":"ddf44ea6-beb2-429c-9c30-f61b3ae30fb7","resolution":{"observed_at":"2026-05-11T18:51:07.475875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taso: Task-aligned sparse optimization for parameter-efficient model adaptation","venue":null,"work_id":"1432f9c5-476a-475f-8864-9581b866c0a7","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:ef6585a7700f5df1af2a65fe73a7cee1283e1fa47d2a416a74fbb8f99eb54d95","observation_id":"24d96dbf-87cc-4837-863c-e9f7382093cd","resolution":{"observed_at":"2026-05-26T12:17:18.055281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13669","last_updated":"2025-02-17T13:10:33Z","snapshot_observed_at":"2026-07-06T20:24:59.539207Z","submitted_at":"2025-01-23T13:54:53Z","title":"How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization","version":2},"cited_work":{"arxiv_id":"2501.13669","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13669","snapshot_observed_at":"2026-07-03T16:48:39.897925Z","title":"How to alleviate catastrophic forgetting in llms finetuning? hierarchical layer-wise and element-wise regularization","venue":null,"work_id":"34c3a01d-9101-40cb-a0fe-8809f3a3b5e2","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2501.13669","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:51fb61d20e73dc0f9035ef58dd37eee2f8cb9d2f9943e0fe3910aad1492963b8","observation_id":"77785bd3-0de9-4bd4-a6c8-5aac75750fa7","resolution":{"observed_at":"2026-05-11T18:51:07.467799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-07-06T21:34:15.440576Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"cited_work":{"arxiv_id":"2506.00495","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00495","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Floe: Fisher-based layer selection for efficient sparse adaptation of low-rank experts","venue":null,"work_id":"b326173b-5a35-4b60-ab02-d122997a90e7","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2506.00495","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:8cfd814947a5f085c45c3381824d6af607b0ff15da6ee4b762449a08ea461e38","observation_id":"cf0213bb-963b-4605-99a1-ce6dd3a2fdce","resolution":{"observed_at":"2026-05-11T18:51:07.433669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hft: Half fine-tuning for large language models","venue":null,"work_id":"970e71af-b72a-4b0e-a257-b786664085e3","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:6221ab4b437df5ed2bc1a5a828437c2aff9c7c225179449d9b03e6a72738e416","observation_id":"0d65d3bc-4124-4f05-a67d-974846160c4f","resolution":{"observed_at":"2026-05-26T12:17:18.129185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recurrent knowledge identification and fusion for language model continual learning","venue":null,"work_id":"21bb683d-d162-4ce0-a0b1-2fa705917d09","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:5ada257a5d1fdaa2bf953e2ba94b2cccb1c2012af277f824593e8124872e99f3","observation_id":"fd958bc8-e338-4d5e-a244-a0a3f2145e12","resolution":{"observed_at":"2026-05-26T12:12:18.448847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.15375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter importance-driven continual learning for foundation mod- els","venue":null,"work_id":"fbf91197-e63a-450f-9539-0a4fc52c3cd6","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:ad5ea2a5678d8ef79c6ec98af843b6d8627ff1f966675e6790ed33868418900e","observation_id":"bdd2db40-f36e-4d1f-9ff2-5b73b9e3afe3","resolution":{"observed_at":"2026-05-11T18:51:07.439079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MODEL SHAPLEY : Find your ideal parameter player via one gradient backpropagation","venue":null,"work_id":"30160ff5-6d3e-422b-b914-2b462ff882cb","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:60b0c02639fc97c4bd4b2df06977f34ad87e93cfe27b6736595e5112e46aa839","observation_id":"704a610b-e652-491c-bff4-5e4dc1b9c35f","resolution":{"observed_at":"2026-05-26T12:12:18.401310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ShaploRA: Allocation of low-rank adaption on large language models via shapley value inspired importance estimation","venue":null,"work_id":"076be75f-e2f9-4a0f-a745-addbee0d4b38","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:98a84f197879472b3bda56e799e9dee84a4ecc4904b0dd68776ec8d7903f8678","observation_id":"547beda4-22e7-490d-a40c-3ada6002ce2e","resolution":{"observed_at":"2026-05-26T12:12:18.424979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pruning as a cooperative game: Surrogate- assisted layer contribution estimation for large language models","venue":null,"work_id":"a376bc8d-9cb8-412a-bbe4-7c95865230c3","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:dd804d09df71091a527ba9a0b3208e8d24dc3014b338c96cf4605a9766991d9d","observation_id":"ac16f2d1-6b75-4ece-9d00-b71d98f5b51c","resolution":{"observed_at":"2026-05-26T12:12:18.441616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Token cleaning: Fine-grained data selec- tion for LLM supervised fine-tuning","venue":null,"work_id":"91c1366e-6a7f-486c-bb63-d5eba291ea07","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:f77722aafde42bda1f93cba6100843b2ef1e0d4ab7b53a50062fdadaf35c9acc","observation_id":"664d7d6e-5e63-4543-8c73-3c69072bd468","resolution":{"observed_at":"2026-05-26T12:17:18.105393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Token-level data selection for safe LLM fine-tuning","venue":null,"work_id":"1f9b5e5c-c796-468c-bbc9-73b6fe887a1d","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:40e87f05c42fa0a6e41a53db97cc104c9a449f0e6b6503ccb5751927e2ee58d0","observation_id":"6a2305f5-2579-4852-8bee-0aa35a72dead","resolution":{"observed_at":"2026-05-26T12:17:18.016783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"sstoken: Self-modulated and semantic-aware token selection for LLM fine-tuning","venue":null,"work_id":"7dedee5b-014b-49a0-a6c0-597a46745c8a","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:545417f718100f4d1f16805a471574bf9d823d161918f7160847e2b7e7dccb20","observation_id":"c60a3888-a52e-4ca7-b12d-3a3eb7595901","resolution":{"observed_at":"2026-05-26T12:17:18.146252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Train on validation (tov): Fast data selection with applications to fine-tuning","venue":null,"work_id":"7ea75682-8753-492b-9a5d-9d6fc0b6ac36","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:07a4419ae9258e5909d970e7802cc82c472785a77ce00e0493026e98a80b7755","observation_id":"ed43311e-958f-470f-9d0d-4018a37c5264","resolution":{"observed_at":"2026-05-26T12:17:18.150704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MATES: Model-aware data selection for efficient pretraining with data influence models","venue":null,"work_id":"292a8357-9135-496d-8c56-e3d8607c7b6e","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:2024de66bd853c690ed9fe76b665674662688d7edb1acb27f3e75223f9ededc9","observation_id":"a35c8257-e2a7-463f-89b5-fb3699fb5a12","resolution":{"observed_at":"2026-05-26T12:17:18.093764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn more, forget less: A gradient-aware data selection approach for llm","venue":null,"work_id":"e0a4998b-1dbb-45f1-8b12-a4ae27146860","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:1ccee391628c1f6cae05ab18055c2c2e7616d963ea742713ff01c1dd5b1e9f17","observation_id":"100b065f-b42f-4b0e-a7d5-a852d4882cd7","resolution":{"observed_at":"2026-05-26T12:17:17.980482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SEAL: Safety-enhanced aligned LLM fine-tuning via bilevel data selection","venue":null,"work_id":"61a777c9-3129-4fa9-b923-74c8a96ca0e9","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:c0fd522f73cb612d0c34afc7d5c3ca743d6eb36f6ec2656312818d7efb378520","observation_id":"fb3530cb-53af-4d08-ad86-9750c7ede8ac","resolution":{"observed_at":"2026-05-26T12:17:18.007633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data shapley in one training run","venue":null,"work_id":"6fd39ac1-a61f-444b-82dc-c71210c2b794","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:a61135188a76176428db5e2cd32481937fc41b55a8602e540518342b400555f8","observation_id":"097eb2ee-010d-424f-8d75-5f844738eae7","resolution":{"observed_at":"2026-05-26T12:17:18.060020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoIDO: Efficient data selection for visual instruc- tion tuning via coupled importance-diversity optimization","venue":null,"work_id":"c9e9879c-86bb-4555-ade9-37ec735954a3","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:cede9c4687b2b4c68c671eb494ea2ca0021c93b77869d447bb34f27a9fb74d14","observation_id":"4b50134d-bab6-4827-962a-fc738b48ba7c","resolution":{"observed_at":"2026-05-26T12:12:18.494294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diversity as a reward: Fine-tuning LLMs on a mixture of domain-undetermined data","venue":null,"work_id":"d3c4520d-e61d-46e6-925d-9b493872f45c","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:5f1af9bb02dd5980d798d6a46bf2f2f8e51a02a02b61e1368636cbfc5c208b2d","observation_id":"2ea5fccd-3fc7-4d25-94f6-dba7268bd48b","resolution":{"observed_at":"2026-05-26T12:17:17.975520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matched data, better mod- els: Target aligned data filtering with sparse features","venue":null,"work_id":"947cc3ef-b693-4f9a-8ce9-cf85b8d02450","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:d5ada7b553e98fd0702cd9d76640426080903a3e3b6491b87d175497d4f0f7b6","observation_id":"d4273237-892f-4792-bd68-ec8d7300a6c5","resolution":{"observed_at":"2026-05-26T12:12:18.453170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PASER: Post-training data selection for efficient pruned large language model recovery","venue":null,"work_id":"e7b22339-6cc1-41c3-968f-238c988cd759","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:783f2df53df0830a952d9a99eb3ebbec9bca64504684b821ae6dd6a6a64b8691","observation_id":"588f5f7e-f28c-4e69-ab8d-63c11c7dcb04","resolution":{"observed_at":"2026-05-26T12:12:18.459304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LoRA learns less and forgets less","venue":null,"work_id":"1e9c8a59-f82c-496d-b075-0e328ddb7837","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:8e2267afd080fc926154855aec45438f279c90585de7a527602bfbca1975a17f","observation_id":"e5425a6e-f33b-455a-80b1-fd5af416f70a","resolution":{"observed_at":"2026-05-26T12:12:18.470109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CorDA: Context-oriented de- composition adaptation of large language models for task-aware parameter-efficient fine-tuning","venue":null,"work_id":"7b4cb48e-b51a-42c6-a31a-cf46981726b7","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:73c32785e93ddfa1b145a71544ada06fb0f5f799f6d91a6236f3cb1280208fb7","observation_id":"50c4cfd1-da53-4263-a967-534795f09592","resolution":{"observed_at":"2026-05-26T12:12:18.503080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Milora: Harnessing minor singular components for parameter-efficient llm finetuning","venue":null,"work_id":"71fd20b4-f421-4e11-9196-6a4dc2bc5ef8","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:9f311c3324b2a5cceb2b7106557861b0f936c93995b418ea850d8cbeb3d51d81","observation_id":"328027ef-afd5-4732-8817-af80f4de9125","resolution":{"observed_at":"2026-05-26T12:12:18.410037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.02659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora-null: Low-rank adaptation via null space for large language models","venue":null,"work_id":"93d35144-819b-4cdc-91f1-d88af603e497","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e3a91e9264fd29db0434688579da289e5a2f1b58d0ad8bd5d1f1cf6ad4dc678f","observation_id":"eff1649c-5131-41e1-9d26-df72a622f819","resolution":{"observed_at":"2026-05-11T18:51:07.479641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23724","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sc-lora: Balancing efficient fine-tuning and knowledge preservation via subspace-constrained lora","venue":null,"work_id":"f57d7b76-9a4f-4250-b60b-22c322c49caa","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:19612f54957c4b749c88cce793d177062033d9a538e84c50c1a6ab54217cdc0f","observation_id":"4ba5e474-d853-47e0-b550-026b36bcc0e1","resolution":{"observed_at":"2026-05-11T18:51:07.418727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Slim: Let llm learn more and forget less with soft lora and identity mixture","venue":null,"work_id":"3f37c5e7-7795-4eca-80b1-42e0ad75fd64","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:b856df23bf5990a0830830206b3a3af4aacd8446565a6ad2369bcd3961abcb2d","observation_id":"59fd743f-008f-45ba-9eeb-28784ab8c2c1","resolution":{"observed_at":"2026-05-26T12:12:18.395573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MoFO: Momentum-filtered optimizer for mitigating forgetting in LLM fine-tuning","venue":null,"work_id":"8e47283c-e3a4-4859-8fa9-6729e8354a5a","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:19f838ee7ec2fe0ca1e056f4eafc711809f4c3eb36945d1ccbe75f9f225b2d3e","observation_id":"5b7cfe1d-29c2-4883-b04e-04dd7f48d2ef","resolution":{"observed_at":"2026-05-26T12:12:18.398448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Loki: Low-damage knowledge implant- ing of large language models","venue":null,"work_id":"251e315c-1469-4735-af11-64fa7a2c5ddc","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:191c413102285b7b59e21ea61fb268f0141f0e3f7093146163f66422ba8bd4a0","observation_id":"768ab543-5c36-40fa-b3b9-8a24523e3603","resolution":{"observed_at":"2026-05-26T12:12:18.415473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Damoc: Efficiently selecting the optimal large language model for fine-tuning domain tasks based on data and model compression","venue":null,"work_id":"4fefaa20-74d8-457e-b582-554908a2ecc3","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:5c0838a995f91feb24df6d2643a1f98ffef50f4a1ad2bb7190bb62d65cc6f62c","observation_id":"075c408e-1b0d-410c-801f-822c023516dc","resolution":{"observed_at":"2026-05-26T12:12:18.392509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks","venue":null,"work_id":"8b7d4bc3-ee7d-4e42-b503-bd87e89f57fc","year":2017},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:abf7fc64282c80dfeca2edc1a6942cfdee8722871839d64ee94e431ef8e46e11","observation_id":"4311939a-5251-4bd3-8f82-510b6a0e0b04","resolution":{"observed_at":"2026-05-26T12:12:18.371219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bilevel programming for hyperparameter optimization and meta-learning","venue":null,"work_id":"6b0829b1-e9da-4cfa-977b-2964ed5c59ea","year":2018},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:4f4b3254fb8e3e2bf451208422a0ec2430ab8fa8ab9319a6bbc75f65971fb492","observation_id":"38c1c205-d7ae-4d77-b003-9cdc6f972571","resolution":{"observed_at":"2026-05-26T12:12:18.374659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DARTS: Differentiable architecture search","venue":null,"work_id":"868fd936-c82e-43ef-a2c1-64e5918ff854","year":2019},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:8d23ca5cd47aef133b92ea1643815614a009522409b4142957ff67184d3db12a","observation_id":"01cc9b07-0724-4221-90b7-b6e6479d074b","resolution":{"observed_at":"2026-05-26T12:12:18.378357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glister: Generalization based data subset selection for efficient and robust learning","venue":null,"work_id":"556ef4d5-e962-4741-bb00-475286f136da","year":2021},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:e99029398f5d4a57b1b20573423e3c5030ab7ae7652108f531ce943dd0097b67","observation_id":"3e209921-3188-4945-a222-1e84e4edfa0d","resolution":{"observed_at":"2026-05-26T12:12:18.382428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LLM data selection and utilization via dynamic bi-level optimization","venue":null,"work_id":"e014fda7-66c9-4384-8848-08abb7ed3141","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:32a567c719435d68cd579e05136852e1ba35de8dfbfeaf42e30d1699bbb0f408","observation_id":"c938db5e-2b96-47cf-a2d3-b9268e6f1a81","resolution":{"observed_at":"2026-05-26T12:12:18.364659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compress large language models via collaboration between learning and matrix approximation","venue":null,"work_id":"222e4867-d0e2-428c-849a-e6eae67d6c6d","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:41bfcf3ba7926a510298adca8fe00bfafa68b3c36c8ca333159f9e2d8b4271c1","observation_id":"89c984ae-a3dc-4b76-8f4b-48bab8fa9057","resolution":{"observed_at":"2026-05-26T12:12:18.367995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bilevel ZOFO: Efficient LLM fine-tuning and meta- training","venue":null,"work_id":"6861ddfe-214d-4a08-87d7-53a3965157ce","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:05514a379fdc94139c9e39a7f033f91f313921d5eadf6c099cf3214ccfb82e10","observation_id":"3240c1a6-0205-47c6-874f-797f6c4994e9","resolution":{"observed_at":"2026-05-26T12:12:18.388809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond value functions: Single-loop bilevel optimization under flatness conditions","venue":null,"work_id":"1ac12dff-a1c1-49fc-bc50-34c3bf8859af","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:b4ddae862f6c22b74e37a300e1307babd7500a1cd99d3e47bad345bfad6b7ef3","observation_id":"ba6e66a9-4c61-4a08-8822-66b784a1008f","resolution":{"observed_at":"2026-05-26T12:12:18.406254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GREATS: Online selection of high-quality data for LLM training in every iteration","venue":null,"work_id":"2561f4e1-12bc-48eb-9f6f-32ebdc115f10","year":2024},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:1697820be2b63432369716b0535b05eb3bbb761c0a8deb775da0489e7e0ae567","observation_id":"89184c7e-5b1f-420f-9806-4154ac5dcc6b","resolution":{"observed_at":"2026-05-26T12:12:18.445491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Influence-preserving proxies for gradient-based data selection in LLM finetuning","venue":null,"work_id":"822c0332-db63-4714-ae8d-a4b0da96fa93","year":2026},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:208e77a5ed102e8fd73b483f1133f8eee375a2c840b80d393b1d942633a3afe5","observation_id":"0a47be6f-99d6-4e16-811f-f0f1cee48a3f","resolution":{"observed_at":"2026-05-26T12:12:18.350561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient data selection at scale via influence distillation","venue":null,"work_id":"7ddca03c-4589-4b7b-97b0-5b7c326f306b","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:2d8798a0ba7394b1429a633d06f1df9838e8f7cb880456cf44724a02ae292a58","observation_id":"98a91caf-59f4-4a4b-a4a0-c7319757e690","resolution":{"observed_at":"2026-05-26T12:17:18.012253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Group-level data selection for efficient pretraining","venue":null,"work_id":"ce242ff0-587b-4e15-8131-da1927d57618","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:87a6b9a3ff03c19dbe5786cf382632eef880acddfeb2681bcdd9b99e6b6c863e","observation_id":"0a1d56dd-7cdf-438d-a758-f5c16de16fee","resolution":{"observed_at":"2026-05-26T12:12:18.356187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Second-order fine-tuning without pain for LLMs: A hessian informed zeroth-order optimizer","venue":null,"work_id":"65a689ff-6f72-496f-acb2-fdb835931251","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:ce1cc0c1cccb6f732cacd9f72fb25ce24febe5aaf4a88e22928ec9a06a185561","observation_id":"b2ec0ca6-d1b4-431b-a1b8-d0ef922dd963","resolution":{"observed_at":"2026-05-26T12:12:18.436816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PaZO: Preconditioned accelerated zeroth-order optimization for fine-tuning LLMs","venue":null,"work_id":"297208a6-874f-47b4-84f1-f2cd293221f6","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:adb6cb053b0ffad88f58f4003afbc4e8ff7a5344d026350b58b7b0e6c765e411","observation_id":"58959dfb-7aed-4131-82ec-085a68045a02","resolution":{"observed_at":"2026-05-26T12:12:18.474171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Helene: Hessian layer-wise clipping and gradient annealing for accelerating fine-tuning llm with zeroth-order optimization","venue":null,"work_id":"65795e61-7a91-452c-85d8-45f6a7ac2f89","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:fd2e8028e3dba9dc4997b77416175926af38e650d05175869c022c2bceb5bdf9","observation_id":"3aae9b97-c520-4ae5-95f8-3dc926efb80b","resolution":{"observed_at":"2026-05-26T12:12:18.512215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating forgetting in low rank adap- tation","venue":null,"work_id":"070c2256-aa2c-42c9-8405-af93d6d158ef","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:569f065355e528a3856b3828c782cb4fe8722e48e835c05c72d65cf508510cbf","observation_id":"e61b6762-ca3f-47ef-814c-719820cd7053","resolution":{"observed_at":"2026-05-26T12:17:18.025638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adam-mini: Use fewer learning rates to gain more","venue":null,"work_id":"926378a4-3c8f-42b5-9156-767564820ddb","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:874c2e1f1ff43d75dfb240ac4deef708b756312d19c372a86f7880c297da6af1","observation_id":"04ae0284-ac76-4d44-b6cc-2d7a9485a945","resolution":{"observed_at":"2026-05-26T12:12:18.432811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When can you get away with low memory adam?","venue":null,"work_id":"b496b557-8d49-4ccf-bef3-0824fc5dabed","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:cc195675b021b0fedc8c443b448a829b9c8dde7166b6e1c9d826a2a5464cfeac","observation_id":"a245aee7-78e0-4b88-8f34-136eb1a2a1b1","resolution":{"observed_at":"2026-05-26T12:17:18.089561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04805","last_updated":"2026-05-25T11:37:32Z","snapshot_observed_at":"2026-07-06T21:37:04.422359Z","submitted_at":"2025-06-05T09:31:41Z","title":"Adaptive Preconditioners Trigger Loss Spikes in Adam","version":2},"cited_work":{"arxiv_id":"2506.04805","doi":"10.48550/arxiv.2506.04805","metadata_source":"pith","pith_arxiv_id":"2506.04805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adaptive preconditioners trigger loss spikes in Adam","venue":"cs.LG","work_id":"db7678ee-f2b1-4958-8a1f-b1297a31e62c","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2506.04805","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:d8f0a2c25dfcf795be12e660b610af88221de0238847ed22ff12c592331f36c9","observation_id":"b65fe672-dab5-4161-9207-3b456fe89c4e","resolution":{"observed_at":"2026-05-26T03:04:02.571868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LDAdam: Adaptive optimization from low- dimensional gradient statistics","venue":null,"work_id":"8eafc98f-034c-49db-8101-e3ecd54ccb70","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:365ef1e2232f7d249fdc331701e24340d62c4dde5401f95ac6c1528e23dd62f1","observation_id":"b7204905-68dc-408a-ad0d-b7bbad10b481","resolution":{"observed_at":"2026-05-26T12:17:18.077273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SOAP: Improving and stabilizing shampoo using adam for language modeling","venue":null,"work_id":"e5073068-836e-4c32-a9cd-52234a53af46","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:f42f7b20431cc4e91b0690eba692d9413d46f5b083db24118bc8e9f87c44d20e","observation_id":"041a49ce-38d0-4f13-b300-39b698006f44","resolution":{"observed_at":"2026-05-26T12:17:18.046528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T02:48:23.058877Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":11,"verified_fuzzy":88},"total_outbound_references":124},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 124 outbound references and 0 inbound Pith citation observations for arXiv:2605.06166."}