{"as_of":"2026-08-08T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbebc4cfe7b1f6148a2952c6bfa91b1999a1dba3e8b5da57ff7dc0fc6ba60db9","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:33:17.278546Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.16191/citation-record","integrity":"/paper/2508.16191/integrity","json":"/paper/2508.16191/citation-record.json","paper":"/paper/2508.16191"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.14470","last_updated":"2025-06-23T16:25:27Z","snapshot_observed_at":"2026-08-08T07:47:48.276022Z","submitted_at":"2024-08-26T17:58:53Z","title":"Step-by-Step Unmasking for Parameter-Efficient Fine-tuning of Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.14470","snapshot_observed_at":"2026-08-05T17:33:18.576356Z","title":"Step-by-Step Unmasking for Parameter-Efficient Fine-tuning of Large Language Models","venue":"cs.CL","work_id":"e890c929-459b-4258-af96-9e7a67fb1239","year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:12.771427Z"},"links":{"cited_paper":"/paper/2408.14470","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:ad37210ccd40008a5eaa9d2f3849a31e9c713557aa00deb9e3ee4d657b45cd2c","observation_id":"3f608c5b-67aa-4a15-8bda-57f44af4bdf0","resolution":{"observed_at":"2026-08-05T17:33:18.651844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-05T17:33:12.839802Z","title":"Program synthesis with large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:12.839802Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:706c6a2ad7ce12199a2b238d615be0116f6e834a4437cd8aef420080e646d473","observation_id":"ced5fa40-a84e-4dac-a45d-b66940ff799c","resolution":{"observed_at":"2026-08-05T17:33:12.839802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-05T17:33:12.919440Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:12.919440Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:7a6a21b0b9bea51b9c4b8974016ff290388a7b0318f06ee2b45293597fe07558","observation_id":"241aac14-8c28-42f1-a502-42a0da460e2f","resolution":{"observed_at":"2026-08-05T17:33:12.919440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:19.828001Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"134a43c3-7a41-40f0-8fbb-071817b831c5","year":2019},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.026944Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:fcf4eeab4c79a3966233fcca0e4b35638a28f7f09bd9f69649f8582514b1144d","observation_id":"0dd9c966-b57e-4491-a159-9a0eef6c84f5","resolution":{"observed_at":"2026-08-05T17:33:19.901950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T17:33:13.187428Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.187428Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:2d5317fdf4e9b1d587fa9a0a418155c406eea423a3d59e75815ab9acae124b14","observation_id":"6fb2da2f-5be9-48d8-9a22-bee4c867411b","resolution":{"observed_at":"2026-08-05T17:33:13.187428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:19.673766Z","title":"The pascal recognising textual entailment challenge","venue":null,"work_id":"dc5f1b2f-2e91-414a-921b-4ff8cad37052","year":2005},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.332462Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:dc6ee1bf57579480ef67a8a1bf3a1020ff69ede67d434265b9c329578adddd2c","observation_id":"31533800-2b6d-4326-82dc-8963d50809ac","resolution":{"observed_at":"2026-08-05T17:33:19.741861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03748","last_updated":"2023-11-07T06:19:37Z","snapshot_observed_at":"2026-08-08T05:21:34.325214Z","submitted_at":"2023-11-07T06:19:37Z","title":"Unified Low-Resource Sequence Labeling by Sample-Aware Dynamic Sparse Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03748","snapshot_observed_at":"2026-08-05T17:33:13.475037Z","title":"Unified low-resource sequence labeling by sample-aware dynamic sparse finetuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.475037Z"},"links":{"cited_paper":"/paper/2311.03748","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:c059137cf61e646a7d78fe7d0ef37873c712b78d672c59d26e2fac585202be41","observation_id":"d66a7e00-af97-493b-aaa5-77317cd53982","resolution":{"observed_at":"2026-08-05T17:33:13.475037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-05T17:33:13.567444Z","title":"Qlora: Efficient finetuning of quantized llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.567444Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:956e8c84583b241d6d7b7da70078bb201aefc95370cb65a624e79a3ad08ee423","observation_id":"bef0ac6b-7616-406b-9f20-d081a0622cfe","resolution":{"observed_at":"2026-08-05T17:33:13.567444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11696","last_updated":"2023-11-20T11:56:25Z","snapshot_observed_at":"2026-08-04T08:07:45.481643Z","submitted_at":"2023-11-20T11:56:25Z","title":"Sparse Low-rank Adaptation of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11696","snapshot_observed_at":"2026-08-05T17:33:13.657154Z","title":"Sparse low-rank adaptation of pre-trained language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.657154Z"},"links":{"cited_paper":"/paper/2311.11696","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:4008cd46739029cb43a804d64205f43e8e0141ca582111c9d30d11449146e3b2","observation_id":"dd989852-0977-45ed-b658-fe7f01c8d078","resolution":{"observed_at":"2026-08-05T17:33:13.657154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:19.524214Z","title":"Xo RA : Expander adapted lo RA finetuning","venue":null,"work_id":"4f913a3a-b9f5-402b-bdec-37306443bd2c","year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.736998Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:012e0ef4e1245609f8a4e9430aa8c9f56a0c1dbe1db91dfea884777945103907","observation_id":"41924d27-c112-44be-a263-08c62fac779e","resolution":{"observed_at":"2026-08-05T17:33:19.581371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-05T17:33:13.812258Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.812258Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:fa1f88b6388d6b0cca6814de60b56826bface4f5017b059d488cc09b80256119","observation_id":"4c022bbc-f032-41fa-91e3-065d2a571fb5","resolution":{"observed_at":"2026-08-05T17:33:13.812258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T17:33:13.957240Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:13.957240Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:cce800f360d1f502959f7945118ec9ae39f997ba08eceecac7948aa752ba0d91","observation_id":"d141022c-5142-4941-8199-f66c33bf4c97","resolution":{"observed_at":"2026-08-05T17:33:13.957240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03792","last_updated":"2024-06-06T07:03:29Z","snapshot_observed_at":"2026-08-05T15:34:38.847534Z","submitted_at":"2024-06-06T07:03:29Z","title":"Light-PEFT: Lightening Parameter-Efficient Fine-Tuning via Early Pruning","version":1},"cited_work":{"arxiv_id":"2406.03792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03792","snapshot_observed_at":"2026-08-05T17:33:18.312796Z","title":"Light-PEFT: Lightening Parameter-Efficient Fine-Tuning via Early Pruning","venue":"cs.CL","work_id":"3632371a-ebeb-4f4a-a2d0-09f8ee70ed7a","year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.113201Z"},"links":{"cited_paper":"/paper/2406.03792","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:15011e074b6cd6b32cacc7444a71d2138415b2ff4d1c2bb934ba3b9073e6ed68","observation_id":"9b212754-99a6-4e22-9e82-06e0e8796ff4","resolution":{"observed_at":"2026-08-05T17:33:18.411079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-05T17:33:14.227984Z","title":"Textbooks are all you need, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.227984Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:bae49cc7bc397b777f49652adc9d8d5f2cf21c9b18cb6d5394c50968b57c1cb6","observation_id":"cf19e553-4b57-4e17-a109-30cdf526e666","resolution":{"observed_at":"2026-08-05T17:33:14.227984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07463","last_updated":"2021-06-09T14:39:17Z","snapshot_observed_at":"2026-08-08T10:12:13.760366Z","submitted_at":"2020-12-14T12:34:01Z","title":"Parameter-Efficient Transfer Learning with Diff Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07463","snapshot_observed_at":"2026-08-05T17:33:14.305960Z","title":"Rush, and Yoon Kim","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.305960Z"},"links":{"cited_paper":"/paper/2012.07463","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:b08c66d96dfb347c46075c02e29373a257978589e3791cf17c795a999a81e845","observation_id":"2020c9fd-ada6-409f-8cb8-28bc2d8010cc","resolution":{"observed_at":"2026-08-05T17:33:14.305960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:14.418031Z","title":"Gora: Gradient-driven adaptive low rank adaptation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.418031Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:c3f860f6de2791076009bd001c852e94066151fd1826e323d5a700b96d385718","observation_id":"f84976e3-5880-4030-b5df-5eae5bd0db83","resolution":{"observed_at":"2026-08-05T17:33:14.418031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00751","last_updated":"2019-06-13T17:48:30Z","snapshot_observed_at":"2026-07-06T07:30:44.870185Z","submitted_at":"2019-02-02T16:29:47Z","title":"Parameter-Efficient Transfer Learning for NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00751","snapshot_observed_at":"2026-08-05T17:33:14.531714Z","title":"Parameter-efficient transfer learning for nlp, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.531714Z"},"links":{"cited_paper":"/paper/1902.00751","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:0c37c110ac52c02c3c2f46b5fa68c7e0ac23e9e20e59d482d5b857eb93de6000","observation_id":"1f39d57b-a4ec-4a68-9ccd-e4167c157e22","resolution":{"observed_at":"2026-08-05T17:33:14.531714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-05T17:33:14.677479Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.677479Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:c24ed6ffeb53c9b72eb9798b3e4bdafd208e26d5092e9d96f65ad1522fdded71","observation_id":"2782ce0b-c017-4c80-b781-fae6510f1aae","resolution":{"observed_at":"2026-08-05T17:33:14.677479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:19.333891Z","title":"Looking beyond the surface: A challenge set for reading comprehension over multiple sentences","venue":null,"work_id":"cce965ca-0665-4142-974a-80fd08966290","year":2018},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.771565Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:1cc4c62f33525ef05817add19448b80199b7d4fa0768faa8f21d9904f99d07d9","observation_id":"c7619741-a3ca-4874-b73b-471540d4e686","resolution":{"observed_at":"2026-08-05T17:33:19.440864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11454","last_updated":"2024-01-16T18:59:22Z","snapshot_observed_at":"2026-07-06T16:34:38.718198Z","submitted_at":"2023-10-17T17:59:46Z","title":"VeRA: Vector-based Random Matrix Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11454","snapshot_observed_at":"2026-08-05T17:33:14.836891Z","title":"Kopiczko, Tijmen Blankevoort, and Yuki M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.836891Z"},"links":{"cited_paper":"/paper/2310.11454","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:1828e9301e997f55354e359bab315c49d2abdd97293d7e9e2afd164f6e66b6de","observation_id":"a3e8dee5-fe8a-438e-9055-3f3d7d882b2e","resolution":{"observed_at":"2026-08-05T17:33:14.836891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15330","last_updated":"2025-02-13T13:06:00Z","snapshot_observed_at":"2026-08-06T02:17:17.117766Z","submitted_at":"2024-06-21T17:42:52Z","title":"Enhancing Large Language Model Performance with Gradient-Based Parameter Selection","version":2},"cited_work":{"arxiv_id":"2406.15330","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15330","snapshot_observed_at":"2026-08-05T17:33:18.022133Z","title":"Enhancing Large Language Model Performance with Gradient-Based Parameter Selection","venue":"cs.AI","work_id":"d855772c-aeb5-4e55-87c8-d765383e0c47","year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:14.924155Z"},"links":{"cited_paper":"/paper/2406.15330","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:2bb0bc933daece9d94ea9a739be868847c477c3772408b5a5f348fde92d15f63","observation_id":"0bd1e196-8672-4d1c-8baf-edddea6c96e5","resolution":{"observed_at":"2026-08-05T17:33:18.081272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-07-06T10:29:18.734092Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-05T17:33:15.028510Z","title":"Prefix-tuning: Optimizing continuous prompts for generation, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.028510Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:eb25d57010b567308817b26cdadae2e78c3166b2a5a69e196509553f4efb57c2","observation_id":"c5fb43a1-b53e-439a-9164-8b75a9a19101","resolution":{"observed_at":"2026-08-05T17:33:15.028510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-05T17:33:15.123076Z","title":"Awq: Activation-aware weight quantization for llm compression and acceleration, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.123076Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:7739427d7edb738a3c8b8d6603e3ad3e6ae12369be72808a8a535e0917c512ba","observation_id":"0732a16b-1893-48b9-b5d2-801deaf9f16a","resolution":{"observed_at":"2026-08-05T17:33:15.123076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16187","last_updated":"2024-04-15T13:25:05Z","snapshot_observed_at":"2026-08-08T05:35:09.830014Z","submitted_at":"2024-03-24T15:09:55Z","title":"ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16187","snapshot_observed_at":"2026-08-05T17:33:15.257502Z","title":"Alora: Allocating low-rank adaptation for fine-tuning large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.257502Z"},"links":{"cited_paper":"/paper/2403.16187","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:72c0023dbbe19b4ad0ef47648868b94068a2ffd017c4a854ff1f741bd463a715","observation_id":"a26cd787-9830-44fe-b122-55eefd1ccc8d","resolution":{"observed_at":"2026-08-05T17:33:15.257502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04647","last_updated":"2021-11-27T13:48:40Z","snapshot_observed_at":"2026-08-08T09:07:49.828598Z","submitted_at":"2021-06-08T19:17:04Z","title":"Compacter: Efficient Low-Rank Hypercomplex Adapter Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04647","snapshot_observed_at":"2026-08-05T17:33:15.367652Z","title":"Compacter: Efficient low-rank hypercomplex adapter layers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.367652Z"},"links":{"cited_paper":"/paper/2106.04647","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:8cdc19b115ff9816d9d6493dc037fe04dcbd4793af99ac4dabf09a371d3f29b1","observation_id":"7559f462-a32c-4ec9-94ac-aab7bc99d807","resolution":{"observed_at":"2026-08-05T17:33:15.367652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:19.163947Z","title":"Phi-2: The surprising power of small language models","venue":null,"work_id":"880bfbf7-eba8-47b5-bad5-7917d20497b0","year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.461503Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:edb2663c4a05f6ea4a757eaca6aad7b4812cadaf8a3f945155e7e91948b14598","observation_id":"7152f900-e565-4513-a333-ba2956dd8b4d","resolution":{"observed_at":"2026-08-05T17:33:19.238284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.07779","last_updated":"2020-10-06T10:16:39Z","snapshot_observed_at":"2026-07-06T09:38:29.271727Z","submitted_at":"2020-07-15T15:56:05Z","title":"AdapterHub: A Framework for Adapting Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.07779","snapshot_observed_at":"2026-08-05T17:33:15.503670Z","title":"Adapterhub: A framework for adapting transformers, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.503670Z"},"links":{"cited_paper":"/paper/2007.07779","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:c44cb802d6e9733511b0c504c3e61a69f99f8671a5b645c3b73b9680b22b5705","observation_id":"aef78e1b-9790-41ad-aaa5-df99563c07a0","resolution":{"observed_at":"2026-08-05T17:33:15.503670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00247","last_updated":"2021-01-26T12:54:33Z","snapshot_observed_at":"2026-07-06T09:16:48.444854Z","submitted_at":"2020-05-01T07:03:42Z","title":"AdapterFusion: Non-Destructive Task Composition for Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00247","snapshot_observed_at":"2026-08-05T17:33:15.587239Z","title":"Adapterfusion: Non-destructive task composition for transfer learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.587239Z"},"links":{"cited_paper":"/paper/2005.00247","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:37f2fddff44bc5d5c6efad508a461ca5aa0dd96accaab3311e72e82bfdcd2cb2","observation_id":"5dae3360-0e9e-437a-ba48-5806fcc023ec","resolution":{"observed_at":"2026-08-05T17:33:15.587239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.09121","last_updated":"2019-04-27T09:31:59Z","snapshot_observed_at":"2026-07-06T06:57:46.546190Z","submitted_at":"2018-08-28T05:16:35Z","title":"WiC: the Word-in-Context Dataset for Evaluating Context-Sensitive Meaning Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.09121","snapshot_observed_at":"2026-08-05T17:33:15.702574Z","title":"Wic: 10,000 example pairs for evaluating context-sensitive representations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.702574Z"},"links":{"cited_paper":"/paper/1808.09121","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:3f0de24ac763dfc8d1df2a1525647615a353ea182a1831f3c5b6d7b2dce12cf4","observation_id":"3936f051-f4df-45b4-9a43-772ae8e95a15","resolution":{"observed_at":"2026-08-05T17:33:15.702574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:15.833300Z","title":"Know what you don ' t know: Unanswerable questions for SQ u AD","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.833300Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:a3a7bea2babe01c6565d8dbd1c8e74b0eedd9550479d1ed990c99d835eb3a726","observation_id":"fca64d7e-309f-465c-9613-20d36c42d629","resolution":{"observed_at":"2026-08-05T17:33:15.833300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:19.041641Z","title":"Choice of plausible alternatives: An evaluation of commonsense causal reasoning","venue":null,"work_id":"c1284710-28b0-4b3b-a0de-7a9af8216842","year":2011},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.904883Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:caf51fe99d20ba0bdbe0402bf76b70a4bb19a977e5a82a46a0e310a0f97afabf","observation_id":"eddb13b5-baca-4bb0-8d00-31d9ced6898e","resolution":{"observed_at":"2026-08-05T17:33:19.106306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:18.887292Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":"c02ca109-10e1-478f-b5b1-63f39a541c26","year":2013},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:15.990313Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:de1d270f04f66f9fb1631cae813a15889484da39ac1dc002e135ed6af0d6d41f","observation_id":"cc04bbf7-e983-4857-bf1c-0fcb435fabe5","resolution":{"observed_at":"2026-08-05T17:33:18.972778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11875","last_updated":"2024-06-08T03:29:17Z","snapshot_observed_at":"2026-07-06T17:05:06.923713Z","submitted_at":"2023-12-19T06:06:30Z","title":"Sparse is Enough in Fine-tuning Pre-trained Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11875","snapshot_observed_at":"2026-08-05T17:33:16.066343Z","title":"Sparse is enough in fine-tuning pre-trained large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.066343Z"},"links":{"cited_paper":"/paper/2312.11875","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:062e9dde77d6aee8cfaf62a8584e2b5461572a586c54e7f9c8c177c819166611","observation_id":"9b6f2c04-0c80-4605-be26-8b12d05f768a","resolution":{"observed_at":"2026-08-05T17:33:16.066343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09839","last_updated":"2021-11-18T18:06:01Z","snapshot_observed_at":"2026-08-07T01:37:17.867619Z","submitted_at":"2021-11-18T18:06:01Z","title":"Training Neural Networks with Fixed Sparse Masks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09839","snapshot_observed_at":"2026-08-05T17:33:16.131863Z","title":"Training neural networks with fixed sparse masks, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.131863Z"},"links":{"cited_paper":"/paper/2111.09839","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:af920b7260b058e3fd021bcc3419ddb5ec17ba2851a6c0d3ebc5ef89c10b40d8","observation_id":"685150dd-9b59-4131-8ee2-ed93020e951f","resolution":{"observed_at":"2026-08-05T17:33:16.131863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T17:33:16.223836Z","title":"Llama: Open and efficient foundation language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.223836Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:3199025b15a6bf50d7194576568ceabbd8eaa60bae978fe289749aab83888947","observation_id":"1e07e83f-675d-4898-b249-103416c0ed7e","resolution":{"observed_at":"2026-08-05T17:33:16.223836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:18.760302Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":"29f8bb19-91b6-4231-b8c8-5cc22b891169","year":2018},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.373356Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:787cc7a2a9dcc35464ab0c688fd8f2695b872f82d1a70311f25f3c0befa10770","observation_id":"1aa5aebf-6db9-42aa-a25b-a2674c9a7f1a","resolution":{"observed_at":"2026-08-05T17:33:18.818692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00537","last_updated":"2020-02-13T00:28:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-05-02T00:41:50Z","title":"SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00537","snapshot_observed_at":"2026-08-05T17:33:16.462429Z","title":"Superglue: A stickier benchmark for general-purpose language understanding systems","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.462429Z"},"links":{"cited_paper":"/paper/1905.00537","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:66b818b61c1b55fd2728a18187684c946b9916dc421fe967db55dc037b35d5cc","observation_id":"77590faa-bb67-4bab-84b7-a5374d3df39a","resolution":{"observed_at":"2026-08-05T17:33:16.462429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02596","last_updated":"2024-05-04T07:44:18Z","snapshot_observed_at":"2026-08-06T04:49:40.074002Z","submitted_at":"2024-05-04T07:44:18Z","title":"Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02596","snapshot_observed_at":"2026-08-05T17:33:16.547782Z","title":"Random masking finds winning tickets for parameter efficient fine-tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.547782Z"},"links":{"cited_paper":"/paper/2405.02596","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:4de026c4675c64ff8ef4d424192589735e611e426357bc1bfcd572cf62cd5069","observation_id":"bcb6d216-929c-4819-a916-c6c6a1d2d1ed","resolution":{"observed_at":"2026-08-05T17:33:16.547782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05687","last_updated":"2021-09-13T03:39:52Z","snapshot_observed_at":"2026-08-05T01:06:28.807438Z","submitted_at":"2021-09-13T03:39:52Z","title":"Raise a Child in Large Language Model: Towards Effective and Generalizable Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05687","snapshot_observed_at":"2026-08-05T17:33:16.622932Z","title":"Raise a child in large language model: Towards effective and generalizable fine-tuning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.622932Z"},"links":{"cited_paper":"/paper/2109.05687","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:b86f16c64841800761d218ebe3db0a43326916d1f8ab5737ff393c56a3bbd1e8","observation_id":"98375c99-8f46-4302-bc8e-676094bc1b9f","resolution":{"observed_at":"2026-08-05T17:33:16.622932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12579","last_updated":"2025-05-18T23:45:50Z","snapshot_observed_at":"2026-08-07T15:43:35.414765Z","submitted_at":"2025-05-18T23:45:50Z","title":"Adaptive parameter-efficient fine-tuning via Hessian-informed subset selection","version":1},"cited_work":{"arxiv_id":"2505.12579","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12579","snapshot_observed_at":"2026-08-05T17:33:17.721401Z","title":"Adaptive parameter-efficient fine-tuning via Hessian-informed subset selection","venue":"cs.LG","work_id":"efda116c-2a00-46a9-87cb-013f9888d0a7","year":2025},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.699502Z"},"links":{"cited_paper":"/paper/2505.12579","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:d2a3f6e75e7d1dabef7cf4fdf6b4d6f73ba0f27a8c6ff13a7e155b6a0904b46b","observation_id":"84caad95-cdb8-415f-8e38-f0b3af41e05c","resolution":{"observed_at":"2026-08-05T17:33:17.784963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:33:16.793882Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.793882Z"},"links":{"citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:55e813489b57e956c46d6fc936280f24b308fb12da5cf221e65ef8bf84b09b49","observation_id":"f33e3494-a4ee-4963-a2ba-a15af7b04205","resolution":{"observed_at":"2026-08-05T17:33:16.793882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-08-08T14:14:26.000056Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-08-05T17:33:16.928324Z","title":"Lora-fa: Memory-efficient low-rank adaptation for large language models fine-tuning, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:16.928324Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:17c394633a5cba744bb5858be5e57800882725e890beefd912f8fcff133dc0dc","observation_id":"73a82e9a-bf96-4f26-b2c0-8f502bab158e","resolution":{"observed_at":"2026-08-05T17:33:16.928324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-05T17:33:17.053712Z","title":"Adalora: Adaptive budget allocation for parameter-efficient fine-tuning, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:17.053712Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:669761262975f3eda829eaa37cdf2e2ff55bee3f2d268d5546d9fef4e518417b","observation_id":"21b668b0-6030-4e0b-b14c-409376b230ca","resolution":{"observed_at":"2026-08-05T17:33:17.053712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-05T17:33:17.084635Z","title":"Opt: Open pre-trained transformer language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:17.084635Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:15878c217d7f46e7d0859d81195c0d574f4b0d5ac8aab506a8ffc84504c5ed2a","observation_id":"cda02456-f76a-4a96-a948-ecfb0cf2c591","resolution":{"observed_at":"2026-08-05T17:33:17.084635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10136","last_updated":"2024-06-11T22:45:49Z","snapshot_observed_at":"2026-07-06T17:03:06.967126Z","submitted_at":"2023-12-15T18:59:05Z","title":"Gradient-based Parameter Selection for Efficient Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2312.10136","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.10136","snapshot_observed_at":"2026-08-05T17:33:17.383486Z","title":"Gradient-based Parameter Selection for Efficient Fine-Tuning","venue":"cs.CV","work_id":"aa7d0768-cde6-4745-acf7-ee83f42d6e54","year":2023},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:17.178516Z"},"links":{"cited_paper":"/paper/2312.10136","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:5ad5fe45fc6df2f381a7e92c2f3b9851a76687558d1714bc5194ac28fee5d85d","observation_id":"377bd2eb-7d7c-4b5e-b12c-445cb009b6ce","resolution":{"observed_at":"2026-08-05T17:33:17.487998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12406","last_updated":"2020-10-11T11:52:08Z","snapshot_observed_at":"2026-07-06T09:15:18.473097Z","submitted_at":"2020-04-26T15:03:47Z","title":"Masking as an Efficient Alternative to Finetuning for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12406","snapshot_observed_at":"2026-08-05T17:33:17.278546Z","title":"Masking as an efficient alternative to finetuning for pretrained language models, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T17:33:17.278546Z"},"links":{"cited_paper":"/paper/2004.12406","citing_paper":"/paper/2508.16191"},"observation_digest":"sha256:e6a4b26dfb77304892309311359772d596ac9cb4fffea1542fefcddb8ae36593","observation_id":"1d975d77-176e-4ae7-91d5-b8c5e078fcff","resolution":{"observed_at":"2026-08-05T17:33:17.278546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.16191","last_updated":"2025-08-22T08:12:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T23:09:48.831652Z","submitted_at":"2025-08-22T08:12:06Z","title":"GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream Adaptation"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":5,"verified_fuzzy":8},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2508.16191."}