{"as_of":"2026-08-05T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:044fdaea3918d78779fdeeab897886cd547dd3f8a3abc0254103ecccba9f4b7d","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T04:08:39.594367Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09287/citation-record","integrity":"/paper/2607.09287/integrity","json":"/paper/2607.09287/citation-record.json","paper":"/paper/2607.09287"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.16405","last_updated":"2024-02-02T14:53:14Z","snapshot_observed_at":"2026-07-31T08:14:11.199709Z","submitted_at":"2024-01-29T18:43:49Z","title":"Scaling Sparse Fine-Tuning to Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16405","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Scaling sparse fine-tuning to large language models.arXiv preprint arXiv:2401.16405,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2401.16405","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:f750f38439c177f771db449e78841ad02ef8bc9c1f6fa6a0cce2cda13a119fee","observation_id":"ad14e144-d21f-4ae8-aec8-dae0ee02fcdb","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Gallop: Gradient-based sparse learning on low-magnitude parameters.arXiv preprint arXiv:2510.19778,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:78dfb4d03169347980d66ecfe00dd3ee2dbbd81153c3e72d26f498cab404265f","observation_id":"69a59fa8-6578-4f99-b66e-8686dee62963","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.19778","doi":"10.48550/arxiv.2510.19778","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Karl Cobbe, Vineet Kosaraju, Mohammad Bavarian, Mark Chen, Heewoo Jun, Lukasz Kaiser, Matthias Plappert, Jerry Tworek, Jacob Hilton, Reiichiro Nakano, et al","venue":"ArXiv.org","work_id":"93b9bfca-9f8e-45a2-a172-31f4eb1b82d0","year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:7de576795c578ea48ff94ca4a3b59533bbd4e1b392026646d7f1c32d887c0e26","observation_id":"46949af6-813f-4d59-8110-6f2e97c88119","resolution":{"observed_at":"2026-07-13T04:09:18.631438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T07:19:53.258795+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T07:19:53.258795+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02214","last_updated":"2024-11-02T06:00:03Z","snapshot_observed_at":"2026-08-04T13:15:41.775650Z","submitted_at":"2024-06-04T11:14:21Z","title":"SLTrain: a sparse plus low-rank approach for parameter and memory efficient pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02214","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Sltrain: a sparse plus low-rank approach for parameter and memory efficient pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2406.02214","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:42629cdeeb05a728ca6c6ff6a2cf2b9977709338bd439cdb80d7b9ae5ac3fb05","observation_id":"2d914d76-aefd-4b87-b037-c398446fd5b0","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Learning to solve arithmetic word problems with verb categorization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:f23e2e70542523ca3a22835106d0ce2c79c51156b85674a5539fdbc1d41c26b6","observation_id":"167fcd97-5dd6-474d-a9e6-6e23631947ef","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:2a0dd093cff66fa926fac33ff1ba3eb338e40eaa820617caa7a046b10e8578b3","observation_id":"1a7d9844-56aa-4933-97e6-dbf20e0fab69","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11439","last_updated":"2025-07-24T18:14:45Z","snapshot_observed_at":"2026-07-06T20:37:33.041473Z","submitted_at":"2025-02-17T04:54:42Z","title":"An Efficient Sparse Fine-Tuning with Low Quantization Error via Neural Network Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11439","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"An efficient sparse fine-tuning with low quantization error via neural network pruning.arXiv preprint arXiv:2502.11439,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2502.11439","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:bdc7957d3d23c200c97a68d6ead945686c18134516776f14c064b4732379a1ea","observation_id":"8a68ca6f-f98b-40c9-a624-23ba4ade3f9c","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Program induction by rationale genera- tion: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:0047f82e544669f2982eec923cc05c143baae42ff777549eb7b867d5ebc87084","observation_id":"0d3738e6-5bf6-4afd-96bd-8c0036ed2584","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Dora: Weight-decomposed low-rank adaptation.arXiv preprint arXiv:2402.09353,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:a8d551eadf17778e0d4bd66da81f55396eff49249445f8f954a914f03104fd0f","observation_id":"78d3410a-7aee-47f2-9a1c-686e36e9731f","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01392","last_updated":"2024-06-06T16:38:34Z","snapshot_observed_at":"2026-07-06T18:24:30.706727Z","submitted_at":"2024-06-03T14:56:09Z","title":"Sparsity-Accelerated Training for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01392","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"org/2025.acl-long.1541/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2406.01392","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:2146d7166f18c7da39514acfef85afee11f6929ef8342d9be28a551bee60a91d","observation_id":"093be92d-4679-48e1-93a1-1f90377c6918","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04679","last_updated":"2024-06-03T06:59:31Z","snapshot_observed_at":"2026-08-03T01:46:05.289935Z","submitted_at":"2024-01-09T17:09:01Z","title":"RoSA: Accurate Parameter-Efficient Fine-Tuning via Robust Adaptation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04679","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Rosa: Accurate parameter-efficient fine-tuning via robust adaptation.arXiv preprint arXiv:2401.04679,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2401.04679","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:d296e7ded34ba1ae1b8968b533c71e5e546791cf605053b758baa735e84f0add","observation_id":"37b5cca5-772e-4a5f-8584-f87d1fe4ee1d","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07191","last_updated":"2021-04-15T06:11:12Z","snapshot_observed_at":"2026-07-06T10:49:19.314215Z","submitted_at":"2021-03-12T10:23:47Z","title":"Are NLP Models really able to Solve Simple Math Word Problems?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.07191","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Are nlp models really able to solve simple math word problems?arXiv preprint arXiv:2103.07191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2103.07191","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:248a63434e59c20b8a46c9dbc65522f1bdefa20947e13ef295487f398e6b50fb","observation_id":"0f88c719-42cd-43ac-9e97-214c7f146209","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.01413","last_updated":"2016-08-20T11:50:41Z","snapshot_observed_at":"2026-07-06T05:05:58.291779Z","submitted_at":"2016-08-04T01:47:23Z","title":"Solving General Arithmetic Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.01413","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Solving general arithmetic word problems.arXiv preprint arXiv:1608.01413,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/1608.01413","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:8e18dd4c8d63f2d0cda9442e003dafd9ab67142e0a54aa5b48826c50d00e9a58","observation_id":"22d1c5b2-6e5e-46ad-ab30-960877bc9376","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11875","last_updated":"2024-06-08T03:29:17Z","snapshot_observed_at":"2026-07-06T17:05:06.923713Z","submitted_at":"2023-12-19T06:06:30Z","title":"Sparse is Enough in Fine-tuning Pre-trained Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11875","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Sparse is enough in fine-tuning pre-trained large language models.arXiv preprint arXiv:2312.11875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2312.11875","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:114e77b21f300fac36efcf2b5bf90649bedbb4e56fa476510988e081e82c8e12","observation_id":"0d5e775e-ab87-4672-966f-96573f51e73d","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"A simple and effective pruning approach for large language models.arXiv preprint arXiv:2306.11695,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:5d1fb36e32a7ebfddf87589266779280b1133ed6b78854e9afd3de60074d44fe","observation_id":"b0f0f5b0-db12-4ef0-8497-96a412f042e7","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11621","last_updated":"2024-03-18T09:55:01Z","snapshot_observed_at":"2026-08-01T23:39:04.005780Z","submitted_at":"2024-03-18T09:55:01Z","title":"Let's Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11621","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Let’s focus on neuron: Neuron-level supervised fine-tuning for large language model.arXiv preprint arXiv:2403.11621,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2403.11621","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:45568847a8b8df6ce7bb4638067aecc8a8bd71fcbbb08340f14fa142a8e1f330","observation_id":"b1e6a095-d3e6-4f8a-9e17-8f0c36160bd9","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06289","last_updated":"2024-12-19T18:47:54Z","snapshot_observed_at":"2026-07-06T20:03:42.903210Z","submitted_at":"2024-12-09T08:24:11Z","title":"S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06289","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"S2ft: Efficient, scalable and generalizable llm fine-tuning by structured sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2412.06289","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:63c6decf1a35108287ae2ed22ae7c8d2d98213a9c9adebf65d5aac38768f1ece","observation_id":"c9f00262-f308-48fc-8c1f-ed6329db4db5","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Adaptive budget allocation for parameter-efficient fine-tuning.arXiv preprint arXiv:2303.10512,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:d43ff6ecdc78662d314f5d35f9b9cfb57c5b82fb34e4b6ddbfeb0870c45af05c","observation_id":"19775c8f-c5b9-4790-933b-8f75b9c364af","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15300","last_updated":"2024-08-27T14:41:14Z","snapshot_observed_at":"2026-07-06T19:06:45.969497Z","submitted_at":"2024-08-27T14:41:14Z","title":"GIFT-SW: Gaussian noise Injected Fine-Tuning of Salient Weights for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15300","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Gift-sw: Gaussian noise injected fine-tuning of salient weights for llms.arXiv preprint arXiv:2408.15300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2408.15300","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:77d21ea7e6ee2095cf917fd257a5c4d721093a187ff31572f80ce6f6cc0bf823","observation_id":"db059159-49d4-450f-af3d-46e5f1e1d03b","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"All trainable masks use C4 calibration and approximately 5.6M trainable sparse parameters","venue":null,"work_id":null,"year":2050},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:5e38b3351e0125fcd910bb6dc80f58a8cb1affd099d42901c9e0c25cf6c2e64f","observation_id":"71761943-a945-4ba0-a4e6-808937660f68","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Full fine-tuning is an unbudgeted reference row separated by rules","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:9575489521774fb438b3def9a4c3d77de6e6d4515c61fcf94648a21ab1c36fad","observation_id":"8cb73a3b-0f5a-4e4e-b7b5-5bf03e12f41e","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Each row uses the learning rate selected by the held-out validation split of the fine-tuning set","venue":null,"work_id":null,"year":2072},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:2b9c9da3396c8338ef7a7987caed9ef38f469184842c1c7e9d57bfb07bb9c6f1","observation_id":"dba6f14f-42f3-4146-ba0b-d7b4de02e82b","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Lower is better","venue":null,"work_id":null,"year":2079},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:18f6d6bd9f5df89ebb5cdae413f63d45e4bba078c4da85c079c48becde9145e8","observation_id":"69f67018-2435-45f1-b8d0-149452e377ad","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-15T23:18:09.646772Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.09287."}