{"as_of":"2026-08-12T12:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e55df23c544b5e2f9580c9e59fd2ecc9944c40235d66951d9f494ecceb1f6189","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:37:39.109971Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12951/citation-record","integrity":"/paper/2412.12951/integrity","json":"/paper/2412.12951/citation-record.json","paper":"/paper/2412.12951"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.17604","last_updated":"2025-08-19T19:14:56Z","snapshot_observed_at":"2026-08-10T19:05:37.907509Z","submitted_at":"2024-05-27T19:07:13Z","title":"LoRA-XS: Low-Rank Adaptation with Extremely Small Number of Parameters","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17604","snapshot_observed_at":"2026-08-11T13:37:38.959932Z","title":"Lora-xs: Low-rank adaptation with extremely small number of parameters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.959932Z"},"links":{"cited_paper":"/paper/2405.17604","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:69e6c846e1072e794d74115210fe5cb06216303f10b2ad04ea194d200262000b","observation_id":"bb345255-2aad-4735-83ba-1ce1393706c9","resolution":{"observed_at":"2026-08-11T13:37:38.959932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07967","last_updated":"2023-10-16T15:52:20Z","snapshot_observed_at":"2026-08-09T19:05:22.405576Z","submitted_at":"2023-06-13T17:59:32Z","title":"One-for-All: Generalized LoRA for Parameter-Efficient Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07967","snapshot_observed_at":"2026-08-11T13:37:38.975262Z","title":"One-for-all: Gen- eralized lora for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.975262Z"},"links":{"cited_paper":"/paper/2306.07967","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:6683e6a69505418a8e077e42650cb08704f5e215afe36f1d528697335eab25af","observation_id":"d611bb79-8524-4824-a725-3b8f8a684f6b","resolution":{"observed_at":"2026-08-11T13:37:38.975262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04284","last_updated":"2022-11-10T12:48:10Z","snapshot_observed_at":"2026-08-12T10:04:00.519143Z","submitted_at":"2022-10-09T15:28:48Z","title":"SparseAdapter: An Easy Approach for Improving the Parameter-Efficiency of Adapters","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04284","snapshot_observed_at":"2026-08-11T13:37:38.989122Z","title":"Sparseadapter: An easy approach for improving the parameter-efficiency of adapters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.989122Z"},"links":{"cited_paper":"/paper/2210.04284","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:8621cf6d0faf216ce3bf99c5ee95081745cbfa9bb900903e8411000894dc1e2c","observation_id":"fae90cd4-f1a1-4ce9-a1b3-424393506691","resolution":{"observed_at":"2026-08-11T13:37:38.989122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-11T13:37:39.025487Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.025487Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:05cc4fea0aa5a42b704c72ebd7ba0c6c9ee99064b562e839f6abe4d2940e1855","observation_id":"70ba8ea8-e90b-49c6-a122-d4831967591a","resolution":{"observed_at":"2026-08-11T13:37:39.025487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11005","last_updated":"2022-05-23T02:43:45Z","snapshot_observed_at":"2026-08-10T18:58:53.374221Z","submitted_at":"2022-05-23T02:43:45Z","title":"Parameter-Efficient Sparsity for Large Language Models Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11005","snapshot_observed_at":"2026-08-11T13:37:39.038878Z","title":"Parameter-efficient sparsity for large language models fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.038878Z"},"links":{"cited_paper":"/paper/2205.11005","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:f4c2945c816831f9b4f33d61623807d72fa5484f34f16f19797f19a0afceaf04","observation_id":"43228dba-83be-4515-b305-06cf25f23d0a","resolution":{"observed_at":"2026-08-11T13:37:39.038878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10280","last_updated":"2024-08-27T15:34:49Z","snapshot_observed_at":"2026-08-10T02:34:15.194906Z","submitted_at":"2024-08-18T12:18:56Z","title":"NoRA: Nested Low-Rank Adaptation for Efficient Fine-Tuning Large Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10280","snapshot_observed_at":"2026-08-11T13:37:39.044748Z","title":"Nora: Nested low-rank adaptation for efficient fine-tuning large models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.044748Z"},"links":{"cited_paper":"/paper/2408.10280","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:484764427275dd10e5ab0310017b1d570ba7d38e0e486129b37b9e3e14cebdd5","observation_id":"9534321c-2b14-4854-b86e-977c9c0ecf84","resolution":{"observed_at":"2026-08-11T13:37:39.044748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T13:37:39.051681Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.051681Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:02ae377d4817d99a279d7a202a4b8460edbc319198b347e14a0fbcec56beb13d","observation_id":"22da5c8f-a4da-46f6-a705-eeeca38ae19b","resolution":{"observed_at":"2026-08-11T13:37:39.051681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T13:37:39.058919Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.058919Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:1a7206e1cc1800c2f9f007e889085cb05e2d324df79d8b6e9b34f3fc98e8f081","observation_id":"7900e55e-a855-4440-96ea-a5c8f17129ff","resolution":{"observed_at":"2026-08-11T13:37:39.058919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00247","last_updated":"2021-01-26T12:54:33Z","snapshot_observed_at":"2026-08-11T03:47:32.551562Z","submitted_at":"2020-05-01T07:03:42Z","title":"AdapterFusion: Non-Destructive Task Composition for Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00247","snapshot_observed_at":"2026-08-11T13:37:39.065819Z","title":"Adapterfusion: Non-destructive task composition for transfer learning","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.065819Z"},"links":{"cited_paper":"/paper/2005.00247","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:1f1a54a0314ad2bb7a8bf1e1cb1e9dd4a6f313cfa0031e1e7f1b1834ca89a59b","observation_id":"5969d639-2c32-4121-a031-fc2e550a8b9f","resolution":{"observed_at":"2026-08-11T13:37:39.065819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09920","last_updated":"2024-09-24T09:48:36Z","snapshot_observed_at":"2026-08-11T16:53:58.710480Z","submitted_at":"2024-06-14T11:02:21Z","title":"Knowledge Editing in Language Models via Adapted Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09920","snapshot_observed_at":"2026-08-11T13:37:39.085414Z","title":"Knowledge editing in lan- guage models via adapted direct preference optimization.arXiv preprint arXiv:2406.09920,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.085414Z"},"links":{"cited_paper":"/paper/2406.09920","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:db082ad8b4824143de2a1e55576a690c8b5572f363b99cf6e5539e51a9467bc1","observation_id":"60fb603f-49ca-4d9e-a071-01d9c8b8f477","resolution":{"observed_at":"2026-08-11T13:37:39.085414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14717","last_updated":"2023-10-09T07:39:04Z","snapshot_observed_at":"2026-08-03T21:40:53.000035Z","submitted_at":"2023-09-26T07:22:23Z","title":"QA-LoRA: Quantization-Aware Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14717","snapshot_observed_at":"2026-08-11T13:37:39.098228Z","title":"Qa-lora: Quantization-aware low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.098228Z"},"links":{"cited_paper":"/paper/2309.14717","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:e61b859acf6b5599eb212088ed206ed8f83c95e1dc12055ff94a44873aedbe8f","observation_id":"edd36266-ceea-4be3-a9e3-f06f940be680","resolution":{"observed_at":"2026-08-11T13:37:39.098228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-08-08T14:14:26.000056Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-08-11T13:37:39.104166Z","title":"Lora-fa: Memory- efficient low-rank adaptation for large language models fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.104166Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:a0880256c1c3a01a1eb3b3a828227ec7168ac2be722b0e35774f5dce5815047b","observation_id":"4cdab6a2-10f5-4154-b204-6b905bddb292","resolution":{"observed_at":"2026-08-11T13:37:39.104166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12200","last_updated":"2024-06-04T06:39:23Z","snapshot_observed_at":"2026-08-11T07:43:15.820875Z","submitted_at":"2024-01-22T18:39:40Z","title":"APT: Adaptive Pruning and Tuning Pretrained Language Models for Efficient Training and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12200","snapshot_observed_at":"2026-08-11T13:37:39.109971Z","title":"Apt: Adaptive pruning and tun- ing pretrained language models for efficient training and inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.109971Z"},"links":{"cited_paper":"/paper/2401.12200","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:570fb7388581bb4ef8860719fd5d7e3bc5926513ad317ef5195f720fcad10fd1","observation_id":"cbffbc6e-f309-4b74-9466-41507d492341","resolution":{"observed_at":"2026-08-11T13:37:39.109971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00408","last_updated":"2022-05-02T19:21:13Z","snapshot_observed_at":"2026-08-02T16:36:17.936691Z","submitted_at":"2022-04-01T13:09:56Z","title":"Structured Pruning Learns Compact and Accurate Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00408","snapshot_observed_at":"2026-08-11T13:37:39.091398Z","title":"Structured pruning learns compact and accurate models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.091398Z"},"links":{"cited_paper":"/paper/2204.00408","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:018f9a5091a91e778e1f3761a9e0325d4a2b325617106c7c88d52976ce001d2a","observation_id":"96c5b90a-b226-431f-b89f-30b89c2db25e","resolution":{"observed_at":"2026-08-11T13:37:39.091398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11454","last_updated":"2024-01-16T18:59:22Z","snapshot_observed_at":"2026-08-10T23:48:46.481607Z","submitted_at":"2023-10-17T17:59:46Z","title":"VeRA: Vector-based Random Matrix Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11454","snapshot_observed_at":"2026-08-11T13:37:39.015019Z","title":"Vera: Vector-based random matrix adaptation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.015019Z"},"links":{"cited_paper":"/paper/2310.11454","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:d6355c1966740a3c16a472cbf2ca165edb780cdadd00480b51bda531c293944f","observation_id":"c54b1ee3-738c-4924-8ee5-168f49988073","resolution":{"observed_at":"2026-08-11T13:37:39.015019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T13:37:39.008120Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.008120Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:4dec39bdc7cc82bfb8b48f3c92debd5b4b43942806fd7a65417e527a4ee0a1fa","observation_id":"e566352a-b8d7-4344-a89e-df74ff9a09fd","resolution":{"observed_at":"2026-08-11T13:37:39.008120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:37:39.073074Z","title":"Adarankgrad: Adaptive gradient-rank and moments for memory-efficient llms training and fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.073074Z"},"links":{"citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:75d04bfbcabd65e4ec7f341c0c26082cb68a5b193e8cc46b3e2373aebdd165c2","observation_id":"b6ea905d-3e74-4795-b540-3fd15a901fe5","resolution":{"observed_at":"2026-08-11T13:37:39.073074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-07-06T10:29:18.734092Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-11T13:37:39.032181Z","title":"Prefix-tuning: Optimizing continuous prompts for genera- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.032181Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:dbce2f702aa8a31e393d18141dd9a9c880e102e3add0f3af13ead6a6a541132f","observation_id":"80f7dbd3-0b05-4750-ac40-522008e61992","resolution":{"observed_at":"2026-08-11T13:37:39.032181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T13:37:38.999966Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.999966Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:5d8bf25377d02b579b12b432a05bc11527e2d51bdb69ed5aa40e03c66e115c96","observation_id":"1c609644-d4c2-46a8-bfaf-0397e417528d","resolution":{"observed_at":"2026-08-11T13:37:38.999966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03432","last_updated":"2024-03-06T03:33:48Z","snapshot_observed_at":"2026-08-10T13:11:57.531083Z","submitted_at":"2024-03-06T03:33:48Z","title":"Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03432","snapshot_observed_at":"2026-08-11T13:37:38.982037Z","title":"Mixture-of-loras: An efficient multitask tuning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.982037Z"},"links":{"cited_paper":"/paper/2403.03432","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:64a1f05c5b556c9bb5e551f7d2eebed1fde68fd8b8231454febc82a7f8f4959f","observation_id":"f4a3c265-805d-4a26-ad1d-978f1e2a96e0","resolution":{"observed_at":"2026-08-11T13:37:38.982037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06385","last_updated":"2024-09-03T16:36:06Z","snapshot_observed_at":"2026-08-10T12:23:45.913056Z","submitted_at":"2024-06-10T15:44:22Z","title":"Low-Rank Quantization-Aware Training for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06385","snapshot_observed_at":"2026-08-11T13:37:38.968326Z","title":"Low-rank quantization-aware training for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.968326Z"},"links":{"cited_paper":"/paper/2406.06385","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:c00bf27a223cf4cdd30548cb4726cf81e192604af5867b4cdb0560f30ea3e7de","observation_id":"d150909c-3950-405c-8c12-b12358e4a58a","resolution":{"observed_at":"2026-08-11T13:37:38.968326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T10:04:25.151096Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2412.12951."}