{"as_of":"2026-08-12T03:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:194fe140e7364f90bec7fb89b25d54360c4905543eb8d9bb6db409d4e9519875","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:08:44.933146Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13488/citation-record","integrity":"/paper/2412.13488/integrity","json":"/paper/2412.13488/citation-record.json","paper":"/paper/2412.13488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:43.886538Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.886538Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:2a4bea56a713187795c441d451ce94e7eaf491dcfeb0e0289a866391e3b630a0","observation_id":"2159657d-2a9b-4b7a-ad0d-a983948562c1","resolution":{"observed_at":"2026-08-11T13:08:43.886538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:43.938551Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.938551Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:80f1602c76e31e54d6f789666565c698027f5358ad38d4793298db1b6b8388cb","observation_id":"e1d587fa-b9d0-4244-bc37-87c0c2b8cddb","resolution":{"observed_at":"2026-08-11T13:08:43.938551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.802696Z","title":"https://www.amd.com/en/products/accelerators/instinct/mi300.html","venue":null,"work_id":"2dc772db-9cfa-45b8-824b-5f2c51052c46","year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.947420Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:20116d209be4e8d8ae6989cf09130f8e5945eeaee6926575275b445bf78fb97b","observation_id":"3ba99d20-13bd-42d3-8870-bbedc79a649f","resolution":{"observed_at":"2026-08-11T13:08:46.811594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07560","last_updated":"2023-02-09T10:54:10Z","snapshot_observed_at":"2026-08-12T02:34:00.006984Z","submitted_at":"2021-10-14T17:27:29Z","title":"Composable Sparse Fine-Tuning for Cross-Lingual Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07560","snapshot_observed_at":"2026-08-11T13:08:43.955299Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.955299Z"},"links":{"cited_paper":"/paper/2110.07560","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:2f3f163efd7bf2028abd92c2f0a465c0e0ed60502fc996c58ceec50d1c7cb2cd","observation_id":"e9416622-6e64-4203-b7fa-15319359874e","resolution":{"observed_at":"2026-08-11T13:08:43.955299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-11T13:08:43.963206Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.963206Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:6851900d18b6b801d78888c6a326ac3b82cbcee19f75929640956c7eb9a75cb1","observation_id":"c3bb3309-b44d-42d7-bbcf-5355f24807fc","resolution":{"observed_at":"2026-08-11T13:08:43.963206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-11T05:54:56.124984Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-11T13:08:43.970986Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.970986Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:b4c12f9244ef75eec10c46b0415c3572673e8156d9fc0b8168708ada3c518007","observation_id":"7d0aaeac-8a9c-4001-a27c-7a38def01a55","resolution":{"observed_at":"2026-08-11T13:08:43.970986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:43.977961Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.977961Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:ec23503b13fe281c6171e40f37003b067e75c860eaaeaa208e5eb49eba03948f","observation_id":"4e648c15-2cb4-45b1-b151-e25cc280dd6e","resolution":{"observed_at":"2026-08-11T13:08:43.977961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T13:08:43.986062Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.986062Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:b9194def2b29fd32aef7e779c5bd9d45efeeeabaf28cdcc65d2bb5b02e98dd29","observation_id":"69ecb653-ba1f-4dc4-9f2e-8cbfcad26b45","resolution":{"observed_at":"2026-08-11T13:08:43.986062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.739633Z","title":null,"venue":null,"work_id":"98912ca3-5b4b-4628-a568-26aaa95f2b6a","year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.995613Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:c73ab1afd3bb5ef2aaf499f39bc36013719727ef2f112f87eaa9bf64eb043b4a","observation_id":"b25bd934-da3b-4f19-b27a-40ab274809f5","resolution":{"observed_at":"2026-08-11T13:08:46.757253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.678788Z","title":null,"venue":null,"work_id":"942231fe-aab5-4df3-a065-d16d0a4d89ea","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.007349Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:d603c03914ceff7836cd3c8a843ac2e5bc9d5c56be7f19078e2a2e2b57a92500","observation_id":"0edb2456-eba7-49ec-8ecd-2d64f90deb80","resolution":{"observed_at":"2026-08-11T13:08:46.721649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T13:08:44.036019Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.036019Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:a0f5f5c0d76f316323445db91a50d9d756ec43b68a8752fdc6c46f8b35d67030","observation_id":"fd6edc2e-fe9e-428c-9cf2-6665d341eda2","resolution":{"observed_at":"2026-08-11T13:08:44.036019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03748","last_updated":"2023-11-07T06:19:37Z","snapshot_observed_at":"2026-08-08T22:59:37.561433Z","submitted_at":"2023-11-07T06:19:37Z","title":"Unified Low-Resource Sequence Labeling by Sample-Aware Dynamic Sparse Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03748","snapshot_observed_at":"2026-08-11T13:08:44.071767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.071767Z"},"links":{"cited_paper":"/paper/2311.03748","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:cd95ef0ec0c00ec0e62048b08f6653fa4438361d6da148c315f056c62e0bc0e0","observation_id":"420d26a3-864e-42e0-a457-790519ffc06c","resolution":{"observed_at":"2026-08-11T13:08:44.071767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.644723Z","title":null,"venue":null,"work_id":"aaee56ed-9111-4e33-b66f-0954aebe2856","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.108077Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:cab5da0339635b44a6e7b136bcc785f005900360918940b2cf2933b2653a3a9b","observation_id":"f3a1b39a-7270-4d9a-9038-b09a97b483ee","resolution":{"observed_at":"2026-08-11T13:08:46.653130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T13:08:44.158346Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.158346Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:429023ac073881bbcabfe59b1faf6e00ea8c43d51df537de18ca7f68ff785209","observation_id":"c04fa806-6e6e-444e-b0c0-6fb759f623ee","resolution":{"observed_at":"2026-08-11T13:08:44.158346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.166495Z","title":"Dolan and Chris Brockett","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.166495Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:dc1254ef1383c84cbd83196a3fa7073d622261d870bb4ae94bbcd1334adb39e4","observation_id":"1fd2b719-6ec1-43c6-b7c2-90e51135841d","resolution":{"observed_at":"2026-08-11T13:08:44.166495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.580224Z","title":null,"venue":null,"work_id":"c37acaad-f469-4e3c-877b-2419b90017f4","year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.175881Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:38c324cc9836feef6d36bac4554a0c6cbbfa3d1405973ee3b984c19531b0b711","observation_id":"ae27d535-a7c8-409d-86d4-02e9b32d273e","resolution":{"observed_at":"2026-08-11T13:08:46.609238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T13:08:44.184507Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.184507Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:c3625b08a4534d111fb5a60a205cd669c1099c96fed658e70bef5c7b63654d51","observation_id":"40dbb497-8295-4922-bf2a-ea6f0e4f3507","resolution":{"observed_at":"2026-08-11T13:08:44.184507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07463","last_updated":"2021-06-09T14:39:17Z","snapshot_observed_at":"2026-08-10T10:06:48.397353Z","submitted_at":"2020-12-14T12:34:01Z","title":"Parameter-Efficient Transfer Learning with Diff Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07463","snapshot_observed_at":"2026-08-11T13:08:44.192819Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.192819Z"},"links":{"cited_paper":"/paper/2012.07463","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:7b52ade14d14d598bc7bcd076902e8e9912ca58d589977846bc88bbe8f35684c","observation_id":"a786ad46-16c8-4aab-b800-be76e2c6ae7e","resolution":{"observed_at":"2026-08-11T13:08:44.192819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-11T13:08:44.201236Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.201236Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:cdcbb30caa10ac493183c0555612fc88adb575d0fa55a72af9ffe188317ee91d","observation_id":"a2b26195-4d31-46fb-aeb0-6b151242b7e6","resolution":{"observed_at":"2026-08-11T13:08:44.201236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T13:08:44.270763Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.270763Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:47dbbe68d2d8b4212e37423de451edab3513629d33a6e613003630bb4a887dbe","observation_id":"d967add3-3c2a-4459-842e-f3a01dbe422e","resolution":{"observed_at":"2026-08-11T13:08:44.270763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T13:08:44.363545Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.363545Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:13d41e21d834c12aaffba69b4bed37c5a99b1266b31864d6d771fc5f0a91bb4b","observation_id":"b518c8b9-bde3-4890-91dd-8def499193bd","resolution":{"observed_at":"2026-08-11T13:08:44.363545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.462505Z","title":null,"venue":null,"work_id":"f915f083-02e5-42bb-ab11-861739f79f34","year":2016},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.409013Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:035f1b9c978aa45b3926cb4db65bfdbffed6f07ed35a30c9f1fcfd858f9f6fd1","observation_id":"595ee46e-efbe-49fc-a648-8f9ba8c9b334","resolution":{"observed_at":"2026-08-11T13:08:46.503029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07327","last_updated":"2023-10-31T11:38:07Z","snapshot_observed_at":"2026-08-06T15:18:02.072435Z","submitted_at":"2023-04-14T18:01:29Z","title":"OpenAssistant Conversations -- Democratizing Large Language Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07327","snapshot_observed_at":"2026-08-11T13:08:44.417263Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.417263Z"},"links":{"cited_paper":"/paper/2304.07327","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:df3de89762cd32833b6e6fad0e71cda05471db857642ff8de5e7c28a706c183d","observation_id":"acee3235-c3ad-40ef-afc3-5377c8c3b31d","resolution":{"observed_at":"2026-08-11T13:08:44.417263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-11T13:08:44.425013Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.425013Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:cce3dd825f422be2ac3a1b0b0d0e74c5f350fddb44e83cad0c893c29f6917943","observation_id":"fb5641c4-d03d-4304-af14-bcd851f47080","resolution":{"observed_at":"2026-08-11T13:08:44.425013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.432653Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.432653Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:4ea49ff156f09b8b6c4f9ff3816e7bfc1a60047ee6b1ea9c39e9ca0d2c347b2b","observation_id":"5a738634-c189-463c-a88b-7b4907c969b9","resolution":{"observed_at":"2026-08-11T13:08:44.432653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.413676Z","title":null,"venue":null,"work_id":"0cd85250-9d65-40d5-a55c-484c36c79a60","year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.440453Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:2db9a9836bd9942b730f13b8eff2bcbee3de8da1936684f8f91fdf749d3f2746","observation_id":"b53dfac0-84e9-410e-a4b1-1d330fe4e6a2","resolution":{"observed_at":"2026-08-11T13:08:46.422270Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02340","last_updated":"2019-02-23T07:45:29Z","snapshot_observed_at":"2026-07-06T07:06:10.289386Z","submitted_at":"2018-10-04T17:39:58Z","title":"SNIP: Single-shot Network Pruning based on Connection Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02340","snapshot_observed_at":"2026-08-11T13:08:44.446544Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.446544Z"},"links":{"cited_paper":"/paper/1810.02340","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:0a50ad2a5f6b8f182186ff5e34e9b4e07f8c3f1d4aac4e34e0a5b35202dcb1e7","observation_id":"4c99056b-e021-49ba-ad84-7e59dcbae68b","resolution":{"observed_at":"2026-08-11T13:08:44.446544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.376808Z","title":null,"venue":null,"work_id":"7011d33b-4ce9-4aa6-97c3-3ed6ceafb0c7","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.477140Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:8174800766860cf51fd3fddb399dda336df50278eaecc2269b579f8adcf47705","observation_id":"c7bee93d-6b39-4f0c-9aef-4c15747b1c31","resolution":{"observed_at":"2026-08-11T13:08:46.386924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T13:08:44.509912Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.509912Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:c631e33639b2421e9df1dc14cebebcff53eb815b1592ab9d268724ed3b585a4e","observation_id":"d2deea00-573a-4069-aa60-eafd92701cf1","resolution":{"observed_at":"2026-08-11T13:08:44.509912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.547906Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.547906Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:85f0fc45b31bf8d63cf37b550f38c394c96f6d156e57dc6778af161c358a38da","observation_id":"00258c3e-efe1-41b2-8911-359b6dcebd2e","resolution":{"observed_at":"2026-08-11T13:08:44.547906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-09T04:47:57.368711Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-11T13:08:44.553681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.553681Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:a1765cd3ddfd9abf7b65a37b46f05657d4a16c8b24f240c14cec1166cdedd60c","observation_id":"c3c788a1-5430-4572-b765-0e934e9ff1a5","resolution":{"observed_at":"2026-08-11T13:08:44.553681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.237986Z","title":null,"venue":null,"work_id":"52718a54-4ca8-4bf1-b05a-ffd9745b88c1","year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.564056Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:de5e688641a35d9ad540cfbb3c5023c1a7ffc2d4f0731a37cbe1fb277ca5879d","observation_id":"2d5ab9d4-e75d-47bd-a4ef-fa270f7e0472","resolution":{"observed_at":"2026-08-11T13:08:46.291912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.207761Z","title":null,"venue":null,"work_id":"04342a24-bedd-4d3f-8bad-54917ca53de1","year":2022},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.572093Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:431f8fdee6b37c3726a84065758fd18c74765ff4d499f39fe0d8fd6624e6507a","observation_id":"6b1e9760-afd7-4679-b7b1-fae5cd176150","resolution":{"observed_at":"2026-08-11T13:08:46.216675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.09777","last_updated":"2022-04-14T15:23:32Z","snapshot_observed_at":"2026-07-06T09:49:17.164814Z","submitted_at":"2020-08-22T08:15:52Z","title":"Surrogate NAS Benchmarks: Going Beyond the Limited Search Spaces of Tabular NAS Benchmarks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.09777","snapshot_observed_at":"2026-08-11T13:08:44.579420Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.579420Z"},"links":{"cited_paper":"/paper/2008.09777","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:c447ed1631f00226936763d2d2f965a78d1468022a5161fb0056e7467a036364","observation_id":"3cde09d5-c9b7-43d6-8ea8-df87b14bdfce","resolution":{"observed_at":"2026-08-11T13:08:44.579420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.121645Z","title":null,"venue":null,"work_id":"450759b4-a7b8-498b-be94-cc16e8255ba0","year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.586290Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:d60ab5f897243223ff9fee1b6e3c4c8e39ce9fea066aa5ad467eefaa1d1c7b89","observation_id":"96830ecd-fa77-4af8-944d-331b072010f3","resolution":{"observed_at":"2026-08-11T13:08:46.177611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.094329Z","title":null,"venue":null,"work_id":"450c8641-732b-41b5-88e5-21789d5ce4ac","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.595129Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:3f228d4ed9354831b9c44e2911fdc5e1e52acb08429950e4915d69444554d2a4","observation_id":"751db91f-c272-4e1a-bc50-1052757f6980","resolution":{"observed_at":"2026-08-11T13:08:46.104909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.057790Z","title":null,"venue":null,"work_id":"2301175a-e3aa-49e4-8ab5-600efda63ff1","year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.601629Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:6645b05d8847dad5c13db58dd02f8eccd21467316bae001ada7389c757a6f5a9","observation_id":"6d460b70-7929-4360-923e-8754b63a4818","resolution":{"observed_at":"2026-08-11T13:08:46.064686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.611155Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.611155Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:64b0d4d9e929f754fa48bc4cb0f7dee44405cb29031d46df1d5c256b8db793ee","observation_id":"dc6f652a-5ceb-49a6-832d-45f862509ebe","resolution":{"observed_at":"2026-08-11T13:08:44.611155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T13:08:44.711848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.711848Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:6f9457d6d9b5856dfc220ed3f4f2c4362b9f4fb16ceca98d73aebc69955a4c70","observation_id":"cc2f1e2f-8ac5-46c9-99ca-917f3fc6c123","resolution":{"observed_at":"2026-08-11T13:08:44.711848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-11T13:08:44.797442Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.797442Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:fab702b5391912554ef6de8346dc261db3a15ab819a4a3594b1dfd2ec1fec5cd","observation_id":"bc2e8def-2054-4aac-a4f7-1044641597a2","resolution":{"observed_at":"2026-08-11T13:08:44.797442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:45.968991Z","title":null,"venue":null,"work_id":"2889f865-7f40-44af-adf6-b1e2030bd33a","year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.894327Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:5451c7acff825a997d84ae0aa5d1e274b3a7faa89e09b4a86bf3e7f38ac86e04","observation_id":"669cd79e-7205-4e85-bd95-b36f437ce94c","resolution":{"observed_at":"2026-08-11T13:08:45.997279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.902467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.902467Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:61b71fbf495e404546d91dfc5cec4bb2d55e77097c551e0bcf4f146f57d7d3f1","observation_id":"bcc2531d-3ab9-4ae3-b0be-86e76e8cd7ee","resolution":{"observed_at":"2026-08-11T13:08:44.902467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-11T13:08:44.910387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.910387Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:d2b35e27a82330db2de4d0dc3812fa9503bbe71b6fc39d414e166e224c002acb","observation_id":"306d8cd4-1e53-47ee-8762-65966a468240","resolution":{"observed_at":"2026-08-11T13:08:44.910387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-11T13:08:44.917527Z","title":"Kwok, Zhenguo Li, Adrian Weller, and Weiyang Liu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.917527Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:ce6ffc4f6226db330f4484459c4f43bc393c465f459d522cd4b73f3b407bc318","observation_id":"2c5deaa6-980e-4f1e-be74-e6322fc5a8fe","resolution":{"observed_at":"2026-08-11T13:08:44.917527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-11T13:08:44.925209Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.925209Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:6cbe61489c4e19abaa3716bd36c710967a860ee677896c3250247814f62be446","observation_id":"8c7f400d-ecd8-4e4f-bd07-7bd56adc46af","resolution":{"observed_at":"2026-08-11T13:08:44.925209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-06T03:14:31.781649Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-11T13:08:44.933146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.933146Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:d58a82cb88c1a9f55b7ac969dfc639d51594bd3c65f715bc05d3742e0f8dbc09","observation_id":"dd6de7a9-09d4-4921-afa7-57ed09be6e0b","resolution":{"observed_at":"2026-08-11T13:08:44.933146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T02:34:38.748338Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2412.13488."}