{"as_of":"2026-08-04T09:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:efa4b663afac62d52aaf201987fb0fc3603d21d3cb58d64132905c3e814fd3f2","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T18:55:48.540435Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:25:39.418964Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.22671","snapshot_observed_at":"2026-07-31T11:25:39.418964Z","title":"Fragile knowledge, robust instruction-following: The width pruning dichotomy in Llama-3.2,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28319","last_updated":"2026-07-30T14:54:33Z","snapshot_observed_at":"2026-08-03T00:09:53.699212Z","submitted_at":"2026-07-30T14:54:33Z","title":"Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T11:25:39.418964Z"},"links":{"cited_paper":"/paper/2512.22671","citing_paper":"/paper/2607.28319"},"observation_digest":"sha256:fab67d8f7ec24f580007089866900b9e0a4e0b3cc95cd9f974ec9dfdd832f7fb","observation_id":"49a87d05-acb9-4e96-a157-9204b3899df6","resolution":{"observed_at":"2026-07-31T11:25:39.418964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.22671/citation-record","integrity":"/paper/2512.22671/integrity","json":"/paper/2512.22671/citation-record.json","paper":"/paper/2512.22671"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.14230","last_updated":"2026-07-18T19:29:10Z","snapshot_observed_at":"2026-08-04T03:55:47.678827Z","submitted_at":"2025-09-17T17:59:00Z","title":"NIRVANA: Structured Pruning Reimagined for Large Language Model Compression","version":2},"cited_work":{"arxiv_id":"2509.14230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.14230","snapshot_observed_at":"2026-07-21T02:20:30.756931Z","title":"arXiv:2509.14230 [cs]","venue":null,"work_id":"3db3d13b-caef-4eaf-a679-3192c8144a37","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2509.14230","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:594fe743898781c71d572132c61747cbbfb2a8dc8564c920654f7da9f3c33720","observation_id":"6b1f1d7d-7747-46c2-b9f1-40b47013ac2f","resolution":{"observed_at":"2026-07-21T02:20:30.756931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":"2401.15024","doi":"10.48550/arxiv.2401.15024","metadata_source":"pith","pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Slicegpt: Compress large language models by deleting rows and columns","venue":"cs.LG","work_id":"f3275cfc-b514-4a2e-be9d-1fa27726e5f4","year":2024},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:a73640f8b58112e4c0da3479171de0d9c61d2ac4c6004ebb640eb6f6e21716f4","observation_id":"2752f341-8876-4411-94b4-ea32e2b7f8f0","resolution":{"observed_at":"2026-05-16T18:58:19.021517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00096","last_updated":"2025-09-03T14:58:03Z","snapshot_observed_at":"2026-07-06T22:20:50.350336Z","submitted_at":"2025-08-27T15:48:18Z","title":"Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs","version":2},"cited_work":{"arxiv_id":"2509.00096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00096","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"org/abs/2509.00096v2","venue":null,"work_id":"e212277d-8d3d-4799-abe7-a03eb2786b28","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2509.00096","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:b8e8a2bdd7609bb3735bd1616cbd543ed38d67f166d1604bc0138c07d53ffa26","observation_id":"9984d5ee-22f3-41d3-80b6-0797f120f9a5","resolution":{"observed_at":"2026-05-16T18:58:19.024693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04573","last_updated":"2023-10-06T20:28:32Z","snapshot_observed_at":"2026-08-03T12:59:12.948609Z","submitted_at":"2023-10-06T20:28:32Z","title":"Can pruning make Large Language Models more efficient?","version":1},"cited_work":{"arxiv_id":"2310.04573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.04573","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2310.04573 [cs]","venue":null,"work_id":"385626de-8084-4cd9-b3fd-97d6be6cac28","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2310.04573","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:b92b064adcb306100b3439917e23e94ba1fdbd89aaff64a093156e39bf5f1121","observation_id":"767d55d5-aa94-4fc1-b505-e5fdcf98a7ba","resolution":{"observed_at":"2026-05-16T18:58:18.981211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01943","last_updated":"2024-10-20T12:27:26Z","snapshot_observed_at":"2026-07-31T12:35:17.813055Z","submitted_at":"2024-05-03T09:13:13Z","title":"Dependency-Aware Semi-Structured Sparsity of GLU Variants in Large Language Models","version":3},"cited_work":{"arxiv_id":"2405.01943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01943","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2405.01943 [cs]","venue":null,"work_id":"9fa93302-901f-4e35-9789-4d483645abe2","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2405.01943","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:883462eed19418ac2beaedccd9c196419beb9412754bb8353b328b22f4e73d8b","observation_id":"d51fdf24-d5ff-4fc3-a9ce-8fdea2648509","resolution":{"observed_at":"2026-05-16T18:58:18.976803Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02086","last_updated":"2025-06-02T21:33:43Z","snapshot_observed_at":"2026-08-02T20:26:29.728788Z","submitted_at":"2025-01-03T20:19:14Z","title":"Instruction-Following Pruning for Large Language Models","version":3},"cited_work":{"arxiv_id":"2501.02086","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.02086","snapshot_observed_at":"2026-07-10T12:07:03.716884Z","title":"arXiv:2501.02086 [cs]","venue":"cs.CL","work_id":"02691984-32c8-421a-9573-d3d1b1f3334e","year":2025},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2501.02086","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:d76734c07567459c6d087e13d43ed169704c68b7fbf936a70fb36a910496bbd8","observation_id":"9d632509-9cc7-4abe-9675-f75f8954adf7","resolution":{"observed_at":"2026-05-16T18:58:19.017918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-07-06T17:25:18.238343Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":"2402.02834","doi":"10.48550/arxiv.2402.02834","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2402.02834 , volume=","venue":null,"work_id":"4c40e3b8-e525-4a77-9650-98e2f999bb7a","year":2024},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:89562b84e42d062586fef4c3753f50940d714802e8d3dfd4cdc48a6dad295a2f","observation_id":"ab7addbe-4973-44d0-b510-d957f66c5722","resolution":{"observed_at":"2026-05-16T18:58:19.028449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12182","last_updated":"2025-07-08T07:21:15Z","snapshot_observed_at":"2026-08-04T05:40:26.897908Z","submitted_at":"2025-05-18T00:47:21Z","title":"Truth Neurons","version":3},"cited_work":{"arxiv_id":"2505.12182","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12182","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2505.12182 [cs]","venue":null,"work_id":"dd465066-b7e5-4dd9-934a-b6eb11301ba3","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2505.12182","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:204999f0bcfd6b242f26b3a04e90f3849e9d3e33a1dd165fad6554d034740e9e","observation_id":"19ae8818-37b5-4486-af14-6e04f6ef3605","resolution":{"observed_at":"2026-05-16T18:58:19.031989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21174","last_updated":"2026-07-29T21:06:04Z","snapshot_observed_at":"2026-08-02T23:10:43.063810Z","submitted_at":"2025-04-29T20:50:08Z","title":"Efficient LLMs with AMP: Attention Heads and MLP Pruning","version":2},"cited_work":{"arxiv_id":"2504.21174","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.21174","snapshot_observed_at":"2026-07-31T01:08:26.145898Z","title":"arXiv: 2504.21174","venue":null,"work_id":"924b3f65-f89f-49ba-86cc-fcda4c51579b","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2504.21174","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:48e7b7ba0bbaaec4c02b04207232760ded54e35f26a8be5d46b177a32f0fa533","observation_id":"38315544-0fb9-42ba-bf5a-cdd6fbed4faa","resolution":{"observed_at":"2026-07-31T01:08:26.145898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14679","last_updated":"2024-11-04T17:36:38Z","snapshot_observed_at":"2026-07-06T18:49:20.859618Z","submitted_at":"2024-07-19T21:47:57Z","title":"Compact Language Models via Pruning and Knowledge Distillation","version":2},"cited_work":{"arxiv_id":"2407.14679","doi":"10.48550/arxiv.2407.14679","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.14679","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Compact language models via pruning and knowledge distillation","venue":null,"work_id":"ec34dd9f-3c10-4d6c-a30c-48d8865b0cf8","year":2024},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2407.14679","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:8276969ef4cfa984efcf82554d59009e9bcf47d9bbe116cb15c6a3289c77c6e2","observation_id":"7458b619-10a0-4a75-bda5-015293fcfb83","resolution":{"observed_at":"2026-05-16T18:58:19.011236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2505.18350 [cs]","venue":null,"work_id":"7a0dd42b-794a-4a90-9504-d702ab0504a1","year":2023},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:796187440e8a7791f5a5e5e2d4bcea10e87d11a5b1665514b2e6d0a6e878a3bc","observation_id":"2f0ad6bb-de33-4797-8015-030edffafa00","resolution":{"observed_at":"2026-05-16T18:58:19.003572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-07-11T03:27:46.760869Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:8c3c6e6f5389b81f6eb925459b6a0d06deaadb2abd5edd75826bcd70ae0e7f9d","observation_id":"1a2cbb7e-7c00-4ca7-9458-a1eb1c2ba268","resolution":{"observed_at":"2026-05-16T18:58:19.000224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":"2306.11695","doi":"10.48550/arxiv.2306.11695","metadata_source":"pith","pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A Simple and Effective Pruning Approach for Large Language Models","venue":"cs.CL","work_id":"e764df7f-c928-4b41-812e-352750f475c2","year":2023},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:78c5f0581f9bcd97375c42853a92a54888a730d7ce0190cd436f6c248c2e3e73","observation_id":"7f7edf20-5217-42e2-8f03-157b2ff64b04","resolution":{"observed_at":"2026-05-16T18:58:19.007288Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:17:35.617708Z","title":"librosa/librosa: 0.6.3","venue":null,"work_id":"a2be0426-0f15-4d3d-a62d-9b21d5ec8960","year":2025},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:820b6a5a6acaee40d2c327d20ea1ab7ab788031eb81878ba3b674f9fe5523549","observation_id":"8a9d76ab-aeba-4762-b804-50f32f0bc3b8","resolution":{"observed_at":"2026-05-16T18:58:18.511287Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.22228","last_updated":"2026-07-20T17:30:01Z","snapshot_observed_at":"2026-08-04T08:11:48.838546Z","submitted_at":"2025-10-25T09:22:22Z","title":"When Fewer Layers Break More Chains: Layer Pruning Harms Test-Time Scaling in LLMs","version":2},"cited_work":{"arxiv_id":"2510.22228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.22228","snapshot_observed_at":"2026-07-21T03:22:30.098810Z","title":"arXiv: 2510.22228","venue":null,"work_id":"ab7de536-07cd-47a2-8742-8df3a1e1b005","year":null},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2510.22228","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:c6f07be09af03cfc4b0e01b2629dbaba7508750f70a17201eb3bf544c72ec13b","observation_id":"7232e06d-0a39-438c-89aa-ae5ef513d8cd","resolution":{"observed_at":"2026-07-21T03:22:30.098810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05162","last_updated":"2024-10-24T19:21:52Z","snapshot_observed_at":"2026-08-02T21:32:36.729604Z","submitted_at":"2024-02-07T18:34:38Z","title":"Assessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications","version":4},"cited_work":{"arxiv_id":"2402.05162","doi":"10.48550/arxiv.2402.05162","metadata_source":"pith","pith_arxiv_id":"2402.05162","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Assessing the brittleness of safety alignment via pruning and low-rank modifications","venue":"cs.LG","work_id":"0adadb60-1c1e-4c3f-ba68-7e500b454d96","year":2024},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2402.05162","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:b72fd6ab7a41200d429d2b10ee19c259cc9185926dee43eb449ce465cc9f7613","observation_id":"4014d4f8-ebe4-4157-9e85-317ab0948343","resolution":{"observed_at":"2026-05-16T18:58:18.996512Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T04:52:42.066348+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T04:52:42.066348+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-02T10:03:27.228650Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":"2310.06694","doi":"10.48550/arxiv.2310.06694","metadata_source":"pith","pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2310.06694 (2023)","venue":"cs.CL","work_id":"73480081-43d5-42f8-b23e-1d3638244364","year":2023},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:870612f4d6a4521a9a2d3c9ec7eb6bef6459ce3fa709cd21e384d6bd968c5a26","observation_id":"05da1b48-ddd9-4c91-9f62-e482d31c653d","resolution":{"observed_at":"2026-05-16T18:58:18.989602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-04T09:56:30.951462Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:6783c22b343f0f6bb0317b54f879fcb968a2f30594f34a32b3b3a520e7be6f69","observation_id":"a33dc195-a8fa-4260-9eb3-abf161242ae4","resolution":{"observed_at":"2026-05-16T18:58:18.992814Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-07-06T16:06:18.758673Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:bc309392ca7db77108e3dae30fe136e0f5f45221e5abff6ff757a426c95986d7","observation_id":"14994c42-d4de-4a2c-9588-84ebfe2588af","resolution":{"observed_at":"2026-05-16T18:58:18.985436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Capability Dichotomy","venue":null,"work_id":"099ef1c6-b141-48b5-b2e4-b0bb8463e5c2","year":2024},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:87fe966be48dc542c17a5343ed31f17f59a64634e62cfbc60855fe45c5c98652","observation_id":"df306856-9277-4b49-8e13-9684fdef45c8","resolution":{"observed_at":"2026-05-16T19:01:12.441841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lambada (PPL) WikiText-2 (PPL) Selection Criteria Value∆vs","venue":null,"work_id":"920543fa-71cb-4ec5-9012-872701613d35","year":2032},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:2cfb2a23ed126ecd17f10be002ec69c321fe1bf90fa5687d87b982b2391a3443","observation_id":"357835de-d9f8-4bb6-b299-3a94c8b100ed","resolution":{"observed_at":"2026-05-16T19:01:12.439507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T20:24:07.326890Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":16,"verified_fuzzy":2},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2512.22671."}