{"as_of":"2026-08-09T05:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83ebd48abe7cf78230276975dff8296ff61739ab64e1b1e2b5c88fd7fbcdd045","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:03:50.230653Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20155/citation-record","integrity":"/paper/2505.20155/integrity","json":"/paper/2505.20155/citation-record.json","paper":"/paper/2505.20155"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:03:45.589327Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:45.589327Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:f3b9bc99f8b1985f70ef9362bcefa3e580a401c5b81ac750a20c4f2bcd49720c","observation_id":"a7bb6bb2-7bfd-4cff-a62f-3df0890ec3b1","resolution":{"observed_at":"2026-08-07T14:03:45.589327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:45.813530Z","title":"Fluctuation-based adaptive structured pruning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:45.813530Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:34ccafe1e5f86a9a7b55e2ef1e4fee1d9ed9792858180c2806e78c314a3e83bc","observation_id":"3875c603-d1fb-44de-9600-88164dad398d","resolution":{"observed_at":"2026-08-07T14:03:45.813530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-07T14:03:47.433610Z","title":"Slicegpt: Compress large language models by deleting rows and columns.arXiv preprint arXiv:2401.15024, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:47.433610Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:53829a65a633449d9dca6ee0f485fbd64346ee0c507bdcf3a1aa4f73227f73f4","observation_id":"f583b216-7d27-41cb-abfb-421b17e8792b","resolution":{"observed_at":"2026-08-07T14:03:47.433610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T14:03:47.885148Z","title":"Layer normalization.arXiv preprint arXiv:1607.06450, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:47.885148Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:7d9e8ebf8213345041c5e81310ee4923b4ead6a1cc85974fa40534e05a01c874","observation_id":"1c95d95c-92de-4e67-918a-590c1e80d78e","resolution":{"observed_at":"2026-08-07T14:03:47.885148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19146","last_updated":"2025-06-03T12:02:03Z","snapshot_observed_at":"2026-07-06T19:58:31.184255Z","submitted_at":"2024-11-28T13:45:42Z","title":"Puzzle: Distillation-Based NAS for Inference-Optimized LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19146","snapshot_observed_at":"2026-08-07T14:03:48.003294Z","title":"Puzzle: Distillation-based nas for inference-optimized llms.arXiv preprint arXiv:2411.19146, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.003294Z"},"links":{"cited_paper":"/paper/2411.19146","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:8d57abd86c85b182c95ab79487c58a62859703e1dbe8ad3524f207a23721fb45","observation_id":"d545edcf-f197-457a-8148-c6806cce1427","resolution":{"observed_at":"2026-08-07T14:03:48.003294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07143","last_updated":"2021-10-14T04:05:25Z","snapshot_observed_at":"2026-08-08T04:38:52.617907Z","submitted_at":"2021-10-14T04:05:25Z","title":"bert2BERT: Towards Reusable Pretrained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07143","snapshot_observed_at":"2026-08-07T14:03:48.143877Z","title":"bert2bert: Towards reusable pretrained language models.ArXiv, abs/2110.07143, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.143877Z"},"links":{"cited_paper":"/paper/2110.07143","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:b125bf4008b88af63471d58d3e37005daba28a508e9fae92f2a799e929af0941","observation_id":"8ab5afdd-292a-42c9-9b4e-bb77f805e6b5","resolution":{"observed_at":"2026-08-07T14:03:48.143877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:03:48.288660Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.288660Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:17d165c4c4d6473e3de347c7b1f7c3e4231ffd35663f8e4c6f6c0cfb1a5f088b","observation_id":"92110032-d165-49ac-8391-e96b0591203c","resolution":{"observed_at":"2026-08-07T14:03:48.288660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:48.413639Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.413639Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:0aad6907c9a2cfebcb72d6f6f2718e421ea2402f24e330daa139b8a31a218da4","observation_id":"db65e958-1a6a-4023-a763-90c95870fdd4","resolution":{"observed_at":"2026-08-07T14:03:48.413639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:03:48.536521Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.536521Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:facb1e3dbf6b78ff916545d1c3607d42ce6d945f5f1b65e9061687def1f773ec","observation_id":"512347b6-c9e4-4d31-83f3-b881c26f44bb","resolution":{"observed_at":"2026-08-07T14:03:48.536521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T14:03:48.628769Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.628769Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:d9d72482f1289e93381e2b565dc7140c6d501805da915361743d44045b39598f","observation_id":"679708b8-e580-4377-8e40-2c0a3afc7172","resolution":{"observed_at":"2026-08-07T14:03:48.628769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T14:03:48.732655Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.732655Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:c5ce5df039b7d8dc43b6c44982e12368bf45cae7a36f7c0e74a25c6ef3a978fd","observation_id":"d45a5f1f-9194-4e91-91ef-20498241ab00","resolution":{"observed_at":"2026-08-07T14:03:48.732655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-08-07T23:10:12.222808Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-08-07T14:03:48.843903Z","title":"Shortened llama: A simple depth pruning for large language models.arXiv preprint arXiv:2402.02834, 11, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.843903Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:1ddece488d1ac854b435ecf8aee2948feb9286be8ae4270d0bdae62be397a9fc","observation_id":"10dcde56-a951-426d-9a75-e25bee6e158f","resolution":{"observed_at":"2026-08-07T14:03:48.843903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09695","last_updated":"2024-04-15T11:53:22Z","snapshot_observed_at":"2026-07-06T18:00:16.713949Z","submitted_at":"2024-04-15T11:53:22Z","title":"LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09695","snapshot_observed_at":"2026-08-07T14:03:48.948801Z","title":"Lorap: Transformer sub-layers deserve differenti- ated structured compression for large language models.arXiv preprint arXiv:2404.09695, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:48.948801Z"},"links":{"cited_paper":"/paper/2404.09695","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:41c410e2a3b6b29e725026430cb53c7ed170da664375f9fe1953a6033e175656","observation_id":"0babf88d-6996-4337-a4be-c1678e7de9e2","resolution":{"observed_at":"2026-08-07T14:03:48.948801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16663","last_updated":"2024-10-22T03:29:33Z","snapshot_observed_at":"2026-08-07T00:29:14.945462Z","submitted_at":"2024-10-22T03:29:33Z","title":"FastAttention: Extend FlashAttention2 to NPUs and Low-resource GPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16663","snapshot_observed_at":"2026-08-07T14:03:49.048605Z","title":"Fastattention: Extend flashattention2 to npus and low-resource gpus","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.048605Z"},"links":{"cited_paper":"/paper/2410.16663","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:b8edf7029e6a20c65d70aa0aae69eeb2e59b377d781d596f00c146629cb8c872","observation_id":"06a0d854-3cc7-498b-a52b-adeb1053b518","resolution":{"observed_at":"2026-08-07T14:03:49.048605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18110","last_updated":"2024-12-24T02:49:50Z","snapshot_observed_at":"2026-07-06T20:12:31.283474Z","submitted_at":"2024-12-24T02:49:50Z","title":"SlimGPT: Layer-wise Structured Pruning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18110","snapshot_observed_at":"2026-08-07T14:03:49.156211Z","title":"Slimgpt: Layer-wise structured pruning for large language models.arXiv preprint arXiv:2412.18110, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.156211Z"},"links":{"cited_paper":"/paper/2412.18110","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:757e1bd03de900dc61159d0789bc80b4857e99b0b4722d531bb45d917e85c6a0","observation_id":"13cd30eb-32eb-4858-8572-648f43d32802","resolution":{"observed_at":"2026-08-07T14:03:49.156211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:49.250473Z","title":"Llm-pruner: On the structural pruning of large language models.Advances in neural information processing systems, 36:21702–21720, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.250473Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:9ec9ea8c1b2ab5f5f594e1686372b716635851cb1ca0a4cd61ede4591978f3a8","observation_id":"8cc4047b-c45d-41e2-bd74-8d6fb8e41660","resolution":{"observed_at":"2026-08-07T14:03:49.250473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-07T14:03:49.507829Z","title":"Shortgpt: Layers in large language models are more redundant than you expect.ArXiv, abs/2403.03853, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.507829Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:29efc2f2deaf3b25078a87e2e2e08b0c24236ff23c6dc808673ae178af515ac2","observation_id":"f61d447f-138e-41a6-8ae8-70bbd193dbde","resolution":{"observed_at":"2026-08-07T14:03:49.507829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:49.586477Z","title":"Compact language models via pruning and knowledge distillation.Advances in Neural Information Processing Systems, 37:41076–41102, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.586477Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:0c210ab0c6b85c012f76b8f9a70eb443861522f0c57c96a85ba0d0f2507c1d1a","observation_id":"16afe5be-f828-4d8e-98fe-8c1cfbc0676c","resolution":{"observed_at":"2026-08-07T14:03:49.586477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:49.661378Z","title":"Fusegpt: Learnable layers fusion of generative pre-trained transformers.arXiv preprint arXiv:2411.14507, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.661378Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:474ad30f5182fdfffa8b13c79db4c8f6fab26ec530eefb9594e8b7667fb722c1","observation_id":"09872026-eec2-4148-a4af-b191cb9db28a","resolution":{"observed_at":"2026-08-07T14:03:49.661378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-07T14:03:49.733071Z","title":"A simple and effective pruning approach for large language models.arXiv preprint arXiv:2306.11695, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.733071Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:5c9ad12a1b14576d636470ed3bfd54f34576efac58162d26e98cf0489dd8bc0b","observation_id":"3e305a96-960d-4161-8d27-4aa42b1435f8","resolution":{"observed_at":"2026-08-07T14:03:49.733071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-08T20:21:38.269492Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-07T14:03:49.796812Z","title":"Sheared llama: Accelerating language model pre-training via structured pruning.arXiv preprint arXiv:2310.06694, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.796812Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:84e243fa47e9dbd1764eb22b3d5d17342b5f72fd8e494802ffc06f392f050310","observation_id":"997c0ad8-4bba-4af0-97d2-34bddd8dd6cf","resolution":{"observed_at":"2026-08-07T14:03:49.796812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:03:49.879388Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.879388Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:4b762f5b3441c6fbd0f280eed2cf5946cb4ba0f5b7189bddece46bae5762ddb8","observation_id":"5af5bdcb-e5ad-485c-a00b-53792290b617","resolution":{"observed_at":"2026-08-07T14:03:49.879388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-07T14:03:49.976362Z","title":"Laco: Large language model pruning via layer collapse.arXiv preprint arXiv:2402.11187, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.976362Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:2a698a8968a193c958fe7041c87c05708f32772030025c0da7961b2fa79f2e0f","observation_id":"fcc5502e-2347-4934-90b6-4f3d81b1d427","resolution":{"observed_at":"2026-08-07T14:03:49.976362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:50.065340Z","title":"Pangu ultra: Pushing the limits of dense large language models on ascend npus","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:50.065340Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:390d4d8051ac3e5996008e256382a727a3e1d1f86417e28a257e2577daaf353a","observation_id":"01e62b67-372f-45cc-9958-c6941e61aae1","resolution":{"observed_at":"2026-08-07T14:03:50.065340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:03:50.584142Z","title":"Root mean square layer normalization.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":"eeba7cce-f7d1-4632-9564-4d8e77541750","year":2019},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:50.111033Z"},"links":{"citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:5fd21ca62c0df1e3cd8c1d8419c6d3ca99ac39ff566539722ac6ef7125d01a81","observation_id":"504e655c-17b9-47f1-a380-4b33fe3af8a6","resolution":{"observed_at":"2026-08-07T14:03:50.635206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18403","last_updated":"2024-08-07T03:30:30Z","snapshot_observed_at":"2026-08-06T07:29:40.859648Z","submitted_at":"2023-05-28T15:15:48Z","title":"LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18403","snapshot_observed_at":"2026-08-07T14:03:50.150580Z","title":"Loraprune: Pruning meets low-rank parameter-efficient fine-tuning.arXiv preprint arXiv:2305.18403, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:50.150580Z"},"links":{"cited_paper":"/paper/2305.18403","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:0ee014300282a9531e0b6ca8ad1a9d85a8b9303a982251477bb2f71f9882821a","observation_id":"387bde6f-6707-497d-bb2a-e26386318834","resolution":{"observed_at":"2026-08-07T14:03:50.150580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10622","last_updated":"2025-06-14T08:10:48Z","snapshot_observed_at":"2026-08-07T22:20:27.338782Z","submitted_at":"2025-03-13T17:59:06Z","title":"Transformers without Normalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10622","snapshot_observed_at":"2026-08-07T14:03:50.230653Z","title":"Transformers without normaliza- tion.arXiv preprint arXiv:2503.10622, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:50.230653Z"},"links":{"cited_paper":"/paper/2503.10622","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:3b4de949ad98ba9839512b6c463e9bdea0d931db49836c46f6d4fbc13ab2cb88","observation_id":"5187db35-4762-4cc3-b373-f26c1d62d21e","resolution":{"observed_at":"2026-08-07T14:03:50.230653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2505.20155."}