{"as_of":"2026-08-19T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:780c6bc28cb5d3417f15917f69f7ba352fd08856261fdfc09d3c80eae8e7c3ef","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:59:48.350745Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:52:28.170298Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T17:52:28.290404Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"cited_work":{"arxiv_id":"2501.14713","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.14713","snapshot_observed_at":"2026-08-05T17:52:28.290404Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","venue":"cs.CL","work_id":"4b194778-da04-48d6-a2e8-e5b4eae1bcb8","year":2025},"citing_paper":{"arxiv_id":"2508.16680","last_updated":"2025-08-26T02:14:41Z","snapshot_observed_at":"2026-08-14T16:33:41.392724Z","submitted_at":"2025-08-21T13:16:02Z","title":"CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:52:28.170298Z"},"links":{"cited_paper":"/paper/2501.14713","citing_paper":"/paper/2508.16680"},"observation_digest":"sha256:c1fb0b6f83a930e1f626131b1d9202df84ab2cc7801be00d009a98e80ec421bd","observation_id":"9364cb06-1227-4de1-ad60-37f0966a8470","resolution":{"observed_at":"2026-08-05T17:52:28.297343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14713/citation-record","integrity":"/paper/2501.14713/integrity","json":"/paper/2501.14713/citation-record.json","paper":"/paper/2501.14713"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-08-17T10:13:54.763177Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-10T14:59:48.250451Z","title":"arXiv preprint arXiv:2401.10774","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.250451Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:ca27006c7e7e1b22e7f62cd6892fab33cc2aadc32d837230d5b347826fac81c1","observation_id":"71a7b657-c5c8-4a52-b94c-c8fce5c2cb8b","resolution":{"observed_at":"2026-08-10T14:59:48.250451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11819","last_updated":"2024-10-24T05:53:18Z","snapshot_observed_at":"2026-08-16T14:17:29.881419Z","submitted_at":"2024-02-19T04:19:36Z","title":"Head-wise Shareable Attention for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11819","snapshot_observed_at":"2026-08-10T14:59:48.254511Z","title":"arXiv preprint arXiv:2402.11819","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.254511Z"},"links":{"cited_paper":"/paper/2402.11819","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:92771ae864a9229f6ee42f4a2740226f2b12f0bf34ea2c471ed8a7da33278ed2","observation_id":"9d050b94-7530-448f-85c4-29d3b92b4509","resolution":{"observed_at":"2026-08-10T14:59:48.254511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03819","last_updated":"2019-03-05T16:46:19Z","snapshot_observed_at":"2026-08-13T07:34:17.550838Z","submitted_at":"2018-07-10T18:39:15Z","title":"Universal Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03819","snapshot_observed_at":"2026-08-10T14:59:48.266501Z","title":"arXiv preprint arXiv:1807.03819","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.266501Z"},"links":{"cited_paper":"/paper/1807.03819","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:ecbf9cf87c5f5e0afacc1762fca12b67fd12c8bae4ad411b84f020f98a516b68","observation_id":"b998c2a9-f8a3-46c5-b9b5-4bf5bdbb2583","resolution":{"observed_at":"2026-08-10T14:59:48.266501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16710","last_updated":"2024-10-18T04:02:31Z","snapshot_observed_at":"2026-08-18T12:06:53.750791Z","submitted_at":"2024-04-25T16:20:23Z","title":"LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16710","snapshot_observed_at":"2026-08-10T14:59:48.270004Z","title":"arXiv preprint arXiv:2404.16710","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.270004Z"},"links":{"cited_paper":"/paper/2404.16710","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:2e46a48be0702b6a1e5834a90cc7eedd2aa3943ae73840c94b81e1a5c65d907c","observation_id":"03967287-d11a-4066-9a80-d4262baee57a","resolution":{"observed_at":"2026-08-10T14:59:48.270004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T14:59:48.284156Z","title":"arXiv preprint arXiv:2106.09685","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.284156Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:8e4379cc0edf24f3ff43a6c616f77be7fe98234b4d59d1e0d377cdac1a620677","observation_id":"096671c5-da39-4457-9027-a9c865b69c54","resolution":{"observed_at":"2026-08-10T14:59:48.284156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08442","last_updated":"2023-04-17T17:03:56Z","snapshot_observed_at":"2026-08-16T15:39:49.500140Z","submitted_at":"2023-04-17T17:03:56Z","title":"The MiniPile Challenge for Data-Efficient Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08442","snapshot_observed_at":"2026-08-10T14:59:48.287589Z","title":"arXiv preprint arXiv:2304.08442","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.287589Z"},"links":{"cited_paper":"/paper/2304.08442","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:9a224bb8bd5d28caf6f7a4741e8774d3130b6795cf0fa4df690bcf4f90198c65","observation_id":"381fde8c-c300-43a5-a67b-859ea6a06d4c","resolution":{"observed_at":"2026-08-10T14:59:48.287589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-16T20:01:36.160048Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-10T14:59:48.291038Z","title":"arXiv preprint arXiv:2104.08691","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.291038Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:4a399797df4104e0f1c57083dc619d6003e45f3a39b8e7b0c2a90c8a032912f2","observation_id":"c63f6358-52c3-4134-875a-b3b1b02e4097","resolution":{"observed_at":"2026-08-10T14:59:48.291038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-10T14:59:48.294454Z","title":"In International Conference on Machine Learning, pages 19274–19286","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.294454Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:1ea89304d9b8fb20eaf98e87f5b3a325e03136219f2943d5d3e05a80b2c7af2a","observation_id":"022155da-5826-47fe-9228-d151cb30d5ff","resolution":{"observed_at":"2026-08-10T14:59:48.294454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-18T04:49:12.041312Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-10T14:59:48.297273Z","title":"arXiv preprint arXiv:2110.07602","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.297273Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:864f4e0f40ca53472c9e4059577952be754d3279033bd2505b61c7fec2fbb6b7","observation_id":"b0ff9be9-71d9-456f-a40a-8d06e0fb6c8e","resolution":{"observed_at":"2026-08-10T14:59:48.297273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-16T14:12:14.696997Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-10T14:59:48.300193Z","title":"arXiv preprint arXiv:2403.03853","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.300193Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:0d5b7db0128a26c553fbfe9150d99a7ed4ad7b687b7e30f6a4adbb2c72d43842","observation_id":"7b52c128-d06d-4c9b-aaed-1b6e3fb89ff4","resolution":{"observed_at":"2026-08-10T14:59:48.300193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-10T14:59:48.303078Z","title":"Preprint, arXiv:1609.07843","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.303078Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:bf325288ff4db1eb0e68d2e5f2fb725a88c390b2317ac9f0e423235acc1d3f2d","observation_id":"5c53e008-1a12-4626-91d5-5a0d4f019fff","resolution":{"observed_at":"2026-08-10T14:59:48.303078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-10T14:59:48.306014Z","title":"arXiv preprint arXiv:2402.06196","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.306014Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:c98c3f9f6d98ef1150c963e7c245f976fbc2d2c123a05202a7e428a7e747443b","observation_id":"c14f7341-46bb-480e-975a-ee48ea735a50","resolution":{"observed_at":"2026-08-10T14:59:48.306014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-10T14:59:48.309409Z","title":"arXiv preprint arXiv:2307.06435","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.309409Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:bf602cba8a4247a2d331bd7be077c77400f1e6d1b7ce39de6b6493126f77d685","observation_id":"a1bce8de-2d85-4448-ab4b-cd73becccce5","resolution":{"observed_at":"2026-08-10T14:59:48.309409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00518","last_updated":"2024-02-01T11:39:04Z","snapshot_observed_at":"2026-08-16T14:22:33.449214Z","submitted_at":"2024-02-01T11:39:04Z","title":"EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00518","snapshot_observed_at":"2026-08-10T14:59:48.313273Z","title":"arXiv preprint arXiv:2402.00518","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.313273Z"},"links":{"cited_paper":"/paper/2402.00518","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:a8c459caf461cadade3bd988214d8f125563ccaa0345deb899ade58c7014c68e","observation_id":"cbf55e81-76b6-4a48-ac36-3cd3d18a12d4","resolution":{"observed_at":"2026-08-10T14:59:48.313273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00234","last_updated":"2021-09-08T05:48:57Z","snapshot_observed_at":"2026-08-17T01:36:08.189782Z","submitted_at":"2021-01-01T13:53:22Z","title":"Subformer: Exploring Weight Sharing for Parameter Efficiency in Generative Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00234","snapshot_observed_at":"2026-08-10T14:59:48.316556Z","title":"arXiv preprint arXiv:2101.00234","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.316556Z"},"links":{"cited_paper":"/paper/2101.00234","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:592c90feb8778f90b3bb493850f910c790004b3eaee3e12f046e01d9fb2860f3","observation_id":"9bcbf74b-1ddb-47e3-ad53-9f5b398d549c","resolution":{"observed_at":"2026-08-10T14:59:48.316556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10427","last_updated":"2023-05-17T17:57:34Z","snapshot_observed_at":"2026-08-18T03:17:09.571926Z","submitted_at":"2023-05-17T17:57:34Z","title":"Accelerating Transformer Inference for Translation via Parallel Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10427","snapshot_observed_at":"2026-08-10T14:59:48.319981Z","title":"arXiv preprint arXiv:2305.10427","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.319981Z"},"links":{"cited_paper":"/paper/2305.10427","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:a7134a47026aeee32b705c09538df08cb6dfa6526ff3839011e61855e0b2d9bd","observation_id":"d04cfec8-1c97-4c4a-bb5d-bd871882b7ac","resolution":{"observed_at":"2026-08-10T14:59:48.319981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06022","last_updated":"2023-06-02T11:10:25Z","snapshot_observed_at":"2026-08-16T18:32:00.694647Z","submitted_at":"2021-04-13T08:41:07Z","title":"Lessons on Parameter Sharing across Layers in Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.06022","snapshot_observed_at":"2026-08-10T14:59:48.323153Z","title":"arXiv preprint arXiv:2104.06022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.323153Z"},"links":{"cited_paper":"/paper/2104.06022","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:775258d8e4b7fee25bf0ade712de35fff90d70d106b5a8779f6326e477692082","observation_id":"38583a41-8ab5-4c1b-ae1e-2bf9da7864cb","resolution":{"observed_at":"2026-08-10T14:59:48.323153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T14:59:48.326654Z","title":"arXiv preprint arXiv:2302.13971","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.326654Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:49647815a0da5a59822dea1a2877184ea37298bc996552b49942be9d6dbf82b9","observation_id":"c6cb0186-e725-4e98-bdb6-8b6a6d063d1b","resolution":{"observed_at":"2026-08-10T14:59:48.326654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-16T14:17:47.965208Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-10T14:59:48.329840Z","title":"arXiv preprint arXiv:2402.11187","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.329840Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:e938eb2d8ebfd2febb20ca96f9f084571cfeef8a4d17d46f0156781dc144b66b","observation_id":"c69ce8be-58d2-4e11-bc9a-c3f7eba90d24","resolution":{"observed_at":"2026-08-10T14:59:48.329840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-10T14:59:48.336936Z","title":"arXiv preprint arXiv:2401.02385","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.336936Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:4afe275614ba183e6bd991131a5db483219ce5f225111a9caa8d51fc97d74ebe","observation_id":"57c418fc-d422-42a0-9d67-ab4c55626e42","resolution":{"observed_at":"2026-08-10T14:59:48.336936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-10T14:59:48.340361Z","title":"arXiv preprint arXiv:2205.01068","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.340361Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:f45be72a0445ac929a02cd37b0442a75f4259974a1beff942673c6514d0db65b","observation_id":"0cc733c4-c108-4279-958e-4d34f1faaaf5","resolution":{"observed_at":"2026-08-10T14:59:48.340361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:59:48.673132Z","title":"For zero-shot performance evaluations, we used the ARC-e, ARC-c (Clark et al., 2018), PIQA (Bisk et al., 2020), WinoGrande (Sakaguchi et al., 2021), and HellaSwag (Zellers et al.,","venue":null,"work_id":"5c766b67-ee84-4bcb-8a31-a37a66b5744e","year":2018},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.343955Z"},"links":{"citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:fd9f90c09123cbfad13083de36cf26d6181062102fadea10541dacca3ac53b9f","observation_id":"f1921a86-2b40-4166-ac1b-11252f00cfde","resolution":{"observed_at":"2026-08-10T14:59:48.676276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:59:48.662707Z","title":"For perplexity perfor- mance evaluations, we used the validation MiniP- ile (Kaddour,","venue":null,"work_id":"52a0edbb-9a6e-4e44-8751-457718d0f22a","year":2021},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.347351Z"},"links":{"citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:5b2eddb055ef2f7567e1b915ca242ea8a35bc235afb0a33038de4533bc2df1a8","observation_id":"eb18ec19-2fb0-4e74-a975-2ea1477988df","resolution":{"observed_at":"2026-08-10T14:59:48.666836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:59:48.651120Z","title":null,"venue":null,"work_id":"3e759c10-fe0c-452a-922f-ca0a5baa7e90","year":2020},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.350745Z"},"links":{"citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:10948b376716437df71485cf4ceb550e0cd4709a4f3e415576b154e364e18434","observation_id":"697440f5-e2b3-4665-9975-ccd751f4a3d2","resolution":{"observed_at":"2026-08-10T14:59:48.655850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-10T14:59:48.246704Z","title":"arXiv preprint arXiv:1607.06450","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.246704Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:7453e4ae1c6e407d544d47970f084633510d32c128de846fd4ce5285c479a61e","observation_id":"ac36b88b-c193-4622-8c60-352c07211b0c","resolution":{"observed_at":"2026-08-10T14:59:48.246704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-10T14:59:48.262369Z","title":"arXiv preprint arXiv:1803.05457","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.262369Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:7632e7715ff04ccde8f2a3e3b9999a0e635db35823bd29aaecc8798772c2e370","observation_id":"3be2bc2e-8043-4b15-a740-b14a3c659549","resolution":{"observed_at":"2026-08-10T14:59:48.262369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-10T14:59:48.333160Z","title":"Peiyuan Zhang, Guangtao Zeng, Tianduo Wang, and Wei Lu","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.333160Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:eeda24f9e3122c0af7fdbfb0689cdc5a7551312c47787405301ede64270dde98","observation_id":"765a187d-65ab-4d0a-b874-08c7216758a3","resolution":{"observed_at":"2026-08-10T14:59:48.333160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-10T14:59:48.273551Z","title":"arXiv preprint arXiv:2101.00027","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.273551Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:259a92b5413da7283ba7c03f59d5ba5d45b5ab4a8ddf80ab36f709e6089ccb4d","observation_id":"0be7abd8-2ab4-4ee8-af43-a850c2b04bd8","resolution":{"observed_at":"2026-08-10T14:59:48.273551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04366","last_updated":"2022-02-02T16:39:23Z","snapshot_observed_at":"2026-08-18T09:21:01.141614Z","submitted_at":"2021-10-08T20:22:26Z","title":"Towards a Unified View of Parameter-Efficient Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04366","snapshot_observed_at":"2026-08-10T14:59:48.277091Z","title":"arXiv preprint arXiv:2110.04366","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.277091Z"},"links":{"cited_paper":"/paper/2110.04366","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:fe78d2c6aeaef4842b275c302a875f2534f514d208558f3085108ee638139168","observation_id":"836ca620-f868-4a1c-aaaf-dc40be6eb857","resolution":{"observed_at":"2026-08-10T14:59:48.277091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00112","last_updated":"2022-06-30T21:57:07Z","snapshot_observed_at":"2026-08-18T15:54:54.765131Z","submitted_at":"2022-06-30T21:57:07Z","title":"Language model compression with weighted low-rank factorization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00112","snapshot_observed_at":"2026-08-10T14:59:48.280607Z","title":"arXiv preprint arXiv:2207.00112","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.280607Z"},"links":{"cited_paper":"/paper/2207.00112","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:4b6ebe1883610bfb0256edfeaa8ede5ff84b47a1fd8b0aa6c336b06d3dcbf453","observation_id":"6909fb1c-f9a8-43b1-9b96-497726c1e759","resolution":{"observed_at":"2026-08-10T14:59:48.280607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04916","last_updated":"2024-06-16T08:37:25Z","snapshot_observed_at":"2026-08-17T19:51:48.571122Z","submitted_at":"2023-12-08T09:31:50Z","title":"EE-LLM: Large-Scale Training and Inference of Early-Exit Large Language Models with 3D Parallelism","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04916","snapshot_observed_at":"2026-08-10T14:59:48.258621Z","title":"arXiv preprint arXiv:2312.04916","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.258621Z"},"links":{"cited_paper":"/paper/2312.04916","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:c114fe00459ec09b45ef5d674a88c6dd156d910a55626785e7be232148e98a5a","observation_id":"6765384a-655a-40d2-b6ec-dd16d198f3b6","resolution":{"observed_at":"2026-08-10T14:59:48.258621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-08-16T14:24:10.346445Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-10T14:59:48.242547Z","title":"arXiv preprint arXiv:2401.15024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T14:59:48.242547Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2501.14713"},"observation_digest":"sha256:7360cadd79824b0ffa0bb72f07896dd4955719909c69cec7cbb4106687018741","observation_id":"4c4bb74e-6d21-456f-86f3-308bbb75b210","resolution":{"observed_at":"2026-08-10T14:59:48.242547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.14713","last_updated":"2025-01-31T17:38:07Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T12:41:33.715451Z","submitted_at":"2025-01-24T18:46:37Z","title":"FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2501.14713."}