{"as_of":"2026-08-12T10:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a14fd8a7f0cbb011f6c8040f7c7d6e08103611fdb1a3a0231ac4065d7f224d80","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:26:08.062641Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.08631/citation-record","integrity":"/paper/2501.08631/integrity","json":"/paper/2501.08631/citation-record.json","paper":"/paper/2501.08631"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:07.839362Z","title":"Revolutionizing finance with llms: An overview of applications and insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.839362Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:62ef28385f00fe85d5201ce214c1db99eb7131c496f1547ae3dca03e04e168b2","observation_id":"e1f12d4d-78db-4f2a-9cce-46c3eaad71a2","resolution":{"observed_at":"2026-08-10T20:26:07.839362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18105","last_updated":"2024-04-01T18:47:45Z","snapshot_observed_at":"2026-08-11T18:51:56.106994Z","submitted_at":"2024-03-26T21:04:29Z","title":"Large Language Models for Education: A Survey and Outlook","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18105","snapshot_observed_at":"2026-08-10T20:26:07.846565Z","title":"Large language models for education: A survey and outlook,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.846565Z"},"links":{"cited_paper":"/paper/2403.18105","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:458735362c8c5973115ba19329f69cb64fdb8608bbbc3afc0407f18a973460cf","observation_id":"cee109ef-cdcc-4a03-a23f-bea3e37a4db9","resolution":{"observed_at":"2026-08-10T20:26:07.846565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-10T20:26:07.852154Z","title":"A survey on large language models for code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.852154Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:71f7fda0b53d953283ec9bf4231375ec210883e411a122a8372fd5773562a928","observation_id":"8cfdb49f-c5e8-43e7-964b-1182438e6533","resolution":{"observed_at":"2026-08-10T20:26:07.852154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:07.857957Z","title":"A survey on model compression for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.857957Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:b82047a22a112ca28dc31945d796f33cf40e9f626d18ed2b57689fad9445d6e6","observation_id":"e7b28c28-21ac-4bae-9d79-f41d6dd1c72e","resolution":{"observed_at":"2026-08-10T20:26:07.857957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:08.497101Z","title":"Numerical inverting of matrices of high order,","venue":null,"work_id":"5ab44166-7a34-4322-9404-eb455d4f28f7","year":1947},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.863815Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:c08d895983e7becf51f055d5d0d1079670d88f6cf43ac9572826d0e4b181cc32","observation_id":"51626a63-3c1f-4787-a4ef-585353eda1ed","resolution":{"observed_at":"2026-08-10T20:26:08.505425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-10T20:26:07.869064Z","title":"Llm-qat: Data-free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.869064Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:b08567606211a052600b1c96e576cae1ec7ef8b90f66a5d77bee1f61e7266813","observation_id":"481751bf-a3bd-4deb-b46c-a7f9016bfe4a","resolution":{"observed_at":"2026-08-10T20:26:07.869064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-10T20:26:07.875146Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.875146Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:6100863c1ef72c05dc65e2de91707af39919caf7678d3bf4bae2900e18654cef","observation_id":"a38f4cd1-54ca-4fbe-bc20-0a87b76b0a8f","resolution":{"observed_at":"2026-08-10T20:26:07.875146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:07.880513Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.880513Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:ebc6adc2eeeadcb213111f19607d0c0a5679062c11717a86d6be6578cb648c11","observation_id":"aa536d37-22a9-4432-a44d-c4241737690f","resolution":{"observed_at":"2026-08-10T20:26:07.880513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01721","last_updated":"2024-11-01T17:12:53Z","snapshot_observed_at":"2026-08-12T07:14:53.124272Z","submitted_at":"2024-06-03T18:27:44Z","title":"DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01721","snapshot_observed_at":"2026-08-10T20:26:07.885508Z","title":"Duquant: Distributing outliers via dual transformation makes stronger quantized llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.885508Z"},"links":{"cited_paper":"/paper/2406.01721","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:771f0a0a496a873a2e54e62ae1f5aac71f21e3265f81b3b35157a9106371624e","observation_id":"e2dbad6e-ef01-4042-99c0-d774ddf74940","resolution":{"observed_at":"2026-08-10T20:26:07.885508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:07.890701Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.890701Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:c2a746581167ea69d70268144ccb913ec8730a5ac03eaf1b505a30f1185b2dc4","observation_id":"7df9f665-c903-46e9-8c88-5635d0e1a197","resolution":{"observed_at":"2026-08-10T20:26:07.890701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-10T20:26:07.895750Z","title":"A simple and effective pruning approach for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.895750Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:ac4aa496ee55e365e82b3463690a4856a89bdefe7d859e9667a575b97dc9460b","observation_id":"40aad758-31c1-49a5-bae9-cdc02e67cfbb","resolution":{"observed_at":"2026-08-10T20:26:07.895750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:07.901237Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:07.901237Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:e8b8ff843049b620f2cf7d862a401c31e9b10eee2f1511cf652a763a8181289d","observation_id":"bd905df3-8843-4c6f-8018-19eb610261ab","resolution":{"observed_at":"2026-08-10T20:26:07.901237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-10T20:26:08.007768Z","title":"Shortgpt: Layers in large language models are more redundant than you expect,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.007768Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:dc6f9b023ecedf61b86bc8b1d5ef06970c8404fd048a70d9b8f9d2572f3e7dbc","observation_id":"674326f4-9ab6-4b02-acf3-d0b6960d9f59","resolution":{"observed_at":"2026-08-10T20:26:08.007768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-08-10T02:12:11.712418Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-08-10T20:26:08.013772Z","title":"In-context learning dis- tillation: Transferring few-shot learning ability of pre-trained language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.013772Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:fdd539303a5e110bab93b06e8edaaa452534dfd473eda5719faf1aa6fde3ce97","observation_id":"0cc136d8-6def-4888-bd79-eb324c576391","resolution":{"observed_at":"2026-08-10T20:26:08.013772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06726","last_updated":"2022-10-13T04:50:02Z","snapshot_observed_at":"2026-07-06T14:04:32.971017Z","submitted_at":"2022-10-13T04:50:02Z","title":"Explanations from Large Language Models Make Small Reasoners Better","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06726","snapshot_observed_at":"2026-08-10T20:26:08.019296Z","title":"Explanations from large language models make small reasoners better,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.019296Z"},"links":{"cited_paper":"/paper/2210.06726","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:c82639b28364019442297d1cff704128b2e36d80dbfd6f3402528876147f89dc","observation_id":"8d2c62c0-7471-4531-a054-7d757eff56eb","resolution":{"observed_at":"2026-08-10T20:26:08.019296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12870","last_updated":"2023-10-14T02:21:24Z","snapshot_observed_at":"2026-07-06T15:30:34.082083Z","submitted_at":"2023-05-22T09:49:16Z","title":"Lion: Adversarial Distillation of Proprietary Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12870","snapshot_observed_at":"2026-08-10T20:26:08.024770Z","title":"Lion: Adversarial distillation of proprietary large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.024770Z"},"links":{"cited_paper":"/paper/2305.12870","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:6a1474692a8a22e20a44eceee9e289f14f5c892f9c553b2663da83ef99bf47f0","observation_id":"998374fb-f5a0-4c7d-bbc9-cf80d1727bd6","resolution":{"observed_at":"2026-08-10T20:26:08.024770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:08.029800Z","title":"Minillm: Knowledge distillation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.029800Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:4a126a0b5e0f1927ddd96a7f3a49cf6885556c2756c40a285ca5e1031f78e140","observation_id":"0984919a-92df-4671-902c-e6885c67d4b4","resolution":{"observed_at":"2026-08-10T20:26:08.029800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13649","last_updated":"2024-01-17T03:23:23Z","snapshot_observed_at":"2026-08-06T11:19:43.438106Z","submitted_at":"2023-06-23T17:56:26Z","title":"On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13649","snapshot_observed_at":"2026-08-10T20:26:08.035288Z","title":"On-policy distillation of language models: Learning from self-generated mistakes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.035288Z"},"links":{"cited_paper":"/paper/2306.13649","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:53899118881a24d6e616d9d023018569e4e8e869d5c791eaaaec3b0e992fd403","observation_id":"45175c5c-bc4a-426f-aeb9-e45bea7c0ef1","resolution":{"observed_at":"2026-08-10T20:26:08.035288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18403","last_updated":"2024-08-07T03:30:30Z","snapshot_observed_at":"2026-08-09T12:33:50.387527Z","submitted_at":"2023-05-28T15:15:48Z","title":"LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18403","snapshot_observed_at":"2026-08-10T20:26:08.041243Z","title":"Loraprune: Structured pruning meets low-rank parameter-efficient fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.041243Z"},"links":{"cited_paper":"/paper/2305.18403","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:c4458f8ef8b06c8d1d83d4d2390f400b01c43ae5786c135d76431d38f18aa981","observation_id":"6c6b9e71-c560-40b6-b474-1bacc8d39ea0","resolution":{"observed_at":"2026-08-10T20:26:08.041243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09782","last_updated":"2023-07-20T18:47:20Z","snapshot_observed_at":"2026-07-06T15:55:45.131112Z","submitted_at":"2023-07-19T06:58:03Z","title":"ZeroQuant-FP: A Leap Forward in LLMs Post-Training W4A8 Quantization Using Floating-Point Formats","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09782","snapshot_observed_at":"2026-08-10T20:26:08.046838Z","title":"Zeroquant-fp: A leap forward in llms post-training w4a8 quantization using floating-point formats,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.046838Z"},"links":{"cited_paper":"/paper/2307.09782","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:7484af103598ae94827c3d792f68a51174091a3af239e00b397547276e788379","observation_id":"08d8719c-c36f-46f0-b112-4e3205a59b5c","resolution":{"observed_at":"2026-08-10T20:26:08.046838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:26:08.052760Z","title":"Product quantization for nearest neighbor search,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.052760Z"},"links":{"citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:0634508e7180c5ccc42346f2b75d1a7ded7cf7a63089a810ebf2986d452e10a6","observation_id":"d9cdc088-3b44-480b-923d-97d694c9b1ff","resolution":{"observed_at":"2026-08-10T20:26:08.052760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T20:26:08.057819Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.057819Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:780243f1f34309d1a0d82aae58ec2b95904923994bb1b0678ad068465c4ccb89","observation_id":"44a04f24-677f-4043-ae64-3e1120354f9f","resolution":{"observed_at":"2026-08-10T20:26:08.057819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-10T20:26:08.062641Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:08.062641Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2501.08631"},"observation_digest":"sha256:a9e37219bee8ed70a9e2257dc4b2e0bcc6aa47993494a91f0391c395ad40dabe","observation_id":"32d5127c-e3dc-4ab8-891e-7c2c432df608","resolution":{"observed_at":"2026-08-10T20:26:08.062641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08631","last_updated":"2025-01-15T07:36:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T20:18:54.055609Z","submitted_at":"2025-01-15T07:36:19Z","title":"SWSC: Shared Weight for Similar Channel in LLM"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2501.08631."}