{"as_of":"2026-08-22T15:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cb91eb8b885540ca19b5c80bb2ec55308773066107f1e34f31e831421883f0f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":41,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:32:56.634579Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T10:27:02.453970Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:97d86474b35791fe09aa49f6fb2a9e8701aaab94708af74dc32f1ffe639db949","observation_id":"d8f3448f-b9e1-4de5-a46c-3d526e8720c1","resolution":{"observed_at":"2026-05-19T20:28:39.513658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2312.05821","last_updated":"2025-08-28T03:57:52Z","snapshot_observed_at":"2026-08-16T15:03:40.750477Z","submitted_at":"2023-12-10T08:41:24Z","title":"ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T13:49:33.747672Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2312.05821"},"observation_digest":"sha256:a9f17cd3982eb5812dc61118cfd31d6f1778976a406375b2d3976be31effb0fc","observation_id":"8b58d1ef-d214-4a57-a24c-d79e8a360122","resolution":{"observed_at":"2026-05-20T13:49:33.798725Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T07:21:39.440092Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2404.13501"},"observation_digest":"sha256:bdabcc59bcfc84914d7431f91f0e7e029e33a4e9ac0ba19f6d19cc90892b2eb5","observation_id":"59122b54-0682-4aa6-b875-1e5d83f2fc3d","resolution":{"observed_at":"2026-05-15T07:21:39.766166Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:2922da43308a4c41d45c35be978417eadb04a8895059effb553413e20809e636","observation_id":"b02219e1-bafa-4922-8f5d-9e28b6c42605","resolution":{"observed_at":"2026-05-15T02:39:33.407076Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2411.10656","last_updated":"2026-04-03T16:24:12Z","snapshot_observed_at":"2026-07-06T19:51:14.080262Z","submitted_at":"2024-11-16T01:31:29Z","title":"Precision or Peril: A PoC of Python Code Quality from Quantized Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T17:30:54.204300Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2411.10656"},"observation_digest":"sha256:4899f566744e3182ac9a5a02fd5c645caefcc41a1dacb5e0e585ee064f9857f3","observation_id":"31a3178f-e27a-4e1e-a219-9cdbfa558d95","resolution":{"observed_at":"2026-05-23T17:33:15.813455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T22:41:16.084747Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03220","last_updated":"2024-12-04T11:14:06Z","snapshot_observed_at":"2026-08-20T09:06:11.582266Z","submitted_at":"2024-12-04T11:14:06Z","title":"Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.084747Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.03220"},"observation_digest":"sha256:2019c4fe82a6ebe739d5cf1271fd9df28ecde2c03c02c6e31a61e06758df4f08","observation_id":"b4d59a57-c4c1-485d-9f12-a06f45e2ba99","resolution":{"observed_at":"2026-08-11T22:41:16.084747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T16:39:23.881220Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09906","last_updated":"2024-12-13T06:45:26Z","snapshot_observed_at":"2026-08-20T03:16:23.568993Z","submitted_at":"2024-12-13T06:45:26Z","title":"Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T16:39:23.881220Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.09906"},"observation_digest":"sha256:291e6343ac5e693fde01cd1b4036f5ee84285e09b0d9d959c1a9b0e0e04a2bc1","observation_id":"6866c6f5-87f5-49a8-91e2-eeeb265f4393","resolution":{"observed_at":"2026-08-11T16:39:23.881220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T13:56:39.803614Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12639","last_updated":"2025-04-22T07:32:21Z","snapshot_observed_at":"2026-08-17T17:25:57.432782Z","submitted_at":"2024-12-17T08:02:08Z","title":"Falcon: Faster and Parallel Inference of Large Language Models through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding Tree","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T13:56:39.803614Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.12639"},"observation_digest":"sha256:d9d2ac9c794f2c778b53c59b345bec3dace7ae0a11b30c682394efb1fa9fe282","observation_id":"b884096a-6e81-40bd-ac00-1248f41f1541","resolution":{"observed_at":"2026-08-11T13:56:39.803614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T11:12:57.956319Z","title":"The Chief Executive Officer (CEO","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-18T08:35:07.340488Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.956319Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:8c8cb183558db6100ebf272b3120c0bc1b4b9c449c4387985d3c37c991030584","observation_id":"1587f2f9-a5d6-4e24-9ea5-e37b9dc581d4","resolution":{"observed_at":"2026-08-11T11:12:57.956319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T11:02:15.567076Z","title":"Asurveyonmodelcompressionforlargelanguagemodels","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15921","last_updated":"2025-04-23T23:24:01Z","snapshot_observed_at":"2026-08-14T01:20:10.531199Z","submitted_at":"2024-12-20T14:13:09Z","title":"Less is More: Towards Green Code Large Language Models via Unified Structural Pruning","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T11:02:15.567076Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.15921"},"observation_digest":"sha256:97a8b29649ed5f43616174df722c98d4cfc8642ac314e23aac101c06069bbcae","observation_id":"f8eeb740-8275-4448-9872-aa2df0f1b310","resolution":{"observed_at":"2026-08-11T11:02:15.567076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T00:38:46.086396Z","title":"A survey on model compression for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-20T14:01:46.841630Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T00:38:46.086396Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.19442"},"observation_digest":"sha256:583028370a451ec9c1a375a681824ef5fc40f40fb464c37af9b20b04f5da7739","observation_id":"3b6ef9c0-23d0-4660-b75d-acf611118b0c","resolution":{"observed_at":"2026-08-11T00:38:46.086396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-10T22:34:34.996716Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01277","last_updated":"2025-01-03T14:55:21Z","snapshot_observed_at":"2026-08-18T07:36:04.149842Z","submitted_at":"2025-01-02T14:20:36Z","title":"Language Models for Code Optimization: Survey, Challenges and Future Directions","version":2},"reference_index":164,"source":"pdf_text","source_observed_at":"2026-08-10T22:34:34.996716Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2501.01277"},"observation_digest":"sha256:52fa298f642084943d15230bb67289c80bef0f0c43548d42b535e8a7eb66df5d","observation_id":"400b2c5d-d868-458e-a8e8-7ce1d612126f","resolution":{"observed_at":"2026-08-10T22:34:34.996716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-10T21:42:07.120928Z","title":"A survey on model compression for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04304","last_updated":"2025-02-12T10:49:40Z","snapshot_observed_at":"2026-08-16T13:38:37.744040Z","submitted_at":"2025-01-08T06:30:31Z","title":"DGQ: Distribution-Aware Group Quantization for Text-to-Image Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:42:07.120928Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2501.04304"},"observation_digest":"sha256:7064d8dc5e2ea75d4fd9667a377a7317d7e96164d17b83b59e1dad24d6a1e242","observation_id":"df5e3aaf-90c4-4d66-8e13-21477903f164","resolution":{"observed_at":"2026-08-10T21:42:07.120928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-10T22:04:24.345837Z","title":"A survey on model compression for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.06218","last_updated":"2025-01-06T14:23:07Z","snapshot_observed_at":"2026-08-11T17:50:50.228595Z","submitted_at":"2025-01-06T14:23:07Z","title":"Dissecting Bit-Level Scaling Laws in Quantizing Vision Generative Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:04:24.345837Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2501.06218"},"observation_digest":"sha256:b1ee89896fe46f3d87ff6fa739937aa4be53ccef219e809ee332ad3b8c0f9efc","observation_id":"b24bd678-0a1e-400c-98e9-474510a532af","resolution":{"observed_at":"2026-08-10T22:04:24.345837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-10T20:14:57.778355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09107","last_updated":"2025-01-15T19:44:15Z","snapshot_observed_at":"2026-08-19T14:44:56.853227Z","submitted_at":"2025-01-15T19:44:15Z","title":"Rethinking Post-Training Quantization: Introducing a Statistical Pre-Calibration Approach","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T20:14:57.778355Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2501.09107"},"observation_digest":"sha256:de59a2de8ea87ac0391e89f776638fe3cae960081c6eb6eabe464884cd274aa3","observation_id":"a1440eb5-360b-4b70-a7c7-3cf432871322","resolution":{"observed_at":"2026-08-10T20:14:57.778355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-09T04:23:34.653159Z","title":"A survey on model com- pression for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03617","last_updated":"2025-02-05T21:06:30Z","snapshot_observed_at":"2026-08-20T06:32:38.432035Z","submitted_at":"2025-02-05T21:06:30Z","title":"Resource-Efficient & Effective Code Summarization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T04:23:34.653159Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2502.03617"},"observation_digest":"sha256:cf83d9ac55346e0a11500944fad291645824c387dc2b7dda530e8a3cb2e6e709","observation_id":"a678d389-27c7-4661-a1d2-98018ce12462","resolution":{"observed_at":"2026-08-09T04:23:34.653159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-08T13:36:24.795641Z","title":"A survey on model compression for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07184","last_updated":"2025-02-11T02:19:13Z","snapshot_observed_at":"2026-08-20T00:33:57.859891Z","submitted_at":"2025-02-11T02:19:13Z","title":"Refine Knowledge of Large Language Models via Adaptive Contrastive Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T13:36:24.795641Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2502.07184"},"observation_digest":"sha256:a32b8a136426331fd4ca9f55f275a5cc160938680672147cf954e9229e639c1d","observation_id":"780e26fb-6a48-4fd6-ab9a-87f207ed756b","resolution":{"observed_at":"2026-08-08T13:36:24.795641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-15T21:55:07.904113Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08620","last_updated":"2025-05-13T14:39:33Z","snapshot_observed_at":"2026-08-21T03:17:44.124609Z","submitted_at":"2025-05-13T14:39:33Z","title":"Resource-Efficient Language Models: Quantization for Fast and Accessible Inference","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T21:55:07.904113Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2505.08620"},"observation_digest":"sha256:1e80ee3e284cf54643cd18f11f23ada158c6fef9ce45f331f50bf24d4f01f873","observation_id":"5f175c5c-0b68-40bc-82a2-495a124fb0cb","resolution":{"observed_at":"2026-08-15T21:55:07.904113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-15T21:10:20.246851Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10640","last_updated":"2025-06-02T20:08:34Z","snapshot_observed_at":"2026-08-18T09:36:23.346739Z","submitted_at":"2025-05-15T18:22:45Z","title":"The Hitchhikers Guide to Production-ready Trustworthy Foundation Model powered Software (FMware)","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-15T21:10:20.246851Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2505.10640"},"observation_digest":"sha256:7015474cceaa2e31467d68407cf4a9f5986da7223aa20ed4a577bb4e3a28cb97","observation_id":"d2b5f896-08da-44e7-9896-d7520c679690","resolution":{"observed_at":"2026-08-15T21:10:20.246851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T15:22:20.791559Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15442","last_updated":"2025-08-04T12:03:51Z","snapshot_observed_at":"2026-08-13T02:07:45.963947Z","submitted_at":"2025-05-21T12:23:32Z","title":"On the Generalization vs Fidelity Paradox in Knowledge Distillation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:22:20.791559Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2505.15442"},"observation_digest":"sha256:c7b9442a6673eae72081551485bbb38cb29c30898171b2cf4bca6cfb570dcf90","observation_id":"ba3600f1-79c8-4469-9147-29081cf8dac9","resolution":{"observed_at":"2026-08-07T15:22:20.791559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T15:09:28.068308Z","title":"A survey on model compression for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16210","last_updated":"2025-05-22T04:23:19Z","snapshot_observed_at":"2026-08-19T14:47:55.606245Z","submitted_at":"2025-05-22T04:23:19Z","title":"NQKV: A KV Cache Quantization Scheme Based on Normal Distribution Characteristics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.068308Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2505.16210"},"observation_digest":"sha256:d0bb7feacbff761d208734c42211ac5379689f55b57518b2fd7cf9fd2867425c","observation_id":"35d1fb85-9e6b-4e03-bb04-4cf406c1c24d","resolution":{"observed_at":"2026-08-07T15:09:28.068308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T14:21:59.265594Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19349","last_updated":"2025-08-08T10:00:47Z","snapshot_observed_at":"2026-08-14T05:39:07.622413Z","submitted_at":"2025-05-25T22:32:35Z","title":"DECA: A Near-Core LLM Decompression Accelerator Grounded on a 3D Roofline Model","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T14:21:59.265594Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2505.19349"},"observation_digest":"sha256:549eb58a2710298417c00a821b1e2c5fd8ebbb4291ee5ca2129e378747ffaee9","observation_id":"b62bf205-1d45-4324-88d6-cd9ac7e21163","resolution":{"observed_at":"2026-08-07T14:21:59.265594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-15T22:32:56.634579Z","title":"A Survey on Model Compression for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-20T11:22:02.250012Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.634579Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:c1cf0f08c8f7b749212127b008e0ea4ed1e6d2740ce8ca17eeae175360c1c75f","observation_id":"f897c398-904e-43bf-9df3-7e7471abb794","resolution":{"observed_at":"2026-08-15T22:32:56.634579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T11:27:17.032377Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02561","last_updated":"2025-06-03T07:47:30Z","snapshot_observed_at":"2026-08-13T13:46:32.096470Z","submitted_at":"2025-06-03T07:47:30Z","title":"Pruning General Large Language Models into Customized Expert Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:17.032377Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2506.02561"},"observation_digest":"sha256:be4486e80fae7280eca1c08ac6968c2b4c442d2af62b7253ce4150edbb23b208","observation_id":"8b6e608d-ad4e-4c43-b58e-9b8b51284001","resolution":{"observed_at":"2026-08-07T11:27:17.032377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T04:59:18.685207Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-21T11:39:17.159142Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.685207Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:d5027aab3f63ef1abfadc41dae12be066439a0d3acc27d4b208d7fac9c69d412","observation_id":"fcbefac7-491d-4fa1-bdf5-25b2764ff8b6","resolution":{"observed_at":"2026-08-07T04:59:18.685207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-06T18:10:15.773624Z","title":"A survey on model compression for large lan- guage models.CoRR, abs/2308.07633, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09003","last_updated":"2026-06-21T22:09:56Z","snapshot_observed_at":"2026-08-08T17:45:21.502689Z","submitted_at":"2025-07-11T20:11:04Z","title":"Orchestration for Domain-specific Edge-Cloud Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.773624Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2507.09003"},"observation_digest":"sha256:e47cce695e7effb55241e0be7c687a6f66791489771d03258560fb27eac0c7fd","observation_id":"7c0818d5-62e2-48eb-b4dd-f23930c15f86","resolution":{"observed_at":"2026-08-06T18:10:15.773624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-06T11:06:14.262804Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23147","last_updated":"2025-07-30T22:50:52Z","snapshot_observed_at":"2026-08-08T13:02:05.305998Z","submitted_at":"2025-07-30T22:50:52Z","title":"Foundation Models for Clean Energy Forecasting: A Comprehensive Review","version":1},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-08-06T11:06:14.262804Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2507.23147"},"observation_digest":"sha256:13a886f634b7cffe806ee8f53ac9d2b8da12f3bc981a0ded4d83d2c0630c1f1e","observation_id":"78cde938-e477-4afe-993b-9d13f98a60d5","resolution":{"observed_at":"2026-08-06T11:06:14.262804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2508.04853","last_updated":"2026-04-09T18:24:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-06T20:00:40Z","title":"Provable Post-Training Quantization: Theoretical Analysis of OPTQ and Qronos","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T23:52:06.036879Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2508.04853"},"observation_digest":"sha256:e278b39be87d798b723776fcf033aeeb078e96064964972692dcf31d31bf8daf","observation_id":"238f9b56-ae31-49ca-8e7c-3ed76c57da8d","resolution":{"observed_at":"2026-05-18T23:52:53.084202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-05T12:52:01.733295Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01221","last_updated":"2025-09-04T09:30:16Z","snapshot_observed_at":"2026-08-17T04:57:29.549935Z","submitted_at":"2025-09-01T08:06:49Z","title":"DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T12:52:01.733295Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2509.01221"},"observation_digest":"sha256:b327d90e268c5dc7f8bf84c20d2017e4cb587b96a30f765094068caf3eb74473","observation_id":"7d1220cd-4c89-4ff3-8003-db1ce7f96456","resolution":{"observed_at":"2026-08-05T12:52:01.733295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-04T19:47:08.878839Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09090","last_updated":"2025-09-11T01:52:25Z","snapshot_observed_at":"2026-08-20T12:51:33.981228Z","submitted_at":"2025-09-11T01:52:25Z","title":"SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T19:47:08.878839Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2509.09090"},"observation_digest":"sha256:854b5591a36598ce944cb224d1707fde6c43104ffc1059f5774012fff70738cf","observation_id":"fff96ee7-9324-463c-a844-b2e7dfdc9fd9","resolution":{"observed_at":"2026-08-04T19:47:08.878839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-08-15T08:59:56.241757Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-21T18:46:04.926179Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:f3dd2b8795eab3b4538db4521fdeb9e0acc9e1a28f6b9176ed637a7fea7f7168","observation_id":"30436d1e-7f56-45b3-8f4b-988c1fb393aa","resolution":{"observed_at":"2026-05-21T18:50:30.264426Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-03T23:21:42.473083Z","title":"A survey on model compression for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-08-15T08:59:56.241757Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":4},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-03T23:21:42.473083Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:b7c6232d8c5410756c909e9f9398a9939669b345ebdc28763dd2887d072c97f0","observation_id":"57ffe698-dbd2-49b9-a9e5-2008e7ac393f","resolution":{"observed_at":"2026-08-03T23:21:42.473083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2512.22671","last_updated":"2026-05-06T11:17:35Z","snapshot_observed_at":"2026-08-16T08:59:38.926542Z","submitted_at":"2025-12-27T18:09:57Z","title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T18:55:48.540435Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2512.22671"},"observation_digest":"sha256:99769fb45588bf6d328ab51f1434acb2c8c3344950cbde2631e4ec3679026b17","observation_id":"14994c42-d4de-4a2c-9588-84ebfe2588af","resolution":{"observed_at":"2026-05-16T18:58:18.985436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2604.04013","last_updated":"2026-04-05T08:04:39Z","snapshot_observed_at":"2026-08-11T09:45:12.224702Z","submitted_at":"2026-04-05T08:04:39Z","title":"RUQuant: Towards Refining Uniform Quantization for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:53.861234Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2604.04013"},"observation_digest":"sha256:1a10922dd1934c82a2e6fa62a1a72a353331caac5227c2c7b790a20351e4057b","observation_id":"74b55445-88d2-4dbf-a640-99136f0522e9","resolution":{"observed_at":"2026-05-13T17:38:02.576780Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2604.10091","last_updated":"2026-04-11T08:23:50Z","snapshot_observed_at":"2026-08-18T10:52:43.203417Z","submitted_at":"2026-04-11T08:23:50Z","title":"SEPTQ: A Simple and Effective Post-Training Quantization Paradigm for Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T16:35:28.861765Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2604.10091"},"observation_digest":"sha256:add92466a76f3a6e34caf6798222190cfa77146247ccc80c9ce3b135c8db75fa","observation_id":"08831974-50de-4a11-b9ff-6b4180f8386e","resolution":{"observed_at":"2026-05-11T08:30:58.360484Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2605.15104","last_updated":"2026-05-20T10:20:54Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:22:42Z","title":"From Text to Voice: A Reproducible and Verifiable Framework for Evaluating Tool Calling LLM Agents","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-21T08:45:56.550821Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2605.15104"},"observation_digest":"sha256:59435ebd3d7e0c76e5fb7aac55c900459b8ec279c1221f49df90f61aa1e8b25d","observation_id":"c5b9396d-2f3b-48de-a3f5-2244ffcfe9bf","resolution":{"observed_at":"2026-05-21T08:49:53.710035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2606.28529","last_updated":"2026-06-30T06:26:23Z","snapshot_observed_at":"2026-07-07T00:02:38.226622Z","submitted_at":"2026-06-26T18:28:52Z","title":"The Speedup Paradox: Rethinking Inference Speed-Quality Trade-off in Embodied Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T01:10:12.636354Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2606.28529"},"observation_digest":"sha256:6cb2a86f53d127258dd37fae9619f7b2bf708bd73100853226293c2f9fb15089","observation_id":"31c07307-c8ae-4e6b-8859-c33106133de0","resolution":{"observed_at":"2026-07-01T15:45:48.357172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2606.28529","last_updated":"2026-06-30T06:26:23Z","snapshot_observed_at":"2026-07-07T00:02:38.226622Z","submitted_at":"2026-06-26T18:28:52Z","title":"The Speedup Paradox: Rethinking Inference Speed-Quality Trade-off in Embodied Tasks","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:54.229184Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2606.28529"},"observation_digest":"sha256:99cc3d63cc3eb78b5e9d9d18bab205a8756a718c77c61b5d184c8921dbde67a0","observation_id":"364cfd3a-c27d-4f3b-a42b-c0bd24d3cac8","resolution":{"observed_at":"2026-07-01T09:35:40.072846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":"2308.07633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-07-10T10:27:02.453970Z","title":"arXiv:2308.07633 [cs] 23","venue":"cs.CL","work_id":"7da0321b-9a97-47d5-8343-b50e0c426a87","year":2023},"citing_paper":{"arxiv_id":"2607.08268","last_updated":"2026-07-09T09:10:49Z","snapshot_observed_at":"2026-08-20T10:40:52.263302Z","submitted_at":"2026-07-09T09:10:49Z","title":"Different Teachers, Different Capabilities: Sub-1B On-Device Distillation for Structured Text Enrichment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T10:20:46.103409Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2607.08268"},"observation_digest":"sha256:b38d3113a814dd5da97f560a87bad31358d79d10c3c3181683650f406cf05983","observation_id":"fb8fe8b2-24f6-4156-b72f-1ae9f5be74b7","resolution":{"observed_at":"2026-07-10T10:27:02.455290Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-02T03:32:51.526085Z","title":"A survey on model com- pression for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14181","last_updated":"2026-07-15T14:05:33Z","snapshot_observed_at":"2026-08-18T06:45:06.018281Z","submitted_at":"2026-07-15T14:05:33Z","title":"Quantize with Confidence? An Empirical Study of Quantization for Code Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T03:32:51.526085Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2607.14181"},"observation_digest":"sha256:3933acb118892a5d9c5c7214b5844e2857c3f3d302f3f1e66cd4d525bc57e252","observation_id":"fc7b565d-8c03-4e38-a086-8fc79abf8b4b","resolution":{"observed_at":"2026-08-02T03:32:51.526085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-15T19:58:17.591834Z","title":"A survey on model compression for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-22T11:14:28.285480Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.591834Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:877a558a25404ac4d494cc81ff91f76e07750f2da416fa54e910a9b4f22c8262","observation_id":"d7ad915d-16b2-4492-a0cb-307eb22ecf6c","resolution":{"observed_at":"2026-08-15T19:58:17.591834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2308.07633/citation-record","integrity":"/paper/2308.07633/integrity","json":"/paper/2308.07633/citation-record.json","paper":"/paper/2308.07633"},"outbound":[],"paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T13:56:58.738793Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 41 inbound Pith citation observations for arXiv:2308.07633."}