{"as_of":"2026-08-17T17:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4aabfe11956853889bf9709dae6bbc21e44768aa41152f796c0b4260648702d8","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:57:27.662321Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.11494/citation-record","integrity":"/paper/2412.11494/integrity","json":"/paper/2412.11494/citation-record.json","paper":"/paper/2412.11494"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.16635","last_updated":"2024-10-17T15:45:10Z","snapshot_observed_at":"2026-08-16T13:40:08.649187Z","submitted_at":"2024-06-24T13:41:08Z","title":"ShadowLLM: Predictor-based Contextual Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16635","snapshot_observed_at":"2026-08-11T14:57:27.473508Z","title":"Shadowllm: Predictor-based contextual sparsity for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.473508Z"},"links":{"cited_paper":"/paper/2406.16635","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:eb69a9d2c4b7614d9d06a155995f1883d03c6d7a18d8077d4dbbdbd102813652","observation_id":"7926d214-59c4-4cd2-bca8-31cd32be2505","resolution":{"observed_at":"2026-08-11T14:57:27.473508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T14:57:27.486293Z","title":"Qwen technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.486293Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:03bc7857bde01b008e182d968d66160516d4f13886fec334e2c7e43f7518b7cc","observation_id":"a7bdb73e-6078-4d49-82c8-51007da723d5","resolution":{"observed_at":"2026-08-11T14:57:27.486293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T14:57:27.500046Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.500046Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:5bcdda05557704cc6e257dd8b0dca82736c7977a708b38cd00e80a38b4710ac6","observation_id":"1c7bfb07-0cff-4a6b-8d35-d8eb84518be2","resolution":{"observed_at":"2026-08-11T14:57:27.500046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:57:28.242939Z","title":"Depth-adaptive transformer","venue":null,"work_id":"15b91959-4e5a-4ecb-900b-284e8ff12ceb","year":2020},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.506450Z"},"links":{"citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:2b58b1167cd11ffa36e93ada1a8be6e78ba058cb123535479bb3fd81d57ac278","observation_id":"f5b9775c-3092-44b3-b88b-261dd267c354","resolution":{"observed_at":"2026-08-11T14:57:28.248298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:57:28.200271Z","title":"Xl-sum: Large-scale multilingual abstractive sum- marization for 44 languages","venue":null,"work_id":"44a9340e-26b3-46f1-ac52-d97f771f4f19","year":2021},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.518948Z"},"links":{"citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:adcfc40332677e01a2f4d006994d9624c38278eeda8520d7b15eae8988ea0b35","observation_id":"62446f61-58ac-4d4b-8ad4-bbe5ca743ca7","resolution":{"observed_at":"2026-08-11T14:57:28.208486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-08-16T16:07:07.831142Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-08-11T14:57:27.531592Z","title":"In-context learning distilla- tion: Transferring few-shot learning ability of pre-trained language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.531592Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:5050671fbd51c7f0f64727c2498a6ea8372407435d91bf05133e72c68301706c","observation_id":"25d8cfc8-71b8-43a1-95fd-c03e21235ad9","resolution":{"observed_at":"2026-08-11T14:57:27.531592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-16T14:53:38.585468Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-11T14:57:27.555568Z","title":"Losparse: Structured compression of large language models based on low-rank and sparse approx- imation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.555568Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:e95171378227dd44fa819cd01e0331ced8634eb6e3f8c20b672162976d93c0f4","observation_id":"4a3dc63c-b151-4cc7-9af2-8ce3db85edf4","resolution":{"observed_at":"2026-08-11T14:57:27.555568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00749","last_updated":"2022-04-25T10:38:17Z","snapshot_observed_at":"2026-08-16T18:34:22.978585Z","submitted_at":"2021-04-01T20:01:57Z","title":"Anytime Dense Prediction with Confidence Adaptivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.00749","snapshot_observed_at":"2026-08-11T14:57:27.561796Z","title":"Anytime dense pre- diction with confidence adaptivity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.561796Z"},"links":{"cited_paper":"/paper/2104.00749","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:0727a80a5c262f59ea5f1cd8fdf7f78ebd17bbbf762f6a02eaeb4198dc693749","observation_id":"67c9036e-5de3-41e4-b7de-e19a01a168a0","resolution":{"observed_at":"2026-08-11T14:57:27.561796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-16T14:12:14.696997Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-11T14:57:27.571589Z","title":"Shortgpt: Layers in large language models are more redundant than you expect","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.571589Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:d3748e257bb0af11f182e685607727e2a6d85262f02f3cf3dd241e08b183a707","observation_id":"6b1b3ced-a91b-4af7-87cd-a40c25ab7436","resolution":{"observed_at":"2026-08-11T14:57:27.571589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-11T14:57:27.579545Z","title":"Large language models: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.579545Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:dfec0bf6ee2c606c79cb70936f4e4a7ab25cc4672f8dfaee2b8aa55c39f29c27","observation_id":"82328b29-be81-4e2c-9672-8a8193e307d9","resolution":{"observed_at":"2026-08-11T14:57:27.579545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-08-17T04:55:07.787141Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-11T14:57:27.587037Z","title":"Mixture-of-depths: Dynamically allocating compute in transformer-based lan- guage models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.587037Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:e1bec7472b0be6a5c2749099afe21797a0e0fa1364dd899ce421f223249165d5","observation_id":"567129bf-90b5-46be-a6a8-43297a01e3ce","resolution":{"observed_at":"2026-08-11T14:57:27.587037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09299","last_updated":"2023-12-14T19:08:56Z","snapshot_observed_at":"2026-08-16T14:34:37.658133Z","submitted_at":"2023-12-14T19:08:56Z","title":"Weight subcloning: direct initialization of transformers using larger pretrained ones","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09299","snapshot_observed_at":"2026-08-11T14:57:27.594549Z","title":"Weight subcloning: direct initialization of transformers using larger pretrained ones","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.594549Z"},"links":{"cited_paper":"/paper/2312.09299","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:f94f1ac11b80627b94baecc2fa7346d195826117e0296562a5c128c699dcbefc","observation_id":"91bf7c48-27a9-4baf-bc4c-022fd8b1f158","resolution":{"observed_at":"2026-08-11T14:57:27.594549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-08-13T04:32:33.562415Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-11T14:57:27.601424Z","title":"A simple and effective pruning approach for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.601424Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:26fc8d14dc4fc22f441052a32abc2ed69acae51ae995a56d65cde08e9b6d12d6","observation_id":"afab0312-c173-4e21-b431-ba341f8d7d9b","resolution":{"observed_at":"2026-08-11T14:57:27.601424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T14:57:27.607105Z","title":"Llama 2: Open founda- tion and fine-tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.607105Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:a2bbd4f2a3c70949edc05abd60491a39f42751ab7e4b6d3257eb7b8a96ab5802","observation_id":"3a775116-d942-4406-9f3d-19ab39192ef5","resolution":{"observed_at":"2026-08-11T14:57:27.607105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09748","last_updated":"2024-02-15T06:58:30Z","snapshot_observed_at":"2026-08-16T14:18:24.674010Z","submitted_at":"2024-02-15T06:58:30Z","title":"Model Compression and Efficient Inference for Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09748","snapshot_observed_at":"2026-08-11T14:57:27.612783Z","title":"Model compression and efficient inference for large language models: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.612783Z"},"links":{"cited_paper":"/paper/2402.09748","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:e5f9cc63cf147e1be546bc045af0f3e1a5ada409b9afbd73199cb1bbb489eba1","observation_id":"d86a23ae-8db0-4ddc-9d45-162ee7d35215","resolution":{"observed_at":"2026-08-11T14:57:27.612783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-16T14:53:24.619970Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-11T14:57:27.619770Z","title":"Sheared llama: Accelerating language model pre-training via structured pruning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.619770Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:1c777d2eb952a3b1ad6333bc62b0c330c1d4b03c369e942c9c4b3eeb6c17c96d","observation_id":"fbc542f4-3d8e-40f9-94d9-b5eec5b73084","resolution":{"observed_at":"2026-08-11T14:57:27.619770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-16T14:17:47.965208Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-11T14:57:27.625982Z","title":"Laco: Large language model pruning via layer collapse","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.625982Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:5749ad016dbf0494afad4d8f9dd8d73754c4204b9488b16800ebc98e406b9a38","observation_id":"7ad201fb-9411-4681-956a-e36e86fbda5b","resolution":{"observed_at":"2026-08-11T14:57:27.625982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01150","last_updated":"2023-06-01T21:11:24Z","snapshot_observed_at":"2026-08-16T15:27:18.888907Z","submitted_at":"2023-06-01T21:11:24Z","title":"Did You Read the Instructions? Rethinking the Effectiveness of Task Definitions in Instruction Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01150","snapshot_observed_at":"2026-08-11T14:57:27.631484Z","title":"Did you read the instructions? rethinking the effectiveness of task definitions in instruction learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.631484Z"},"links":{"cited_paper":"/paper/2306.01150","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:d47fc442bf1e9d10d8b293a3d2185e1f3697775ed44239f962b32d9ddafad191","observation_id":"24c578fc-d579-4638-a711-602f533774ae","resolution":{"observed_at":"2026-08-11T14:57:27.631484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-11T14:57:27.637839Z","title":"Hellaswag: Can a ma- chine really finish your sentence? arXiv preprint arXiv:1905.07830,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.637839Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:7cac1f5d2154ea10480417be90e6cea05537e62082495f69e2f37e324ff4cb96","observation_id":"165cf2d3-4ca2-4381-9e5a-aa09ac34edf3","resolution":{"observed_at":"2026-08-11T14:57:27.637839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-11T14:57:27.650898Z","title":"A survey of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.650898Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:67b48034c76017e377f614357c74dc742ed39812d8e13592154b4f865446f82f","observation_id":"4fa577b5-af44-4da0-a106-c75f9d5b3e23","resolution":{"observed_at":"2026-08-11T14:57:27.650898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10594","last_updated":"2025-05-22T04:58:06Z","snapshot_observed_at":"2026-08-16T13:42:43.568572Z","submitted_at":"2024-06-15T11:03:33Z","title":"BlockPruner: Fine-grained Pruning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10594","snapshot_observed_at":"2026-08-11T14:57:27.656730Z","title":"Blockpruner: Fine- grained pruning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.656730Z"},"links":{"cited_paper":"/paper/2406.10594","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:91dcaef96f12f8f31009b1550b0e219835e5974be9eef895cdd5a337dfce21fd","observation_id":"83dc59c8-aacf-4857-b220-cf515fee7487","resolution":{"observed_at":"2026-08-11T14:57:27.656730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:57:28.181325Z","title":null,"venue":null,"work_id":"4ca26db1-5239-4155-841a-b98a3f97975d","year":1904},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.662321Z"},"links":{"citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:c8bca086d66dedb04f1a7e9e58909a92add71c3faec2c0b1d2623660373f7b4f","observation_id":"bbc856ee-af68-4361-a01f-8ddae27968e4","resolution":{"observed_at":"2026-08-11T14:57:28.187066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-16T14:53:48.767514Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-11T14:57:27.548016Z","title":"Llmlingua: Compressing prompts for accelerated inference of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.548016Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:b06cce5beee1872480be51adbabb0e249e0f6fac7d5977b0bf5912dce45a2594","observation_id":"b1bc1a00-5a49-4a02-bf38-f9fe7df36884","resolution":{"observed_at":"2026-08-11T14:57:27.548016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12200","last_updated":"2024-06-04T06:39:23Z","snapshot_observed_at":"2026-08-16T14:25:27.213212Z","submitted_at":"2024-01-22T18:39:40Z","title":"APT: Adaptive Pruning and Tuning Pretrained Language Models for Efficient Training and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12200","snapshot_observed_at":"2026-08-11T14:57:27.645472Z","title":"Apt: Adaptive pruning and tuning pretrained language models for efficient training and inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.645472Z"},"links":{"cited_paper":"/paper/2401.12200","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:655e15a6c582aea4068706eac63aaa8d276bc40b310ff6ebb7075970668c5e3c","observation_id":"39140dc0-ce8b-45ab-80bf-e1d8715e6492","resolution":{"observed_at":"2026-08-11T14:57:27.645472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-11T14:57:27.492381Z","title":"Peter Clark, Isaac Cowhey, Oren Etzioni, Tushar Khot, Ashish Sabharwal, Carissa Schoenick, and Oyvind Tafjord","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.492381Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:ae0cf98e8684fa2aadd2c897f3c21891e48d8a88320e6436f8a2aa3cb33cc478","observation_id":"de63f3d5-aec5-4ef2-b550-2ca84d2ffd83","resolution":{"observed_at":"2026-08-11T14:57:27.492381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T14:57:27.524940Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.524940Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:114ef4b22ca956f9c1dbc0a4adbd1bbf24797da7dac8e274c970f3eecee43b73","observation_id":"1ffb1638-c57d-439a-8a1b-8c0e0c2c008c","resolution":{"observed_at":"2026-08-11T14:57:27.524940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-15T03:05:41.956181Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-11T14:57:27.541321Z","title":"Categorical reparameterization with gumbel-softmax.arXiv preprint arXiv:1611.01144,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.541321Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:b6ba31cc06db328331dec9a475b1f90659ecfa7a0710c885642aaebeb533aa70","observation_id":"47989978-ba53-44db-aefc-d14e6addc0ba","resolution":{"observed_at":"2026-08-11T14:57:27.541321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:57:28.222788Z","title":"Discrete model compression with resource constraint for deep neural networks","venue":null,"work_id":"01bf9428-1538-4604-b272-cbf19e221b47","year":1908},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.512996Z"},"links":{"citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:39cf726c9c9514c5a7207a79ab161dedbd60ac092954c25b8da8cd8e29297d8c","observation_id":"bca45947-b405-4b6e-acdf-c8f700ecc828","resolution":{"observed_at":"2026-08-11T14:57:28.228922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-08-16T14:24:10.346445Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-11T14:57:27.479414Z","title":"Slicegpt: Compress large language models by deleting rows and columns","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:27.479414Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2412.11494"},"observation_digest":"sha256:ab1ed8b4e491c64c22e34a9b30ae0753a8b69cd3b2633bbf2ce3750c90959c18","observation_id":"7e33be7c-4e42-49a4-870e-e1ee5d130438","resolution":{"observed_at":"2026-08-11T14:57:27.479414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.11494","last_updated":"2024-12-16T07:09:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T15:20:29.441453Z","submitted_at":"2024-12-16T07:09:46Z","title":"FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2412.11494."}