{"as_of":"2026-08-11T22:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0813e009af74e1caf80a0a13c710523bca9b6f145274bf6c0c53eceb0f742d54","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:33:44.492537Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.15255/citation-record","integrity":"/paper/2501.15255/integrity","json":"/paper/2501.15255/citation-record.json","paper":"/paper/2501.15255"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-08T02:24:48.712537Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-10T14:33:44.336597Z","title":"A survey on recent advances in llm-based multi-turn dialogue systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.336597Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:2799ccd22ab0e833f9777765817ead353b4d7c528dea8051ce2d64f4a52cc3af","observation_id":"013c793a-1f4f-44fd-b559-a65f588a533b","resolution":{"observed_at":"2026-08-10T14:33:44.336597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.341216Z","title":"Toolqa: A dataset for llm question answering with external tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.341216Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:dbdf500d3b7e46d43133b32ffea47e6a7a68a98188c335cc8cc7f9e7fd793bcf","observation_id":"860e4a02-c02c-4311-8f6f-44a309285257","resolution":{"observed_at":"2026-08-10T14:33:44.341216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.345007Z","title":"A comprehensive survey on process-oriented automatic text summarization with exploration of llm-based methods,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.345007Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:7cfce99a42e7a0c758e272c269ba943d8c38db9a7334961023d32fdf0e0f0414","observation_id":"1fc67cd9-391c-468d-bbff-7aea2db876af","resolution":{"observed_at":"2026-08-10T14:33:44.345007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.981115Z","title":"Exploding ai power use: an opportunity to rethink grid planning and management,","venue":null,"work_id":"e68a8791-704b-46d4-afe5-e283f7de7106","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.348740Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:a905b0117b416cd3576486bf85fd3b0ab44bf6cbafa4de718a3b575d597760fb","observation_id":"03eb5be2-6622-44c8-a793-b71cffa218ee","resolution":{"observed_at":"2026-08-10T14:33:44.984078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10350","last_updated":"2021-04-23T14:26:29Z","snapshot_observed_at":"2026-07-06T11:02:18.405330Z","submitted_at":"2021-04-21T04:44:25Z","title":"Carbon Emissions and Large Neural Network Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10350","snapshot_observed_at":"2026-08-10T14:33:44.352118Z","title":"Carbon emissions and large neural network training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.352118Z"},"links":{"cited_paper":"/paper/2104.10350","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6a2f89187f4b7f64e03bfff5391a20b337e251b7c267ac01cf4b3e2f5fd18c96","observation_id":"87360897-f9a6-44b5-98b5-7ba475a0e4a4","resolution":{"observed_at":"2026-08-10T14:33:44.352118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.355940Z","title":"Drive as you speak: Enabling human-like interaction with large language models in au- tonomous vehicles,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.355940Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:bde36ab96c275a9bd7e14b45399b8050bdefc1d61465e4055f851261be9fc1c3","observation_id":"0878c019-51b2-461a-a433-a919b5d8c977","resolution":{"observed_at":"2026-08-10T14:33:44.355940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11805","last_updated":"2024-03-18T14:03:23Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:03:23Z","title":"LLM as a System Service on Mobile Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11805","snapshot_observed_at":"2026-08-10T14:33:44.359780Z","title":"Llm as a system service on mobile devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.359780Z"},"links":{"cited_paper":"/paper/2403.11805","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:8eb705366dd8f53adc0ba541ebcdc2fc94fb8b62caa8b41483f70cb1847d02ee","observation_id":"77454a21-ecf1-4483-8279-175eee468d69","resolution":{"observed_at":"2026-08-10T14:33:44.359780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.966054Z","title":"Language models are few-shot learners advances,","venue":null,"work_id":"335a47fe-75cd-4a06-a214-648029b1be1a","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.363470Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:33b97b12420b7a95f7a641a6958455c5056722985daee10fb58dab502ecbd853","observation_id":"457735b4-acc0-4490-934d-fb2fc19db4b8","resolution":{"observed_at":"2026-08-10T14:33:44.969294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.956473Z","title":"Energy and policy consid- erations for modern deep learning research,","venue":null,"work_id":"0ca13cfe-153f-461f-b15b-94b98c3b96d0","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.366745Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e6398c8e6222f9b7c053244417530815abe4a517fc574a5c9cc493b370799a6e","observation_id":"a448f3cd-607c-401b-b630-272fa0a7df22","resolution":{"observed_at":"2026-08-10T14:33:44.959998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.370200Z","title":"Learning both weights and connections for efficient neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.370200Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:2427a747caefc05b54e21651dc3de6af2868ab491641c092a1adfb9e2f4a0400","observation_id":"bfda8e4c-9cf8-440c-a99f-ef35692fcf58","resolution":{"observed_at":"2026-08-10T14:33:44.370200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.374805Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.374805Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:fe67b5475d6246b5434ec432c827fa6de5d364ab83bed54d5eb1607355468c55","observation_id":"c3d97847-33d0-4074-bebf-99c305448449","resolution":{"observed_at":"2026-08-10T14:33:44.374805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.01611","last_updated":"2020-07-20T16:50:33Z","snapshot_observed_at":"2026-08-04T07:40:59.947811Z","submitted_at":"2019-03-05T00:52:12Z","title":"Stabilizing the Lottery Ticket Hypothesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.01611","snapshot_observed_at":"2026-08-10T14:33:44.378653Z","title":"Stabilizing the lottery ticket hypothesis,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.378653Z"},"links":{"cited_paper":"/paper/1903.01611","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:4b434ce20c02d2d34de862e02bc7b28e0ef8a9e548ad88ba7ed07f52fa1a826d","observation_id":"41187ac8-a6c5-4cda-8770-24186917364d","resolution":{"observed_at":"2026-08-10T14:33:44.378653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.382403Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.382403Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e20dea5a057196887e08326c6f4a8f9089e8eb65af4f4982a1d0d22e756797a0","observation_id":"c848a58c-8bad-4138-84a1-1b8e3aad5b48","resolution":{"observed_at":"2026-08-10T14:33:44.382403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.927987Z","title":"Plug-and-play: An efficient post-training pruning method for large language models,","venue":null,"work_id":"dc4c7039-7fea-47e9-87a9-2e678a74a878","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.385747Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:297d12ec5f35b2dfa65fb3e8562ca6329f5ba5f6ee3b3fb4d46652c29da6013e","observation_id":"f8778de6-39f8-4a3b-8b69-eb9b73f8b73d","resolution":{"observed_at":"2026-08-10T14:33:44.931726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.389083Z","title":"Nvidia a100 tensor core gpu: Performance and innovation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.389083Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:12f5fb05199a5e9d7ad6139da56cca0d69d7945e243f8b8ce4827e7202db0be9","observation_id":"861098ea-9bf3-4585-864d-f04b67e44447","resolution":{"observed_at":"2026-08-10T14:33:44.389083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.911731Z","title":"A fast post-training pruning framework for transformers,","venue":null,"work_id":"830a5307-4d0a-418a-b37a-4e47000a432b","year":2022},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.392355Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:a7d7671da734db6add9f6091de8d25e5e63eed4aa84d35248e2051a2e55b3195","observation_id":"c15ccb1a-c0a3-4875-bd00-d852470f5f1a","resolution":{"observed_at":"2026-08-10T14:33:44.915181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.901357Z","title":"Loraprune: Structured pruning meets low-rank parameter-efficient fine- tuning,","venue":null,"work_id":"6abb96bf-381d-49f9-a9a3-0b04547571c4","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.395805Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e015375876773cd2a70f942638f99078f58ddb1bf7a71d305f3ff999dbb4ad8b","observation_id":"6025b344-80c9-4c59-be53-413b5e2085df","resolution":{"observed_at":"2026-08-10T14:33:44.905108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-10T14:33:44.399302Z","title":"Shortgpt: Layers in large language models are more redundant than you expect,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.399302Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:7abb74285371645a309640c9afab5aef985759132379fe73c771b004e063a77a","observation_id":"914996d1-6d6c-4f73-a1a2-336f930a7cdf","resolution":{"observed_at":"2026-08-10T14:33:44.399302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.891330Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":"da4a26f9-c86e-44ab-983f-7a7d8a0d9823","year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.403297Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6be7b16a279b79560eb32567078158c745411fe2fd38507aca66b38b3f2fdf20","observation_id":"18d08712-db2b-468a-b654-b6af2fede839","resolution":{"observed_at":"2026-08-10T14:33:44.894912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-10T14:33:44.407072Z","title":"A simple and effective pruning approach for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.407072Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:d0ac7f3ae218be7b9ecce8b95d59d0ada54cc618c5522629533e8e68e86bab74","observation_id":"32b8e711-9b39-4c5d-84cb-5a62ec94e6f7","resolution":{"observed_at":"2026-08-10T14:33:44.407072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-10T14:33:44.410576Z","title":"Parameter-efficient fine- tuning for large models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.410576Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e0339a6fa749ad4bd3ac63eadfb5145cdbcc1a04ae793def37836df59860501f","observation_id":"2148dfb3-c847-4963-a91b-e4028f9fdb03","resolution":{"observed_at":"2026-08-10T14:33:44.410576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T14:33:44.414119Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.414119Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:43e2b58462675752eabc18934ee6bb74de21210b6220214552e66f418c7617fc","observation_id":"86fc1f16-90c8-40af-ae3e-61c118806114","resolution":{"observed_at":"2026-08-10T14:33:44.414119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.417177Z","title":"Compacter: Efficient low-rank hypercomplex adapter layers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.417177Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:05e2044f3884b535753240100a5b72fe2f4023dc6a0db311f2e659d1aa3b08b6","observation_id":"bbf3125e-d4a0-4f6e-8220-2a763776e682","resolution":{"observed_at":"2026-08-10T14:33:44.417177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.419846Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.419846Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:ef061c37a1edfd9e60c0ca314af86c8c0729b609605c3e43fe2aeba5c8689a8e","observation_id":"b82c9b1a-9d5c-46f2-9a02-ef2cf2de04d0","resolution":{"observed_at":"2026-08-10T14:33:44.419846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.869173Z","title":"Privacy-preserving large language models for structured medical information retrieval,","venue":null,"work_id":"b4e54109-b71b-4f06-8a70-0fec5f3cdcd0","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.425729Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:02cf9f0e8eb2fac72f1f118c9f7668e8a980bc451d573279fdf4836d1a379c95","observation_id":"004b8d87-4e38-425d-badd-3ebb660de9b6","resolution":{"observed_at":"2026-08-10T14:33:44.872785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.858943Z","title":"Optimizing llm training for financial services: Best practices for model accuracy, risk management, and compliance in ai-powered financial applications,","venue":null,"work_id":"29dcfb0b-6efa-447f-a6f6-64c2a9221261","year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.428556Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:43acf3a1edbb468532ba2d81749f0a5ac0c30da8a3e51828144a3128faae4d0b","observation_id":"569f2be8-04f6-47c1-9a15-1184ec144354","resolution":{"observed_at":"2026-08-10T14:33:44.862571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T14:33:44.431221Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.431221Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:a689660897b3ff25ad71e9d80d63ad36580f1f56de61e814c79c609b81e18658","observation_id":"413ef0f4-ae05-4b25-8b63-c54a62aa4674","resolution":{"observed_at":"2026-08-10T14:33:44.431221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-10T14:33:44.434000Z","title":"Slicegpt: Compress large language models by deleting rows and columns,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.434000Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6e60b37905f280155fcaff2a5e863a5eaf801e98c8214bade102e698e6ff54c6","observation_id":"56a01d3e-b6ad-44d5-b313-0840ed563c95","resolution":{"observed_at":"2026-08-10T14:33:44.434000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.848274Z","title":"Deja vu: Contextual sparsity for efficient llms at inference time,","venue":null,"work_id":"7507850f-85bf-4bc7-84f8-66143e4684e4","year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.436754Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:50d435d6c2f94bfa56d5dcac79c8d8e49e716b172ab09257bb4beb1840e89a8b","observation_id":"b6853423-0452-43d1-8d62-1c0be72bec33","resolution":{"observed_at":"2026-08-10T14:33:44.852104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.439465Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.439465Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:c97f6eb75d5dd693eb46d992290e964c45a5d2761aec69a3ba61c2125e6d7bc3","observation_id":"fac87cdc-d51f-4666-9662-c5f8cee278ec","resolution":{"observed_at":"2026-08-10T14:33:44.439465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.831777Z","title":"An estimate for the condition number of a matrix,","venue":null,"work_id":"1c672c9f-52b9-4c1f-bc67-9771ddebec43","year":1979},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.442564Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:385577ab40e7f5fee6ca1cdb7b90caa70befdc072684ef04c3902895904c0f1b","observation_id":"8cf8064d-e626-43a5-adb0-c58efa3558ba","resolution":{"observed_at":"2026-08-10T14:33:44.835773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.821457Z","title":"Matrix inversion using cholesky decomposition,","venue":null,"work_id":"d75d4623-15b5-451f-b08b-681d638b79a4","year":2013},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.445594Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:8a4e704b65beb350eba73442cb032f7cb085fde3dbe2633e935234c93f5613d1","observation_id":"0c50f56f-9e78-4011-9f98-3db1ae1fbb79","resolution":{"observed_at":"2026-08-10T14:33:44.825043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.811191Z","title":"Points of significance: model selection and overfitting,","venue":null,"work_id":"c2979af8-33e6-4e86-aac7-561422590a7a","year":2016},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.448713Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:28909123e401de7a6cccc889fd5f4ae95a7b6802ada84c6a700b7774940522cd","observation_id":"68e0d6a8-843e-49f8-9223-ddacac42845c","resolution":{"observed_at":"2026-08-10T14:33:44.814768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-10T14:33:44.452010Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.452010Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:681004a5255ded5007319c684ecb8a78c53d0ff22288139b22992eb6d3a30a91","observation_id":"436bbed2-b290-45c9-8d32-a2f722798a0b","resolution":{"observed_at":"2026-08-10T14:33:44.452010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-02T04:26:53.194797Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02414","snapshot_observed_at":"2026-08-10T14:33:44.455177Z","title":"Glm-130b: An open bilingual pre-trained model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.455177Z"},"links":{"cited_paper":"/paper/2210.02414","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e218465ee28e39b3b59e064f10999f767cb2a6a99ef81d0dfc014afbbf9ee517","observation_id":"97024a3e-4502-4863-88e1-91012bdd692b","resolution":{"observed_at":"2026-08-10T14:33:44.455177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-10T14:33:44.458701Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.458701Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:262ebd84693da57b7c5faacb685a286c3aff9d6ae1c7098bb1fdedba6cd90df9","observation_id":"3f4493f7-b8f6-4015-9178-4a4f842e31f3","resolution":{"observed_at":"2026-08-10T14:33:44.458701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.461865Z","title":"Building a large annotated corpus of english: The penn treebank,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.461865Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:5f6ecf1ac452c51d5c19908d9e452f309caaa2b759a87c7a6289e3536eec6c71","observation_id":"39a0375b-ff2f-4ce5-a68c-f04d50aaa29e","resolution":{"observed_at":"2026-08-10T14:33:44.461865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.793900Z","title":"Compressing pre-trained language models by matrix decomposition,","venue":null,"work_id":"fbf674bb-ad53-47d7-8c70-932883d88b6e","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.465137Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6a1b74f32ea1b26c15f520a90383593c5406b691093893fff505259cc7bbc480","observation_id":"211e2d4c-1762-437e-9d0f-0cec7d247e90","resolution":{"observed_at":"2026-08-10T14:33:44.797749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.783620Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/no questions,","venue":null,"work_id":"240def24-2904-4063-8651-9d9d25f24f9a","year":2019},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.468363Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:4caec6bbff56b03a2ec054b52ed0a29edf2493a8889d7fd26dd7211bdb1f83d0","observation_id":"20dbe893-cd7c-414e-98a3-8e24a909e03c","resolution":{"observed_at":"2026-08-10T14:33:44.786814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.773783Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":"581d1dae-0dcd-44ca-8904-56e7b80435cc","year":2019},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.471683Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:dc0520736583ca41f1dbd108ea1283387ccef2660fcfd484758ca0987e690a30","observation_id":"7650a08c-734f-424c-8a36-a0d5f2b19c17","resolution":{"observed_at":"2026-08-10T14:33:44.777134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-10T13:06:17.421919Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-10T14:33:44.474924Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.474924Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6a6e04a54ceb875331477b0b434b9dfa337042dce227b08f44a3412b53b441ec","observation_id":"a5ae07b3-7fb5-4ebf-b463-0d0b87105b95","resolution":{"observed_at":"2026-08-10T14:33:44.474924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-10T14:33:44.478804Z","title":"Measuring massive multitask language understanding,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.478804Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:c9215209e8b0a55de4e37047d94c5f35eacaa488ba9125e28f25a673888b5137","observation_id":"99c1038a-3f7b-406e-9e92-c72e68c59647","resolution":{"observed_at":"2026-08-10T14:33:44.478804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.763193Z","title":"Piqa: Reasoning about physical commonsense in natural language,","venue":null,"work_id":"627b96c5-61a9-4f24-99f4-b3f3c5190e0f","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.482283Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:1c8877c43b3d3fc327dd89fee82e5f45e77cba0df8811e2a7dfc24484783ee9f","observation_id":"0cdf96ac-8bf5-4b8e-8641-89b058676f1a","resolution":{"observed_at":"2026-08-10T14:33:44.766624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-10T14:33:44.485758Z","title":"Crowdsourcing multiple choice science questions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.485758Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:198756b2d694305c6888fb2109fb34c54e1eb929433aa3c49458d6a47a0e87a5","observation_id":"bf75d910-6fa0-4d25-a020-fc547f3e71be","resolution":{"observed_at":"2026-08-10T14:33:44.485758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.489292Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.489292Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:5390241aff72c0261474e243ff46e3fe2944169ca73450e60b8aef64f1cd0426","observation_id":"b8a4af68-ef6c-49b0-8545-e136c391e98b","resolution":{"observed_at":"2026-08-10T14:33:44.489292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.744431Z","title":"Cupy: A numpy-compatible library for nvidia gpu calculations,","venue":null,"work_id":"f7bb047e-6647-410a-b088-57565a8b8c13","year":2017},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.492537Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:4e13bfc59fff944e1a772da6e57e96bdfea988652fa2dcdd30c4c40936e35a52","observation_id":"d2509998-5f88-4a5f-b63c-20e94b791b83","resolution":{"observed_at":"2026-08-10T14:33:44.749821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T14:33:44.422738Z","title":"Available: https://arxiv.org/abs/1711.05101","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.422738Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:db5cdea19281137fcc0a7f7bb4d3ad09f4fbee546f1b6a036d1ccff405eae35a","observation_id":"e4d836dd-cb1c-4e10-a6a2-522a50cae2bd","resolution":{"observed_at":"2026-08-10T14:33:44.422738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T22:14:11.310562Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2501.15255."}