{"as_of":"2026-08-10T02:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c28f45ffdb76144d1532b5c6bdbabf2ee249e508ccd86079489af7a5671c02d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:08:14.032835Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-07T14:08:14.032835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.032835Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:0f575411f7cbb956deccafed6276060dd7c72b1ed2e60eeb7d8579fa4d453fbc","observation_id":"4a039955-dfb5-49d8-adb2-f6367fb18e70","resolution":{"observed_at":"2026-08-07T14:08:14.032835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-07T14:03:49.976362Z","title":"Laco: Large language model pruning via layer collapse.arXiv preprint arXiv:2402.11187, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20155","last_updated":"2025-05-26T15:57:08Z","snapshot_observed_at":"2026-08-08T04:39:03.740360Z","submitted_at":"2025-05-26T15:57:08Z","title":"Pangu Light: Weight Re-Initialization for Pruning and Accelerating LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:49.976362Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2505.20155"},"observation_digest":"sha256:2a698a8968a193c958fe7041c87c05708f32772030025c0da7961b2fa79f2e0f","observation_id":"fcc5502e-2347-4934-90b6-4f3d81b1d427","resolution":{"observed_at":"2026-08-07T14:03:49.976362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-07T11:27:16.420439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02561","last_updated":"2025-06-03T07:47:30Z","snapshot_observed_at":"2026-08-08T01:27:01.613503Z","submitted_at":"2025-06-03T07:47:30Z","title":"Pruning General Large Language Models into Customized Expert Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:16.420439Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2506.02561"},"observation_digest":"sha256:1a22edda886a6cde347dce43fa6f9126447d5db4425156b670d1b888174dadc8","observation_id":"35df2db4-75ed-483a-ae24-6a93e9e56927","resolution":{"observed_at":"2026-08-07T11:27:16.420439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-07T10:51:51.656370Z","title":"Laco: Large language model pruning via layer collapse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04179","last_updated":"2025-06-04T17:26:31Z","snapshot_observed_at":"2026-08-08T19:35:37.122227Z","submitted_at":"2025-06-04T17:26:31Z","title":"SkipGPT: Dynamic Layer Pruning Reinvented with Token Awareness and Module Decoupling","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:51:51.656370Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2506.04179"},"observation_digest":"sha256:6c1319222c99ee9784e93950dd714611b1455df141b540c3fa8158ff381818bc","observation_id":"cfdedba0-f9df-4cc3-a173-0be35f3f733e","resolution":{"observed_at":"2026-08-07T10:51:51.656370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-06T22:53:07.541474Z","title":"Laco: Large language model pruning via layer collapse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20480","last_updated":"2025-06-25T14:24:59Z","snapshot_observed_at":"2026-08-08T05:07:43.279449Z","submitted_at":"2025-06-25T14:24:59Z","title":"GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:53:07.541474Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2506.20480"},"observation_digest":"sha256:35a9dce4fcde68eba4d89712183c00f0f9af1da1e44cb37be20a3559045d20ec","observation_id":"e8c327d2-7bde-4178-9385-5a7a644ab2e4","resolution":{"observed_at":"2026-08-06T22:53:07.541474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-06T18:54:17.038644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07064","last_updated":"2025-07-09T17:26:10Z","snapshot_observed_at":"2026-08-06T18:45:52.406605Z","submitted_at":"2025-07-09T17:26:10Z","title":"Boosting Parameter Efficiency in LLM-Based Recommendation through Sophisticated Pruning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:54:17.038644Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2507.07064"},"observation_digest":"sha256:921634998eaabe03f996604517bd16955e63345ce91f7e95d1efc87caf47258a","observation_id":"d7e18f89-04d9-4a30-8945-0d2dbf833c18","resolution":{"observed_at":"2026-08-06T18:54:17.038644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T12:52:01.711194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01221","last_updated":"2025-09-04T09:30:16Z","snapshot_observed_at":"2026-08-08T17:37:43.606906Z","submitted_at":"2025-09-01T08:06:49Z","title":"DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T12:52:01.711194Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2509.01221"},"observation_digest":"sha256:febbb67b8fba885924cf01f078bb7e47cab7efad6ca345febbb0c133f19aaa4e","observation_id":"ddae4f8b-b218-4b77-85d3-392f032d56c3","resolution":{"observed_at":"2026-08-05T12:52:01.711194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-07-14T20:29:33.439034Z","title":"Laco: Large language model pruning via layer collapse.arXiv preprint arXiv:2402.11187,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.15389","last_updated":"2026-06-27T04:53:36Z","snapshot_observed_at":"2026-08-01T17:36:36.240938Z","submitted_at":"2026-03-16T15:04:16Z","title":"When Does Sparsity Mitigate the Curse of Depth in LLMs","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T20:29:33.439034Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2603.15389"},"observation_digest":"sha256:70ea85e04a5f04662a9c22c9740029876b5afef3cdaa2802e8a985a809e59aba","observation_id":"b7082a52-cd76-4e9e-82e6-ea9aafc42c68","resolution":{"observed_at":"2026-07-14T20:29:33.439034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2604.12358","last_updated":"2026-04-15T17:43:53Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T06:48:31Z","title":"Why and When Visual Token Pruning Fails? A Study on Relevant Visual Information Shift in MLLMs Decoding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T14:50:37.022338Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2604.12358"},"observation_digest":"sha256:e47d6a05c1b1d6724779191a37bffb60ccabdbdcd77de12373738cc31ad34e4d","observation_id":"bbcff9ad-ce7f-4c70-981a-e574f101ce7d","resolution":{"observed_at":"2026-05-11T11:31:01.354005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2605.07271","last_updated":"2026-05-08T05:35:32Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T05:35:32Z","title":"Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-11T02:23:52.589354Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2605.07271"},"observation_digest":"sha256:843b69a22745a41c1d035daba5f5a675285eabd050d3f6a955a4e60b3a7741ce","observation_id":"aecded9e-0b97-46d9-ad7e-e40efc647e51","resolution":{"observed_at":"2026-05-11T02:25:53.988810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2605.08738","last_updated":"2026-05-18T06:29:11Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:50:35Z","title":"SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-12T03:34:10.370956Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2605.08738"},"observation_digest":"sha256:27ea8b015bf1b2b5eb65e337504115460724c25f42ff48cbdd4330acca846a43","observation_id":"603da301-cec3-4dcd-9070-1e3f38833556","resolution":{"observed_at":"2026-05-12T07:16:28.599350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2605.08738","last_updated":"2026-05-18T06:29:11Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:50:35Z","title":"SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-20T23:22:51.808346Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2605.08738"},"observation_digest":"sha256:5558bba67d3153d532b9ce33fd5a335c6b102a9f5288f4c2ac1f46b52ee9ed91","observation_id":"721d472b-5bf5-4045-b942-61b1c5c1f1ea","resolution":{"observed_at":"2026-05-20T23:23:51.233060Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2605.16234","last_updated":"2026-05-18T08:12:08Z","snapshot_observed_at":"2026-08-09T19:48:54.114224Z","submitted_at":"2026-05-15T17:43:16Z","title":"No Free Swap: Protocol-Dependent Layer Redundancy in Transformers","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T20:29:38.004776Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2605.16234"},"observation_digest":"sha256:f2508fe423b43c29f24aac2c78f3e001538ad95a76fa2c9515ab64cc4ec41642","observation_id":"82413316-4722-48e2-a1b0-7ebef0153e18","resolution":{"observed_at":"2026-05-20T20:33:43.490093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2605.26496","last_updated":"2026-05-26T03:19:04Z","snapshot_observed_at":"2026-07-06T23:36:20.072253Z","submitted_at":"2026-05-26T03:19:04Z","title":"Dense2MoE: Pushing the Pareto Frontier of On-Device LLMs via Unified Pruning and Upcycling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T19:34:17.270161Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2605.26496"},"observation_digest":"sha256:5c8baa847af22fdffed3f0f37fcd0c3284ff40a62d2bdd9be8186c1ea7997547","observation_id":"4fecc81b-6b25-4234-8603-fae5c24a0cc2","resolution":{"observed_at":"2026-06-29T19:43:54.999948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2606.01544","last_updated":"2026-06-01T01:44:31Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T01:44:31Z","title":"CRePE: Convolution-aware Relative Importance in Post-training Pruning with Efficient Search","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T15:43:35.063909Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2606.01544"},"observation_digest":"sha256:76f071ec60e247c95c738e1ff923713d28021329af76a80e0b97a9e32a8a0fee","observation_id":"0d70edae-8b26-4d19-96ea-4a78eda938f1","resolution":{"observed_at":"2026-07-01T22:06:16.823216Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2606.06574","last_updated":"2026-06-04T17:59:58Z","snapshot_observed_at":"2026-07-06T23:46:24.981618Z","submitted_at":"2026-06-04T17:59:58Z","title":"Skip a Layer or Loop It? Learning Program-of-Layers in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T01:56:34.435152Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2606.06574"},"observation_digest":"sha256:521f8c45f33e7c8427f4098a270bae11c3537967d4f667bce30868ed527a1a65","observation_id":"389e01ea-07d4-4d83-9e1b-1e784b12a6bc","resolution":{"observed_at":"2026-07-02T12:36:57.331179Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":"2402.11187","doi":"10.48550/arxiv.2402.11187","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Laco: Large language model pruning via layer collapse","venue":"arXiv (Cornell University)","work_id":"8046f6f6-1b64-4b5b-a29e-b800683b5487","year":2024},"citing_paper":{"arxiv_id":"2606.26538","last_updated":"2026-06-25T02:25:00Z","snapshot_observed_at":"2026-07-07T00:00:51.779266Z","submitted_at":"2026-06-25T02:25:00Z","title":"CascadeFormer: Depth-Tapered Transformers Motivated by Gradient Fan-in Asymmetry","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-26T05:22:26.818078Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2606.26538"},"observation_digest":"sha256:14799d3dda2991f4e2caaa687794ae8dd5ab4889ca37132598a4c841c52124c8","observation_id":"3f49b68f-c196-4f68-ac38-4f8622866702","resolution":{"observed_at":"2026-06-26T05:29:00.093113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.11187/citation-record","integrity":"/paper/2402.11187/integrity","json":"/paper/2402.11187/citation-record.json","paper":"/paper/2402.11187"},"outbound":[],"paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2402.11187."}