{"as_of":"2026-08-07T15:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c4acd73856ae05ee7734764dd1ab4f5e9ffd639265443efdef58e0de049d453","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:52:09.670315Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T14:50:27.875803Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:43:25.630106Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"cited_work":{"arxiv_id":"2506.23266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23266","snapshot_observed_at":"2026-06-29T12:43:25.630106Z","title":"arXiv preprint arXiv:2506.23266 , year=","venue":null,"work_id":"6c7abbbb-d075-444c-a820-db193c9dd4fd","year":2025},"citing_paper":{"arxiv_id":"2408.07666","last_updated":"2025-12-31T04:06:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-14T16:58:48Z","title":"Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities","version":5},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-05-17T22:16:04.386706Z"},"links":{"cited_paper":"/paper/2506.23266","citing_paper":"/paper/2408.07666"},"observation_digest":"sha256:f1e20946e1e7557eb42b51fc6a9d91769692f9388d00c1ba4d2ce8eb056023a0","observation_id":"433a73b8-7e44-4514-a606-9d264a6161c9","resolution":{"observed_at":"2026-05-17T22:16:04.898004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23266","snapshot_observed_at":"2026-08-04T14:50:27.875803Z","title":"Sub-moe: Efficient mixture-of-expert llms compression via subspace expert merging.arXiv preprint arXiv:2506.23266,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02345","last_updated":"2026-07-21T06:35:53Z","snapshot_observed_at":"2026-08-04T14:50:24.826478Z","submitted_at":"2025-09-27T10:45:58Z","title":"Breaking the MoE LLM Trilemma: Dynamic Expert Clustering with Structured Compression","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T14:50:27.875803Z"},"links":{"cited_paper":"/paper/2506.23266","citing_paper":"/paper/2510.02345"},"observation_digest":"sha256:46a8b161651b48c6d4f1a6c5fdd672ff5138a4e639655e7f96a2f8335fd3a1b8","observation_id":"6c0a9910-cf7e-472d-8cbc-5efe986b71f5","resolution":{"observed_at":"2026-08-04T14:50:27.875803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23266","snapshot_observed_at":"2026-08-03T23:41:52.889236Z","title":"Sub-moe: Efficient mixture-of-expert llms compression via subspace expert merging, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.04805","last_updated":"2026-07-06T16:04:54Z","snapshot_observed_at":"2026-08-07T10:51:08.099986Z","submitted_at":"2025-11-06T20:53:02Z","title":"PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T23:41:52.889236Z"},"links":{"cited_paper":"/paper/2506.23266","citing_paper":"/paper/2511.04805"},"observation_digest":"sha256:c3c327c5e70e7d90fc5b88be6d47b6dbcdb590d5026bbcc6a26d6f461d40f90f","observation_id":"aa53dd31-ba35-43bd-a312-d9718e0365cf","resolution":{"observed_at":"2026-08-03T23:41:52.889236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"cited_work":{"arxiv_id":"2506.23266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23266","snapshot_observed_at":"2026-06-29T12:43:25.630106Z","title":"arXiv preprint arXiv:2506.23266 , year=","venue":null,"work_id":"6c7abbbb-d075-444c-a820-db193c9dd4fd","year":2025},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2506.23266","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:3330b6dd5e53f3e9dbe2594e7670d2f6ad753b379aff15275b269ec5ac574eaa","observation_id":"7f021178-66ab-4983-b88d-908922941285","resolution":{"observed_at":"2026-05-15T14:35:55.624299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"cited_work":{"arxiv_id":"2506.23266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23266","snapshot_observed_at":"2026-06-29T12:43:25.630106Z","title":"arXiv preprint arXiv:2506.23266 , year=","venue":null,"work_id":"6c7abbbb-d075-444c-a820-db193c9dd4fd","year":2025},"citing_paper":{"arxiv_id":"2605.16349","last_updated":"2026-05-08T04:17:10Z","snapshot_observed_at":"2026-08-02T09:46:11.155553Z","submitted_at":"2026-05-08T04:17:10Z","title":"Geometric Asymmetry in MoE Specialization: Functional Decorrelation and Representational Overlap","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T23:45:19.279268Z"},"links":{"cited_paper":"/paper/2506.23266","citing_paper":"/paper/2605.16349"},"observation_digest":"sha256:2ac88c8bce8af2492ec68114e093a8e1f891bdeb89f281d2731c810d7640d526","observation_id":"5e930ae5-9ce4-44a2-a61a-c1a5805809b7","resolution":{"observed_at":"2026-05-20T23:49:15.477982Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"cited_work":{"arxiv_id":"2506.23266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23266","snapshot_observed_at":"2026-06-29T12:43:25.630106Z","title":"arXiv preprint arXiv:2506.23266 , year=","venue":null,"work_id":"6c7abbbb-d075-444c-a820-db193c9dd4fd","year":2025},"citing_paper":{"arxiv_id":"2605.28207","last_updated":"2026-06-06T13:23:43Z","snapshot_observed_at":"2026-07-06T23:37:50.157617Z","submitted_at":"2026-05-27T09:27:36Z","title":"Pruning and Distilling Mixture-of-Experts into Dense Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-29T12:39:25.535897Z"},"links":{"cited_paper":"/paper/2506.23266","citing_paper":"/paper/2605.28207"},"observation_digest":"sha256:87b419f457b5642be1366e76606132b05531320f82d992a473151b99cdc92a2a","observation_id":"3ec686f9-e5f0-4339-ad42-40ebbde49f3f","resolution":{"observed_at":"2026-06-29T12:43:25.631665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23266/citation-record","integrity":"/paper/2506.23266/integrity","json":"/paper/2506.23266/citation-record.json","paper":"/paper/2506.23266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:14.179097Z","title":"The fifth pascal recognizing textual entailment challenge","venue":null,"work_id":"8f608cb3-932b-4861-a202-f092722fec9d","year":2009},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:01.700024Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:9c6011248a2f8fd88b1d2745f415e55d96b0ecabc9f3c23dbb5ded94b228d6ec","observation_id":"4cbeb805-5288-4ccc-bc38-8fb592587ddb","resolution":{"observed_at":"2026-08-06T21:52:14.528001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05019","last_updated":"2025-05-29T04:25:16Z","snapshot_observed_at":"2026-07-06T17:56:49.318298Z","submitted_at":"2024-04-07T17:17:23Z","title":"Shortcut-connected Expert Parallelism for Accelerating Mixture-of-Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05019","snapshot_observed_at":"2026-08-06T21:52:01.836956Z","title":"Shortcut-connected expert parallelism for accelerating mixture-of-experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:01.836956Z"},"links":{"cited_paper":"/paper/2404.05019","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:868998b47ad3abe221538824f299b539d348881fa08d69fa4433b32f1365e62c","observation_id":"685b225d-df9a-4871-b6b0-8023773023be","resolution":{"observed_at":"2026-08-06T21:52:01.836956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:01.953614Z","title":"Retraining-free merging of sparse mixture-of-experts via hierarchical clustering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:01.953614Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:e32cd6a3ae851867780a9dd318f401bd0816b88c3bcda148708e3db6c5180d70","observation_id":"82ad7fa7-bad8-4170-a5be-b601728e321e","resolution":{"observed_at":"2026-08-06T21:52:01.953614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.921113Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"ce36710a-8a57-4774-9f8b-b52257350952","year":2019},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.117344Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:88bed9051c8278aecfefe3b1a81e88e688681f50b2f5168a343fe67745095001","observation_id":"9cf00e1a-b7fa-4242-be09-4bf9782e5fe7","resolution":{"observed_at":"2026-08-06T21:52:14.029551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T21:52:02.308317Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.308317Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:70ad221f695ce41df8d4fd77698ed893473e66a269188f8feacc454d350e3891","observation_id":"6dd41cc4-0bb6-4dfb-82f6-f8cd02968f1c","resolution":{"observed_at":"2026-08-06T21:52:02.308317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-06T21:52:02.416225Z","title":"Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.416225Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:578cf9eb39a748bb637662b9c1732efa832513691c3da8cd95b604950ad2bee0","observation_id":"7e22f0a7-798c-4b7f-8e1b-2d8ec1d18c51","resolution":{"observed_at":"2026-08-06T21:52:02.416225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.727318Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model, 2024","venue":null,"work_id":"455bf1d1-345d-4c2b-8559-733d8535c926","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.503692Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:fce6f5b55e9111c7b23a3a2efd24f117f19e8c933f4d805fbe4e48e8fa31d685","observation_id":"cda31413-22d0-4219-9dba-e66f06ab1750","resolution":{"observed_at":"2026-08-06T21:52:13.806576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.571433Z","title":"Pruner-zero: Evolving symbolic pruning metric from scratch for large language models","venue":null,"work_id":"aa8fefbd-d528-4e06-b2ee-927432e87d9a","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.585104Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:58acbe74dd970e610e6a90b7e3c8837693da4d9c566190ab767d0b768f01401f","observation_id":"bc50fd45-23e2-49c1-a6a5-0d60b35fe4a5","resolution":{"observed_at":"2026-08-06T21:52:13.649148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.450396Z","title":"Stbllm: Breaking the 1-bit barrier with structured binary llms","venue":null,"work_id":"82045450-e4ea-4d6b-a83b-043061fc6a44","year":2025},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.659224Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:f0a5309675754fad6fe20842d175050c1a96ef92af814ea87eecaa35dabb3ba6","observation_id":"ea242f90-6ca7-403e-a5e9-57c4b830ca95","resolution":{"observed_at":"2026-08-06T21:52:13.498247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.342574Z","title":"A framework for few-shot language model evaluation, 2024","venue":null,"work_id":"684cb552-cc4f-4236-aacf-b9deb53721a8","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.772171Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:69f331bd10bfcc3affcb45f55da997203b5932937d84b5216829d82e30f1ccfc","observation_id":"605e28bf-de5c-4909-baa3-d6fa1ab91d18","resolution":{"observed_at":"2026-08-06T21:52:13.394017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.212589Z","title":"Delta decompression for moe-based LLMs compression","venue":null,"work_id":"6f8bc459-33b5-422e-a729-d116ce24099c","year":2025},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.861777Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:9c1cc80937b76ca6053e2dd7c4470daf9f1d4e05c6b990979968b4495a6d2d5b","observation_id":"99a03fbc-7fe5-43ad-b49c-a756344c84a2","resolution":{"observed_at":"2026-08-06T21:52:13.286720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02500","last_updated":"2025-03-17T14:18:42Z","snapshot_observed_at":"2026-07-06T18:25:18.469656Z","submitted_at":"2024-06-04T17:18:40Z","title":"Towards Efficient Mixture of Experts: A Holistic Study of Compression Techniques","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02500","snapshot_observed_at":"2026-08-06T21:52:02.958911Z","title":"Demystifying the compression of mixture-of- experts through a unified framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:02.958911Z"},"links":{"cited_paper":"/paper/2406.02500","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:dcb16ec913e561942a1ac0a4292d082c1870f365d26a4cf1873179c532451f21","observation_id":"12f8360b-5c3d-45fa-adf9-feed04322a9a","resolution":{"observed_at":"2026-08-06T21:52:02.958911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:13.099646Z","title":"Measuring massive multitask language understanding, 2021","venue":null,"work_id":"27956ce5-0182-4cb8-981a-2ea5fa288f9e","year":2021},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:03.058511Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:63bc4ae365c4d16121bc2c003b13509c2cf1cb4a0e81ddcd6e51844782122d71","observation_id":"8bd3cfc2-66f3-4783-8686-5fd3e7403f31","resolution":{"observed_at":"2026-08-06T21:52:13.156053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.954684Z","title":"Manifold learning for parameter reduction","venue":null,"work_id":"d8f47150-1173-4dfa-b125-87e8f0ab6344","year":2019},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:03.145567Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:1772af6cc0113b04446d7919a3eaed9a3270ed9b805fe26b0f1f787da1bc4371","observation_id":"469665b2-edce-444e-8cfd-0da6fc610560","resolution":{"observed_at":"2026-08-06T21:52:13.029198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.855479Z","title":"Mixture compressor for mixture-of-experts LLMs gains more","venue":null,"work_id":"79ab073a-77f9-4403-894d-3e542220a897","year":2025},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:03.218727Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:cc36a3f54cb5f05c86fe2a30abf798d7811b8326bf2a11e7f64c404216a5d9e8","observation_id":"ccabf47d-9a88-4769-a8a5-5fe36342d666","resolution":{"observed_at":"2026-08-06T21:52:12.900921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.735712Z","title":"Ikotun, Absalom E","venue":null,"work_id":"35a8b442-dfa1-4d6a-82e8-74647d299a33","year":2023},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:03.303182Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:6cc363e5199a65d6db8415255101b18c13b9195e603f6095dc3c40c0f66d7559","observation_id":"5a37e8ef-ace2-4d26-a204-3b1b635d6802","resolution":{"observed_at":"2026-08-06T21:52:12.791601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.611677Z","title":"Averaging weights leads to wider optima and better generalization","venue":null,"work_id":"26c35726-66aa-468f-8d10-17935f9effd4","year":2018},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:03.482828Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:866fa18ba37e3bcf323bf09a328979dff2571461f545ac23529f3fd5c5250dc5","observation_id":"989650be-4358-4394-a7a5-2ba16045a54d","resolution":{"observed_at":"2026-08-06T21:52:12.673648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.422570Z","title":"Jiang, Alexandre Sablayrolles, Antoine Roux, Arthur Mensch, Blanche Savary, et al","venue":null,"work_id":"68ea7c0b-4563-4e35-b1bc-52b2a2663155","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:03.937724Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:f4fa6282b3c6b544be8e5ba074058309d2c3eef15c0cd344986230be019c6a9e","observation_id":"de1f4d1f-1936-473a-9873-7c891012f5ba","resolution":{"observed_at":"2026-08-06T21:52:12.516835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19429","last_updated":"2024-04-30T10:17:21Z","snapshot_observed_at":"2026-07-06T18:07:34.924208Z","submitted_at":"2024-04-30T10:17:21Z","title":"Lancet: Accelerating Mixture-of-Experts Training via Whole Graph Computation-Communication Overlapping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19429","snapshot_observed_at":"2026-08-06T21:52:05.302540Z","title":"Lancet: Accelerating Mixture-of-Experts Training via Whole Graph Computation-Communication Overlapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.302540Z"},"links":{"cited_paper":"/paper/2404.19429","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:3173554385321cea6e9c0d2ec58586f1c0f769b1a91fb2fa009776fc2c9b53e9","observation_id":"532c7770-3639-4377-87d1-163dafee60e5","resolution":{"observed_at":"2026-08-06T21:52:05.302540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06211","last_updated":"2025-07-21T09:16:12Z","snapshot_observed_at":"2026-07-06T19:12:57.997252Z","submitted_at":"2024-09-10T04:34:42Z","title":"STUN: Structured-Then-Unstructured Pruning for Scalable MoE Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06211","snapshot_observed_at":"2026-08-06T21:52:05.432000Z","title":"Stun: Structured- then-unstructured pruning for scalable moe pruning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.432000Z"},"links":{"cited_paper":"/paper/2409.06211","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:2c16ea309956db2b51da20277d69d3fba817d6ed8eecb5d5fe8feb32a5eeac7d","observation_id":"060cca54-192b-4a22-a3ef-037cea81d0d4","resolution":{"observed_at":"2026-08-06T21:52:05.432000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.343970Z","title":"Discovering sparsity allocation for layer-wise pruning of large language models","venue":null,"work_id":"c8258614-afd4-40bb-aa0c-0a9400bbf6e6","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.547614Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:ae1bd431104d097011b502270534db1e43288665dac2c2efc130b9207b4676f9","observation_id":"335a3b12-a8c6-4b12-858b-0f4adde417ec","resolution":{"observed_at":"2026-08-06T21:52:12.379512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.286888Z","title":"Branch-train-merge: Embarrassingly parallel training of expert language models","venue":null,"work_id":"3631aaa6-2624-4c87-872e-b05415cd33c7","year":2022},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.619505Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:8fba77a181d4d1a70b046105c46c90496d9995aeda8f412cde782a64f9cf4eb4","observation_id":"5864562e-7c48-4130-817c-ba5df65e76c6","resolution":{"observed_at":"2026-08-06T21:52:12.309242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.244166Z","title":"Merge, then compress: Demystify efficient SMoe with hints from its routing policy","venue":null,"work_id":"22ad1fe4-52d6-4fd1-a1f5-df51e6f932e4","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.681639Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:54b22ffb0ae399013a7fa6864f2133212de6a9c283cd201ea7ac1d96e1389388","observation_id":"75196950-bf2a-460b-aea7-a0eb6af839e5","resolution":{"observed_at":"2026-08-06T21:52:12.278644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.141003Z","title":"Lee, Shengjie Sun, Wei Xue, and Yike Guo","venue":null,"work_id":"4571c2e4-ccaa-4098-be91-53b8ba9dcbba","year":null},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.789154Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:abfe74e70b57852fa9113b0849a4b31932634f18c2a0a714116996ead599da44","observation_id":"1232bffa-8705-4ea2-8244-5898cac5653e","resolution":{"observed_at":"2026-08-06T21:52:12.193812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:12.025261Z","title":"Als: Adaptive layer sparsity for large language models via activation correlation assessment","venue":null,"work_id":"b6677bf4-31cb-486f-bf2c-77ce1bfe5ace","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.883884Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:392bcba558b3a38cab6d487c973240cc599a57ff745fe99737f430c06a1d5f41","observation_id":"8bcdba04-2eb9-40f5-8850-00eba842dc72","resolution":{"observed_at":"2026-08-06T21:52:12.083104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16330","last_updated":"2025-05-17T04:23:58Z","snapshot_observed_at":"2026-07-06T18:35:49.991098Z","submitted_at":"2024-06-24T05:57:55Z","title":"Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16330","snapshot_observed_at":"2026-08-06T21:52:05.975099Z","title":"Pruning via merging: Compressing llms via manifold alignment based layer merging","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:05.975099Z"},"links":{"cited_paper":"/paper/2406.16330","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:82d61671f2995725af2486600b20f3238cbcd9f6fa4fc51e7a5d459762b7bc5d","observation_id":"805f692e-1b38-41e8-8255-d813c251de55","resolution":{"observed_at":"2026-08-06T21:52:05.975099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00945","last_updated":"2024-07-01T03:57:35Z","snapshot_observed_at":"2026-08-05T13:26:03.230242Z","submitted_at":"2024-07-01T03:57:35Z","title":"Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00945","snapshot_observed_at":"2026-08-06T21:52:06.051660Z","title":"Efficient expert pruning for sparse mixture-of-experts language models: Enhancing performance and reducing inference costs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.051660Z"},"links":{"cited_paper":"/paper/2407.00945","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:3147dfe4819374199a734407c1dae9324461be180eaaeed8cd5a277f966a1f0b","observation_id":"7660d774-09ea-415c-9f92-5a4c5e66991e","resolution":{"observed_at":"2026-08-06T21:52:06.051660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.921047Z","title":"Not all experts are equal: Efficient expert pruning and skipping for mixture-of- experts large language models","venue":null,"work_id":"dfbd7630-b798-4fd8-9f48-d91f54c68eac","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.119024Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:1b6a3968405ebf52ab1d6ecb004061a1ff2e1d333599313f6520978552c15b6f","observation_id":"977bd942-0be7-4686-87be-32a1fc2a61cb","resolution":{"observed_at":"2026-08-06T21:52:11.977167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:06.181625Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.181625Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:f4902b5b8681a27e5732b92b109405dfa3fd3dddafbc693c22919435538f6097","observation_id":"d47c490c-7550-4743-839a-d7353713cd21","resolution":{"observed_at":"2026-08-06T21:52:06.181625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.806071Z","title":"Seer-moe: Sparse expert efficiency through regularization for mixture-of-experts, 2024","venue":null,"work_id":"b416bd8b-3e48-4b56-aff6-e8d1d42f418c","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.294964Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:2100f3d76ab61044f9e7aaf86df756046b60f8174aa3c83fb5a2c8890d82868e","observation_id":"e04a2f89-af66-46dc-9663-7d3abf7f2d28","resolution":{"observed_at":"2026-08-06T21:52:11.874556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00918","last_updated":"2026-07-25T23:45:29Z","snapshot_observed_at":"2026-07-30T23:51:50.941670Z","submitted_at":"2024-11-01T14:04:36Z","title":"LIBMoE: A Library for comprehensive benchmarking Mixture of Experts in Large Language Models","version":5},"cited_work":{"arxiv_id":"2411.00918","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.00918","snapshot_observed_at":"2026-08-06T21:52:09.932810Z","title":"LIBMoE: A Library for comprehensive benchmarking Mixture of Experts in Large Language Models","venue":"cs.CL","work_id":"9bfaf970-9acd-4da2-a91f-0eef8b464498","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.379550Z"},"links":{"cited_paper":"/paper/2411.00918","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:1ef830639f9a37817428f62c7f760c443692a9972d92f13ba54943077949662e","observation_id":"251c96d4-4a0f-4673-b87a-39a89bf6e3bd","resolution":{"observed_at":"2026-08-06T21:52:09.978004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.690098Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":"276e0593-d599-4e97-b4ea-8d80a0e49340","year":2019},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.500545Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:b2ab5e579bb739342658e3f6446ce2084b16d74a2c40bcbd67229b4928799c8a","observation_id":"1b87261e-35a5-451d-9d22-cd73f26d36ed","resolution":{"observed_at":"2026-08-06T21:52:11.749991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01483","last_updated":"2024-09-02T22:35:03Z","snapshot_observed_at":"2026-07-06T19:09:27.758765Z","submitted_at":"2024-09-02T22:35:03Z","title":"Revisiting SMoE Language Models by Evaluating Inefficiencies with Task Specific Expert Pruning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01483","snapshot_observed_at":"2026-08-06T21:52:06.633945Z","title":"Revisiting smoe language models by evaluating inefficiencies with task specific expert pruning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.633945Z"},"links":{"cited_paper":"/paper/2409.01483","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:13f9123bb6b136493b52970794147bde02fbf7fe83f48a80988f6368a871c15b","observation_id":"1a310a93-f10e-49ba-9a9e-eae1d95de0b7","resolution":{"observed_at":"2026-08-06T21:52:06.633945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10034","last_updated":"2024-08-12T09:23:13Z","snapshot_observed_at":"2026-08-03T20:04:29.832038Z","submitted_at":"2022-05-20T09:09:27Z","title":"MoESys: A Distributed and Efficient Mixture-of-Experts Training and Inference System for Internet Services","version":3},"cited_work":{"arxiv_id":"2205.10034","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.10034","snapshot_observed_at":"2026-08-06T21:52:09.794643Z","title":"MoESys: A Distributed and Efficient Mixture-of-Experts Training and Inference System for Internet Services","venue":"cs.DC","work_id":"4af1a3e6-a9ae-455e-b45c-10c9a33c3081","year":2022},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.765791Z"},"links":{"cited_paper":"/paper/2205.10034","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:276424dca90c8068e1e9473567dde71cfc518614d2e3248c4b2806a67bedf485","observation_id":"9598610f-07a4-4393-9bf6-397d0a7b4a0d","resolution":{"observed_at":"2026-08-06T21:52:09.856666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.571114Z","title":"Model fusion via optimal transport","venue":null,"work_id":"56bf8510-a5d8-478e-b645-53aa3c723d3d","year":2020},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.846447Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:1998072f6106f30bb073cf19aab5e7d07b24899dc328156d19d39c19385a5734","observation_id":"d69d7939-d2ed-48ca-aaac-6870caef5b32","resolution":{"observed_at":"2026-08-06T21:52:11.625157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.443615Z","title":"Powerinfer: Fast large language model serving with a consumer-grade gpu, 2023","venue":null,"work_id":"4ee4b8bb-331c-471f-8c6f-c47b0c935043","year":2023},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:06.980361Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:d0842b414679ae86ae6975389cc5b8cc135c2058b997310fd25dd7f3c9c5cc97","observation_id":"8c5ebc5b-1e73-40fb-9cc8-085a1bf9339f","resolution":{"observed_at":"2026-08-06T21:52:11.503690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.356532Z","title":"Optimizing mode connectivity via neuron alignment","venue":null,"work_id":"40eb6167-b373-4808-885f-cea34cb0baf2","year":2020},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:07.095636Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:0204ebc51cf0b7198b5840121bddd186af002cbe9d48bf0f70a429a6cf5a3bd5","observation_id":"d209a50e-0fc9-4fac-bd72-4afea493e781","resolution":{"observed_at":"2026-08-06T21:52:11.395508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.226411Z","title":"Qwen1.5-moe: Matching 7b model performance with 1/3 activated parameters\", February 2024","venue":null,"work_id":"f6eceac6-4eaf-4186-8290-fda6e7671191","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:07.161675Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:04b8332e0837bbd17ae7d1c7ba76f4cea2b5a3ec56e8a1bb86e451e9f9c8d313","observation_id":"0a3c2a72-6a81-4faf-bb84-1449b67e2d80","resolution":{"observed_at":"2026-08-06T21:52:11.284321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:11.100265Z","title":"A global geometric framework for nonlinear dimensionality reduction","venue":null,"work_id":"9df3c691-9dca-4771-80d1-eb5ae7e227d5","year":2000},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:07.362394Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:a144119b9dbef8a5e1e335188e2ccfe04c97bf123992a5b1927002c8d89245fa","observation_id":"7b2e7a2c-5630-4a6d-9701-0b023011084d","resolution":{"observed_at":"2026-08-06T21:52:11.169066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:10.946890Z","title":"Parameter efficient neural networks with singular value decomposed kernels","venue":null,"work_id":"389d1f83-0670-4474-a2b5-5a5c651251e0","year":2021},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:07.889514Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:408c18af42d4bb89c6f5b3cdc5d26c09da21fa3df2a1dd56c10de3b658395b80","observation_id":"25d94ba9-1b3f-481b-b2f5-46273b36c9bb","resolution":{"observed_at":"2026-08-06T21:52:11.035586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07378","last_updated":"2025-03-16T03:27:33Z","snapshot_observed_at":"2026-07-06T17:43:05.793351Z","submitted_at":"2024-03-12T07:31:18Z","title":"SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07378","snapshot_observed_at":"2026-08-06T21:52:09.016078Z","title":"Svd-llm: Truncation-aware singular value decomposition for large language model compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.016078Z"},"links":{"cited_paper":"/paper/2403.07378","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:4ac4bcc5de03fa432891fc5adce0e7c510352a390ed7b898fb26619893a49fe8","observation_id":"f9d01e2e-d6f0-440a-9805-27ff984b3b5c","resolution":{"observed_at":"2026-08-06T21:52:09.016078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:10.739148Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":"88b010b9-8706-4c54-803f-3f8d2ce6463f","year":null},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.120012Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:0b11266b261fe060d31ca89b87aa2a8232f497f6ee1d0b8c4071912359677f1a","observation_id":"b8c5a085-80f0-4a44-8a31-38ea07511d2b","resolution":{"observed_at":"2026-08-06T21:52:10.829276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12013","last_updated":"2024-10-15T19:22:27Z","snapshot_observed_at":"2026-07-06T19:34:10.252984Z","submitted_at":"2024-10-15T19:22:27Z","title":"MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12013","snapshot_observed_at":"2026-08-06T21:52:09.202720Z","title":"Moe-pruner: Pruning mixture-of-experts large language model using the hints from its router","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.202720Z"},"links":{"cited_paper":"/paper/2410.12013","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:dbbcb7fcb880cc4ebe8a40ef66a93b27c54a83e06645f100fc8e553e98abaad8","observation_id":"8a9c4c16-8373-497e-ab30-db5d5a85d8f2","resolution":{"observed_at":"2026-08-06T21:52:09.202720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:10.559473Z","title":"Moe-infinity: Activation-aware expert offloading for efficient moe serving, 2024","venue":null,"work_id":"1139c344-3c64-4830-bcf9-bb5d14fa11d2","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.336313Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:bbe62866dad2a032d2fba56eed07246ca805909f21b85d1d98163d4513f2a302","observation_id":"4a382819-d242-4b61-a129-5b03a08f677a","resolution":{"observed_at":"2026-08-06T21:52:10.652432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T21:52:09.444898Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.444898Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:19cb0adc818d5d2411148fcbafc94290dfdc45ec4673ecaf92debf0a3ea9d29a","observation_id":"7f1675b5-920c-4afd-b93d-fdf397cf57a1","resolution":{"observed_at":"2026-08-06T21:52:09.444898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-06T21:52:09.523179Z","title":"Moe-i2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.523179Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:ec2940722df90f27bebc87c0fa05f28cb465736d6e74165ec827f931dc20e162","observation_id":"0272af74-5132-471d-816a-2bfd2ee463fa","resolution":{"observed_at":"2026-08-06T21:52:09.523179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:10.381686Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics , 2019","venue":null,"work_id":"ece63237-62a8-4844-a0ea-605c44aada5b","year":2019},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.609171Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:414db1bcafaeeb65e6f300df013e173d7692b997bf076f112c87a2c37f1d79d1","observation_id":"20950d3a-8daf-4794-85bf-442e0f6280c8","resolution":{"observed_at":"2026-08-06T21:52:10.464408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:10.249896Z","title":"HyperMoE: Towards better mixture of experts via transferring among experts","venue":null,"work_id":"39947ac9-f9a7-49ec-831d-75d98830aa86","year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.670315Z"},"links":{"citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:0fc6652e727780fcd2e93537ad915de614b1f4fedbb98303c897723f8f14d6fd","observation_id":"252b6627-c9de-4db3-874a-0f97c2f97b0d","resolution":{"observed_at":"2026-08-06T21:52:10.328961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":31},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 6 inbound Pith citation observations for arXiv:2506.23266."}