{"as_of":"2026-08-08T00:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f7c4ecfd38e7370d1cafd77ebe52aedc13e9df5eb431b602aa2c0bc304ffcc7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:52:09.523179Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T17:14:57.406110Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-06T21:52:09.523179Z","title":"Moe-i2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23266","last_updated":"2025-06-29T14:43:50Z","snapshot_observed_at":"2026-08-07T02:39:39.049338Z","submitted_at":"2025-06-29T14:43:50Z","title":"Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:09.523179Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2506.23266"},"observation_digest":"sha256:ec2940722df90f27bebc87c0fa05f28cb465736d6e74165ec827f931dc20e162","observation_id":"0272af74-5132-471d-816a-2bfd2ee463fa","resolution":{"observed_at":"2026-08-06T21:52:09.523179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-05T11:30:14.314029Z","title":"Moe-i2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02753","last_updated":"2025-09-02T19:01:46Z","snapshot_observed_at":"2026-08-05T11:30:11.536139Z","submitted_at":"2025-09-02T19:01:46Z","title":"LExI: Layer-Adaptive Active Experts for Efficient MoE Model Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:30:14.314029Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2509.02753"},"observation_digest":"sha256:79d0f2980bc470c3ed4ab0175eeca33c7c81116de754b835568eb019cd062828","observation_id":"adc35558-fd31-43f6-910d-11c348de5fea","resolution":{"observed_at":"2026-08-05T11:30:14.314029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-04T17:57:25.224160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-05T12:09:01.164266Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.224160Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:318e5d29e504e1b1a327a058d5486006853c6dfc5d95ee8413f3e60e8684174b","observation_id":"c3df6d3c-33f2-43a4-89fc-75718c3ca28c","resolution":{"observed_at":"2026-08-04T17:57:25.224160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-03T23:41:52.927468Z","title":"Moe-i ^2 : Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.04805","last_updated":"2026-07-06T16:04:54Z","snapshot_observed_at":"2026-08-07T10:51:08.099986Z","submitted_at":"2025-11-06T20:53:02Z","title":"PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T23:41:52.927468Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2511.04805"},"observation_digest":"sha256:8801d95d4de4209c30045f304c11ef49b24e731e40f285a7d034dec8701fda51","observation_id":"c986254d-4e84-45a7-81e5-e58639686ea9","resolution":{"observed_at":"2026-08-03T23:41:52.927468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-03T09:32:55.511235Z","title":"MoE-I 2: Compressing mix- ture of experts models through inter-expert pruning and intra-expert low-rank decomposition.arXiv preprint arXiv:2411.01016, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.13563","last_updated":"2026-07-08T11:01:48Z","snapshot_observed_at":"2026-08-07T13:12:39.905456Z","submitted_at":"2026-01-20T03:39:33Z","title":"ButterflyMoE: Compression-Scalable Ternary Experts via Structured Butterfly Orbits","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T09:32:55.511235Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2601.13563"},"observation_digest":"sha256:806f134a9db36e3b809003196e602a1a5ad4108805d2c8df4c88f8e1b00f7a9d","observation_id":"ba5cfb40-d5cc-4cea-be5f-101809737376","resolution":{"observed_at":"2026-08-03T09:32:55.511235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":"2411.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-06-30T17:14:57.406110Z","title":"MoE-I2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition.arXiv preprint arXiv:2411.01016","venue":null,"work_id":"b87cc1de-d454-4981-9c3f-f1d1742d40ac","year":2024},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:69300bae32032cf7303cc503c5333430ce05f96a15d2e09ab3dc103763880d03","observation_id":"cd1471e9-d9dd-431f-b701-928b761f5709","resolution":{"observed_at":"2026-05-15T14:35:55.646451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":"2411.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-06-30T17:14:57.406110Z","title":"MoE-I2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition.arXiv preprint arXiv:2411.01016","venue":null,"work_id":"b87cc1de-d454-4981-9c3f-f1d1742d40ac","year":2024},"citing_paper":{"arxiv_id":"2603.18297","last_updated":"2026-04-03T22:50:01Z","snapshot_observed_at":"2026-07-06T22:49:37.944352Z","submitted_at":"2026-03-18T21:35:53Z","title":"Path-Constrained Mixture-of-Experts","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T09:16:06.226566Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2603.18297"},"observation_digest":"sha256:da0e838dd34692b982768e132ad48d061d95fb927f4af48d0a6a82bf9469e88a","observation_id":"db7cfda7-5df8-4f90-82bf-f193ef37c6fb","resolution":{"observed_at":"2026-05-15T09:19:54.276593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":"2411.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-06-30T17:14:57.406110Z","title":"MoE-I2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition.arXiv preprint arXiv:2411.01016","venue":null,"work_id":"b87cc1de-d454-4981-9c3f-f1d1742d40ac","year":2024},"citing_paper":{"arxiv_id":"2604.02715","last_updated":"2026-04-30T13:29:54Z","snapshot_observed_at":"2026-08-06T09:38:08.450828Z","submitted_at":"2026-04-03T04:16:01Z","title":"FluxMoE: Decoupling Expert Residency for High-Performance MoE Serving","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:16.466375Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2604.02715"},"observation_digest":"sha256:754ee047381239259937c496977fa73c54dcf18df3ea9a0cbbcfc4e440f1e50d","observation_id":"95615c89-1ce1-4a93-948e-e8717e670abb","resolution":{"observed_at":"2026-05-13T20:18:13.280550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":"2411.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-06-30T17:14:57.406110Z","title":"MoE-I2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition.arXiv preprint arXiv:2411.01016","venue":null,"work_id":"b87cc1de-d454-4981-9c3f-f1d1742d40ac","year":2024},"citing_paper":{"arxiv_id":"2606.00079","last_updated":"2026-05-22T13:05:53Z","snapshot_observed_at":"2026-08-05T07:27:21.222843Z","submitted_at":"2026-05-22T13:05:53Z","title":"BitsMoE: Efficient Spectral Energy-Guided Bit Allocation for MoE LLM Quantization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T15:38:18.616792Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2606.00079"},"observation_digest":"sha256:f2726d37f723fd2a4fecd4f53da668f4956038ad7a9937676d2bcc9834d021a7","observation_id":"d58bc009-1d59-459c-9739-63e84a7a37cd","resolution":{"observed_at":"2026-06-30T15:44:48.466223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":"2411.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-06-30T17:14:57.406110Z","title":"MoE-I2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition.arXiv preprint arXiv:2411.01016","venue":null,"work_id":"b87cc1de-d454-4981-9c3f-f1d1742d40ac","year":2024},"citing_paper":{"arxiv_id":"2606.29982","last_updated":"2026-06-29T08:57:59Z","snapshot_observed_at":"2026-08-06T21:47:26.917202Z","submitted_at":"2026-06-29T08:57:59Z","title":"Beyond Uniform Experts: Cost-Aware Expert Execution for Efficient Multi-Device MoE Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T04:27:02.915854Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2606.29982"},"observation_digest":"sha256:74fa8b77fec3eede35caec98756d040137468ff6cefe66026eeb72f746cf7223","observation_id":"528da36e-b37d-4f86-af60-f3647c4a628a","resolution":{"observed_at":"2026-06-30T17:14:57.407554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-07-11T08:35:22.347459Z","title":"Moe-i 2: Compressing mixture of experts models through inter-expert pruning and intra-expert low-rank decomposition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05116","last_updated":"2026-07-06T14:06:25Z","snapshot_observed_at":"2026-08-02T18:01:37.878392Z","submitted_at":"2026-07-06T14:06:25Z","title":"Communication-Aware Placement and Pruning for Efficient Mixture-of-Experts Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T08:35:22.347459Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2607.05116"},"observation_digest":"sha256:56ffcf8e5b73de899809f9d178a898d046927453b2593aac08d24a645e7a0f06","observation_id":"49ffc646-cb1b-4427-b0e8-255ff2f9e063","resolution":{"observed_at":"2026-07-11T08:35:22.347459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.01016/citation-record","integrity":"/paper/2411.01016/integrity","json":"/paper/2411.01016/citation-record.json","paper":"/paper/2411.01016"},"outbound":[],"paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T19:43:55.074449Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2411.01016."}