{"as_of":"2026-08-07T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ecde3203e892ed40e2ed100a8fc3ceec07215d0eae4fde88807116f6d876eaf8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:01.959332Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:39:56.545642Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-07T14:23:01.959332Z","title":"Moe++: Accelerat- ing mixture-of-experts methods with zero-computation experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-07T14:16:42.182198Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.959332Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:d322a27f5bfef84802ea9b1df7b6db2502a642f905519f0453ac95ce37503d36","observation_id":"71aaedb7-2d88-46d6-b444-47c72670721f","resolution":{"observed_at":"2026-08-07T14:23:01.959332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-05T21:55:10.476732Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-05T21:55:04.420555Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.476732Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:44d894ac3b016400c704614453c5d331120ca8359ee1e1a130b2c2a9d712f2e5","observation_id":"60b066d4-cd5a-4f24-bb97-1ac7c5b0d370","resolution":{"observed_at":"2026-08-05T21:55:10.476732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-04T14:50:27.505927Z","title":"MoE++: Accelerating mixture-of-experts methods with zero- computa- tion experts.arXiv preprint arXiv:2410.07348,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02345","last_updated":"2026-07-21T06:35:53Z","snapshot_observed_at":"2026-08-04T14:50:24.826478Z","submitted_at":"2025-09-27T10:45:58Z","title":"Breaking the MoE LLM Trilemma: Dynamic Expert Clustering with Structured Compression","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T14:50:27.505927Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2510.02345"},"observation_digest":"sha256:41a54c3dad0cf175d31d3e41a4d2ea4d9a2e9556c9f94fdf9c414c393aa25e78","observation_id":"85905def-4ea5-47ee-a46e-70d9ec76f4c0","resolution":{"observed_at":"2026-08-04T14:50:27.505927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-03T16:21:31.465156Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13996","last_updated":"2026-06-01T21:50:10Z","snapshot_observed_at":"2026-08-07T11:29:22.688492Z","submitted_at":"2025-12-16T01:28:57Z","title":"DTop-p MoE: Sparsity-Controlled Dynamic Top-p MoE for Foundation Model Pre-training","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T16:21:31.465156Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2512.13996"},"observation_digest":"sha256:e29a53a9f7748c7fa63572b2b143efcdb65bca9dba9b79b390ec933e4bdb9e04","observation_id":"24186a55-4f05-4d73-90d4-135a963d702b","resolution":{"observed_at":"2026-08-03T16:21:31.465156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2602.12708","last_updated":"2026-04-21T10:44:04Z","snapshot_observed_at":"2026-08-06T20:06:59.260439Z","submitted_at":"2026-02-13T08:21:20Z","title":"Mixture of Predefined Experts: Maximizing Data Usage on Vertical Federated Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T01:54:30.814618Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2602.12708"},"observation_digest":"sha256:1b2ea54bbff5145ceb49f1bb88f1725ddf0ab89224d43b0d217a9e96c3ef3677","observation_id":"9f44f3c4-82db-47f7-9b8c-1fa6d85b74e3","resolution":{"observed_at":"2026-05-16T01:57:06.084930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.08585","last_updated":"2026-05-09T01:05:34Z","snapshot_observed_at":"2026-07-06T23:20:47.880233Z","submitted_at":"2026-05-09T01:05:34Z","title":"PromptDx: Differentiable Prompt Tuning for Multimodal In-Context Alzheimer's Diagnosis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T01:03:23.712417Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.08585"},"observation_digest":"sha256:25d7bd61b30dfd152e5f8111fe026dd5b0b8c7415063cf9bd97d2c4ccf96a733","observation_id":"a7fea64c-5bf2-4891-9d32-8204ab5c53be","resolution":{"observed_at":"2026-05-12T08:31:24.521393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.14438","last_updated":"2026-05-14T06:33:41Z","snapshot_observed_at":"2026-08-06T21:01:38.107284Z","submitted_at":"2026-05-14T06:33:41Z","title":"BEAM: Binary Expert Activation Masking for Dynamic Routing in MoE","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T01:59:33.047821Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.14438"},"observation_digest":"sha256:b13d9b27256e8705ec72da49706d8424a193efbedc2a0e2328a09433adde0ca8","observation_id":"af064616-f770-404a-bf6c-f6cbf52f64a2","resolution":{"observed_at":"2026-05-15T01:59:38.671477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T12:00:35.496822Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:65bcf29c82d926bda5594b660a5efbce3c20d0d072dfd76feeff35e35c1ae592","observation_id":"2a71f0ac-5951-4357-8cb4-d3b8b1a84efd","resolution":{"observed_at":"2026-05-20T12:03:15.161526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T18:22:45.702572Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:0c9b7be5166fa4e176f05989958b4bdef15986f8357a0ac9bca9004c64beca29","observation_id":"36ffc0eb-8178-4bbe-b71c-02d2dee019d9","resolution":{"observed_at":"2026-06-30T18:25:00.030441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2606.26287","last_updated":"2026-06-24T18:34:00Z","snapshot_observed_at":"2026-07-07T00:00:36.766142Z","submitted_at":"2026-06-24T18:34:00Z","title":"GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T01:32:40.435742Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2606.26287"},"observation_digest":"sha256:09675831222081f4e94804ad2651d8f8ee5d2fdf31012a185d2df8eedb340551","observation_id":"0425ad2c-0526-4edb-9692-949509b196cb","resolution":{"observed_at":"2026-07-04T15:39:56.547923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:3487be8f7d1d9102b0b9ee6aa66568814f347ac70aee80c53f4330853626f2d9","observation_id":"f64a9024-9b81-4c66-a70c-9ad90887a5ed","resolution":{"observed_at":"2026-07-02T15:17:07.214080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.07348/citation-record","integrity":"/paper/2410.07348/integrity","json":"/paper/2410.07348/citation-record.json","paper":"/paper/2410.07348"},"outbound":[],"paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2410.07348."}