{"as_of":"2026-08-06T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1faa217230950f3cd7a33410f532cef8a768ca72a2c14d1ed59701bf33b1ac0b","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T07:33:31.233659Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08782/citation-record","integrity":"/paper/2607.08782/integrity","json":"/paper/2607.08782/citation-record.json","paper":"/paper/2607.08782"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"The llama 4 herd: Native multimodality with a mixture-of-experts architecture,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:9cf2db5bb0bce8cab65591cb30ec3ddae1db9f0d365339a33c1b87ccaf849fc3","observation_id":"71c0feb2-454e-43a2-a59e-0918221ad819","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:8a678aa7ab9a422f826cb08da7b0d618492800ded25d81bba31e88cc38dc11cf","observation_id":"48494770-eec2-44f4-8c50-deb0ede79d68","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:5ff3eeffefcaf0a184781f6a1c5e27ffbfc6467a355fbc9ba6953384dcd25468","observation_id":"18e0be56-6e26-4f66-a104-7984db799e4c","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:5d574b5fe961809bc4ad7aab3e1f4e5ffd69da9f9cb86b3b27f63865ddf29431","observation_id":"f3b369a3-e028-4566-b453-de0b06b67d43","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepseekmoe: Towards ultimate expert special- ization in mixture-of-experts language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:b0b96506d2f1c2f75bf0954cfb8314fee294c4100417da0ab26a382aa408a01e","observation_id":"2f6b8dd7-222e-4ef7-8749-f57edca5d5d8","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:b08c3c24d0bb3b137192633c3f206381a5789f613facc96d8f6ebca116d60cf6","observation_id":"b1b2d8e5-a5d8-4b8f-8d87-71ca2e652886","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:913e12070fc9d9cf1c097e6f4cd10173bba30ff684a76cdcab6cf7d599c3a829","observation_id":"bea30814-d9e0-4b9b-ba02-7f3b80652752","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:232c9dad7d0940b91063503e21cc18d18c49831c163e374d4d6ce81564911214","observation_id":"b7145a54-95c9-41ca-a992-a8fa5507a256","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:04074b487b7bb4809d5e4f1c812eb8f91cc41e6cb9818ba779ea0e35a18026ae","observation_id":"32ccd246-4750-4998-a950-14c421ec618e","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Training and serving system of foundation models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:8160fb7e0e6cb241e61343e6e15aad82cde758d7aa9300275dee0fe47d3cf4cc","observation_id":"be38d49d-9f9f-4106-a249-727b50e1c613","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-07-06T09:33:58.857566Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:6d97c3b10a30b71b03d4f2978b965da8700d3efa43fe1e2ae391bd28217d616f","observation_id":"0b707fd0-2320-4a08-8605-a777043164e0","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Expert Parallelism Load Balancer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:54948566325e91bf4ffdea88f3676d4aa7d2c9a6a82667df2ae23a51fd21e6f2","observation_id":"bbe6a236-87ec-4f2a-8ce0-081dd5b14598","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06643","last_updated":"2025-02-10T16:34:36Z","snapshot_observed_at":"2026-08-05T04:45:35.671678Z","submitted_at":"2025-02-10T16:34:36Z","title":"MoETuner: Optimized Mixture of Expert Serving with Balanced Expert Placement and Token Routing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06643","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Moetuner: Optimized mixture of expert serving with balanced expert placement and token routing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2502.06643","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c9efaac9a4c2f3cebf1455bac5ad8e8f797224c89a78db9943eda088d39fe256","observation_id":"24f749bb-d31b-4939-8969-0157822bdb8f","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Fastermoe: modeling and optimizing training of large-scale dynamic pre-trained models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:e8d3682bd4aa037839d14555379abfc2433c92e9773560f26adff66617e519d8","observation_id":"cddb2fcc-6a73-4f92-b880-dc3ef26b1bfc","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Flexmoe: Scaling large-scale sparse pre-trained model training via dynamic device placement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:7d3053c59d015d6f55f9569b0a1fd5b3cf3454d66f8c69db60281a9831f6fcdc","observation_id":"c78b379b-df68-4619-8db1-9858a59402b0","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Tutel: Adaptive mixture-of-experts at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:db644f98e713ab816d9bb5622e3c0c51ee3c43b2728629423090fecf596f0119","observation_id":"74586f9a-5891-4573-9cb6-2fed3ee064be","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Smartmoe: Efficiently training sparsely-activated models through combining offline and online parallelization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f8a668f6f7e1bfa7627e3c54015ffd92406241689d20e2824e918258cc6d889d","observation_id":"fafe8728-0916-4fe6-a9d7-0ef069f784fd","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Janus: A unified distributed training framework for sparse mixture-of-experts models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:a1bdfd6e86036961725d43f807b9509f78e23a18844e1c19f5a0f8b744453e43","observation_id":"ccfb7257-2d96-4479-bd40-be44abe62166","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"A branch-and-price algorithm for the generalized assignment problem,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:b90e45ab42a2a64f391856e0a58757dd6f14f665a3417cddab3f0eed68c8803d","observation_id":"b107627a-7203-4562-8eaa-cf9274888b8f","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:0a4006643ef9997eedcde1c642dd0fffd402c0546098cbed2518ce436409425f","observation_id":"c2005257-f228-46cb-8b67-b80488bd173b","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Not all experts are equal: Efficient expert pruning and skipping for mixture-of-experts large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:ac2274902b82ec7c813b7bbeae0969de78e5c0946c73cac926d705f03087545a","observation_id":"3d59945a-81e2-4493-ad5b-3d63ea496774","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00945","last_updated":"2024-07-01T03:57:35Z","snapshot_observed_at":"2026-08-05T13:26:03.230242Z","submitted_at":"2024-07-01T03:57:35Z","title":"Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00945","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Efficient expert pruning for sparse mixture-of-experts language models: Enhancing performance and reducing inference costs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2407.00945","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:4774a63e71fcddf17686769978e3288c29e150c880b7ec8377e7ae0152cd9ffb","observation_id":"331452d3-39fa-4727-a2c2-478da7597b75","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Ta-moe: topology-aware large scale mixture-of-expert training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:52db98c789ef06cad31c33a0c10eee086877bf297c46058df60985d75a03918e","observation_id":"94ddfb38-3c0e-445f-b4aa-16d41209b88e","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Schemoe: An extensible mixture-of-experts distributed training system with tasks scheduling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:98340b3c6882eec585651734fdfca2822b576cff40b369a85840b2626628b678","observation_id":"841e3ee0-2273-4423-8c2f-e9876c47a1e4","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Fsmoe: A flexible and scalable training system for sparse mixture-of- experts models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:9ba275017337146fa75364e90a191f1348e3bf5f0c34232fc4f7bb738749b4b2","observation_id":"c1906339-2fb5-4bb6-806a-4533246a13f5","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Pipemoe: Accelerating mixture-of- experts through adaptive pipelining,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:6e5474a7d9acb1b01f0373dd150e53597fe44855093cb233803d4213ab3cac6b","observation_id":"7820b9a8-a016-45c4-81f2-e6c1421539a6","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Klotski: Efficient mixture-of-expert inference via expert- aware multi-batch pipeline,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c0a2130e15296a4c7e8b71b9d89b7889b3d28ce2407df0a05198ba5bfb07bab5","observation_id":"f97f1395-c9a5-4006-8c38-2d3ca225806d","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Parm: Efficient training of large sparsely-activated models with dedicated schedules,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:3cb9c07a1cdf9112e6adec45f317d3c8d37a6956da8764860fe72d84cc2850c2","observation_id":"f0ba0975-dc1d-4c19-95d6-b7b35fcfc859","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Expertflow: Optimized expert activation and token allocation for efficient mixture-of-experts inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:04a97c08fb78b9be6520e5a84eed81b5abc44391d3c74ecba5bb0bfdbf6e7e01","observation_id":"8a3cca7c-417a-4e5a-95db-0327bfd5738f","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Netmoe: Accelerating moe training through dynamic sample placement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:7ab80c20e8757219ccfa8d034438ffb38c1af1c2dbf0a33888d5673c6badbc8e","observation_id":"d86a64ba-7f11-4099-86a0-2edbbba1cadf","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Communication-efficient sparsely-activated model training via sequence migration and token condensation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:9df46a20cf45e33538b6f4f5ceab64b2273473625729fa575b269d76b6be5631","observation_id":"123b17a5-97a2-4d20-b60a-a87de76a0b84","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"{PopFetcher}: Towards accelerated{Mixture-of-Experts} training via popularity based{Expert-Wise}prefetch,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:d506952d793cbe88cc9d488257621e2d48c66b03c001e5028c57ed1c293835f2","observation_id":"4c58dac2-856e-4c2b-b276-5e56a7dfbb84","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:3d31e9401ac568529dc2fb5b2d14e4742349ac38e038546a5e7e11e4c1e90a4e","observation_id":"a6c6aaf9-5c03-4fac-bdd8-c85e6d8dafb9","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Let’s verify step by step,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:1f8eb582847a9d993e7eb1270dea5aec8e22ce07c3f801636ba0c985fab82487","observation_id":"e9b0cdf9-1c1d-413d-94f9-79187c4b3fd6","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:428cadef61814cf818c376f008c9bad2c3bc8906c38a83865a14d40ae4984a10","observation_id":"77e01d70-f73b-4627-ab4e-faddceecc7bb","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Sida: Sparsity-inspired data-aware serving for efficient and scalable large mixture-of-experts models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f57c2c5b148cafb9f8b79f26e0bf7477fa47079bc025aeddb99c2dde669eff7d","observation_id":"e6faae90-ae8f-448d-80ae-182c0136819c","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"D2moe: Dual routing and dynamic scheduling for efficient on-device moe-based llm serving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:8f79e8f54e76da0d8622863863e32b0951977845c25dceac2fd001275c2a7c75","observation_id":"c8d1d64e-c068-4277-91ef-084b3ea4656e","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"On tail probabilities for martingales,","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:4e7b175696db1f5ce1d0830fd5c0aa02f6a9060c86bea0d09713bafbb3e6e570","observation_id":"956de3b5-8403-46fd-b8f7-39f8579d400a","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Approximation-friendly discrepancy rounding,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:d30c63986148de09ebf7bbc94fad9190071e5f8a1545bca57262ebda06633c00","observation_id":"028ef24d-fbed-4d1d-8fe2-e5df50c91534","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Constructive algorithms for discrepancy minimization,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:12cdddddfa8c01c745323b3d7df9397f279fda0c37f8b38e8928a40355676d11","observation_id":"4598b9de-4a95-4b56-a6ef-0d41ab7190b2","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Constructive discrepancy minimization by walking on the edges,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c63bfa724b6e382147bca3f297d30c7d466e16b6dd82b0309823882ccf1c0c0a","observation_id":"cca1fb54-86cb-4c2f-9f1b-ae856b7140a1","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:8565bbb83f886000f598c891e8ca88f62f5635684fd1718585b36fed00ef6804","observation_id":"69dba63c-6654-492c-b57f-959fafb26a4d","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Colossal-ai: A unified deep learning system for large-scale parallel training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:26b5532c19bf7a8be9a5c0e5886b60752f7c370154881261167a7cd1acd7c668","observation_id":"92948a4d-ada3-452c-9b64-82e238762421","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"SciPy 1.0: Fundamental Algorithms for Scientific Computing in Python,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:6f28a553c78795c1ec56be830c4ef0dfc5d588f40a6a5c69a605f0a79ac27100","observation_id":"9f6a9bee-96a4-4073-a222-2c0425e81814","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c436a025603fc25bd11c8d971c8247cd34a67bdd27d14aa88f6e45c8ead9c8fa","observation_id":"7b0199b4-506e-474d-bfc8-aa45181ed28a","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:43dbab73bf11a83bcc8709dd8a28e729076a580486624ac3387ad23e77440e7b","observation_id":"6ad07ccf-7bdb-46fa-9321-6577a8bc15a3","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepspeed-moe: Advancing mixture-of-experts inference and training to power next-generation ai scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:e7ce5a83ac1a33fb9ca42c5ea0a00a7b70c1263f789c79ec6f0efdc66273716f","observation_id":"aa84e84b-573e-4dd3-be77-850c19cb1365","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T15:02:48.696487Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2607.08782."}