{"as_of":"2026-08-07T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18f2530e4c03ccb58038d6a6802649df01ab0b70c71f67a387cd98d5e8a5828a","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T04:35:53.249194Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.04101","snapshot_observed_at":"2026-07-14T04:35:53.249194Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11586","last_updated":"2026-07-13T14:05:55Z","snapshot_observed_at":"2026-07-16T23:19:54.710114Z","submitted_at":"2026-07-13T14:05:55Z","title":"HCRMap: Pressure-Aware Hot-Expert Residency Mapping for 3.5D MoE Chiplet Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T04:35:53.249194Z"},"links":{"cited_paper":"/paper/2606.04101","citing_paper":"/paper/2607.11586"},"observation_digest":"sha256:d7255c5bf79a7bb9f9b6b3544debc3b2a7268fb2cf355d233eb9f050b0879943","observation_id":"354ecbd9-eb8d-4d1c-88d3-558b63e0b2d6","resolution":{"observed_at":"2026-07-14T04:35:53.249194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.04101/citation-record","integrity":"/paper/2606.04101/integrity","json":"/paper/2606.04101/citation-record.json","paper":"/paper/2606.04101"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:5516af2171a979d93b8e6c90070e839a644092a9e8af50d91efd9c12f39b3e71","observation_id":"cf8afbd3-09ab-4656-8f12-67e141a8230a","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2025.AMD Helios: Advancing Openness in AI Infrastructure Built on Meta’s 2025 OCP Open Rack for AI Design","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:79099898a214dc9915cec7dca40f479c5279801c35f94be6857cace9060f0412","observation_id":"bbe22d78-7f87-4fea-8f88-d265be9da37a","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.172","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongBench","venue":null,"work_id":"334e52dd-5eee-49da-94cd-26c0028afe5c","year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:32c78b021b7dae337586d53e37af18c3d927044216851a920eb82a1ac76f0d50","observation_id":"80a7512c-2d89-4104-a969-ad04bd04b93a","resolution":{"observed_at":"2026-06-28T08:11:49.679076Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:42.194817+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:42.194817+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06174","last_updated":"2016-04-22T19:21:36Z","snapshot_observed_at":"2026-08-04T13:01:58.606241Z","submitted_at":"2016-04-21T04:15:27Z","title":"Training Deep Nets with Sublinear Memory Cost","version":2},"cited_work":{"arxiv_id":"1604.06174","doi":"10.48550/arxiv.1604.06174","metadata_source":"pith","pith_arxiv_id":"1604.06174","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Deep Nets with Sublinear Memory Cost","venue":"cs.LG","work_id":"f2c5c287-a500-40e4-a136-e7e3172db1d7","year":2016},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/1604.06174","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:14cca34bd78ad85881c6ed12164babc9e8e98971232c720784e4de65361ed6bd","observation_id":"0416afab-cd8c-46b0-9233-bb18c8e0ff90","resolution":{"observed_at":"2026-06-28T08:11:49.711238Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:9a7335676fafa72ae57db3a353beacba2bc99f964138d9b098d8a735c6be3167","observation_id":"dcd5ba8c-8dd9-4e7d-a89d-ef6e295e0577","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"Xu, Huazuo Gao, Deli Chen, Jiashi Li, Wangding Zeng, Xingkai Yu, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:af36423058a1aed35bc137361d7c76a67bdc647c770e4a0eb9b8f972ef26508b","observation_id":"b98b16d3-e65e-41fb-87a0-12b6b800449c","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:b4b10ca3f8fafb98c029b1c7e761a6b59d64f2e12333a30812de3c3caaaf2504","observation_id":"e7795d99-4aea-44a0-9f10-0b1cccf5ac4c","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:69abfed974cb779af5ba09b6a7b3a589e0a3d1a7705066641d287998ec2257d9","observation_id":"2b988d56-a618-4474-bbe8-942dca06b801","resolution":{"observed_at":"2026-07-02T05:26:40.128007Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:c396b085ca3d4ffa71defde3958b855b39763fd1aa626edd32de7b6874c15aa4","observation_id":"928ccda0-51dd-4afb-be83-6c9a49b42f46","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:d6dfce8eae06c470372d92054b670a4ee406639304a19c3e2ed0b0a79b9ef210","observation_id":"d310e5d2-4bc7-4e3a-a5bf-6f8842757235","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:252ee78f0e3dd8cc791e0458339c37bb2c7cd9a20b316a778a5729085809e52d","observation_id":"0557d1a0-65bc-4d62-842f-a8acc63994bf","resolution":{"observed_at":"2026-07-02T05:26:40.116283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:a0a1dfbe81d1732ff27a1fb1fa31a11f00d055b5e0a3c06d449d448b75479887","observation_id":"431c22c3-5fd0-4597-95d0-1b03ba7b5fcc","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:236ddb850ddcf24d720088064573b1c524d894f9df14f17f4e21ccec8179bb2f","observation_id":"8883b628-505a-408b-b23c-d94a10ca88e6","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:42b4fc06eba1231d0d977a4191945ce66cbee7ad907f0e9e821131dec09cc026","observation_id":"76f7780a-2aa0-472f-8537-074075368924","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:3d1d2ea4ee730492451dc97838af255911c680392158c0be37dfc898a83ccab9","observation_id":"9be6e23f-54a9-410f-ac8b-4d015f0ea67b","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2026.GLM-4.7: Advanced Agentic and Reasoning Founda- tion Models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:15f0406617d7a91f2a22627312f927ca1b87f345503ca6c19858a5b390920b6c","observation_id":"45d438f3-26df-44d4-b2c5-12d58a5c9d40","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3221.350841","doi":"10.1145/3503221.3508418","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FasterMoE: modeling and optimizing training of large- scale dynamic pre-trained models","venue":null,"work_id":"3fec1f4d-a828-4fc2-b20d-e275c8e8eaba","year":2022},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:82c095c38ccd88a447901c14bdf0476d6c9b21ea5df0fe25e240f22eb603fda6","observation_id":"f5ba5056-2077-4b21-9b31-d2d5c71dfc26","resolution":{"observed_at":"2026-06-28T08:11:49.713811Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:52.198876+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:52.198876+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:08f4126514d3c57c41af37be12c253f4fdf523d7318c7e4bc1d22ee94aff4d9b","observation_id":"d3dffff8-e3d5-4df9-b731-cc94617d208d","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:5c5ed722124f83c417e55dd75d22e7d167bbe93191eccb0d1b3c5a77b46ce36c","observation_id":"82bbc973-ed0c-4af6-92b9-280d5ecf9b7a","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"InProceedings of the 6th MLSys Conference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:6182c08cb1d71a08ae8874507b7db06c9c4f94bc916b760c9a78a235f6c2311e","observation_id":"78516165-5bca-4913-b54c-c28a1e5e8da7","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:5cdb4845286dd7825d97f2ecc7a8eafe8b9bda2ec8a4ea5c476f8dcc46fb9c1e","observation_id":"3085f6f6-387a-4960-b5ce-b0a03111d162","resolution":{"observed_at":"2026-07-02T05:26:40.125586Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:58642ee4d102fe6d8f5fc98d302f59375d473651187ec8f736b834d77a499e15","observation_id":"4f379455-5fb0-4c69-90e8-090419fe8784","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.11432","doi":"10.48550/arxiv.2505.11432","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:43.805821Z","title":"Megascale-moe: Large-scale communication-efficient training of mixture-of-experts models in production","venue":null,"work_id":"d2e5a111-b10c-463f-8ca7-b88ca8a6ff29","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:6ef6c066587a5faee898dc76ee6e4fffbb415c40eded8f9e7f35fe4075ccc9cd","observation_id":"e87597d7-8869-4776-8248-8d36a35cb842","resolution":{"observed_at":"2026-07-02T05:26:40.114033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:4b7f4e4f76247cb3ddb1c15c088943f5fb69490496a772f6999f1a1d0e40aa86","observation_id":"7da89712-984d-4a0e-9b8b-2eed1b354308","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:4a1c14bd1b99582fda921f3ffb8d1a9d4028ddbe215d80702ec8f9c248f43dbd","observation_id":"d71e1c3a-63bf-4ca3-b287-594239152667","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3600006","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"H., Gonzalez, J","venue":null,"work_id":"eaade690-f526-41e4-af5b-9da4898243e5","year":2023},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:2ccbfe4d0a9f9b082643cee1851d12048cba13c3df9757f4ab1ed3cb24d6bc87","observation_id":"beeef076-684a-4b99-8e36-097f668080f6","resolution":{"observed_at":"2026-06-28T08:11:49.677248Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:c98b3cc8cc53845af19a4522fe89833918c76258f126d8f5199d530315c4133e","observation_id":"5e9d8812-9c89-4728-9f78-aef632fc444f","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3458817","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SC ’21, Association for Comput- ing Machinery, New York, NY, USA (2021).https://doi.org/10.1145/3458817","venue":null,"work_id":"1c0c3d97-ad46-492c-abbd-7149df4b0d70","year":2021},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:4ab26e74f33bf443b42699ac4adbe22a164d7614b321cb83e10372408f9c0c5d","observation_id":"67988bc9-9fa4-47fa-925c-afbe6baf61b3","resolution":{"observed_at":"2026-06-28T08:11:49.702140Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:1f48459110a6c4ea2b9ac1a6848d27f4ee762ff5464235c8ec1a7a7157118759","observation_id":"44e9f6d2-acb8-40c6-96a8-896c898046f1","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:086571b8d8667629009ed4a5808d7041a5cc5a5a305bbb00fb74bff3393412fb","observation_id":"e0234c76-e760-4635-8745-c6391c9a7d3e","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:913355552d1a088233cbaea54112f8b3a0dbc3fc7f2b3eb285916b6611ebdf34","observation_id":"b5ee2056-54fa-497c-822d-5db1864b40b3","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.14960","doi":"10.48550/arxiv.2504.14960","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moe parallel folding: Heterogeneous parallelism mappings for efficient large-scale moe model training with megatron core","venue":"Open MIND","work_id":"c907419e-5e64-4e38-aece-ad5867bcef05","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:10f64121e1552ecb90c488afcfe77b717285062fd618475352e772bf12adbc49","observation_id":"533a9bb5-f0f0-48e2-b4aa-8b08e75615b3","resolution":{"observed_at":"2026-06-28T08:11:49.675274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3269.360486","doi":"10.1145/3603269.3604860","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving network availability with protective reroute","venue":null,"work_id":"136a5560-5326-405d-8a2d-da1f553dbdf8","year":2023},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:f5868794a72f32ad4df91852b8d6de683b48e423dadbcba806fdb01c4713c4f2","observation_id":"ae75a8c6-9fcd-40e8-bee8-1878ea778b07","resolution":{"observed_at":"2026-06-28T08:11:49.704835Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9212.379018","doi":"10.1145/3779212.3790180","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LAER-MoE: Load-adaptive expert re-layout for efficient mixture- of-experts training","venue":null,"work_id":"eb40b26f-cbec-496a-b387-10dcf613b7c4","year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:18ceba578842913e7dd694fd6a18b0d4bccb2b8e73189a234aea8b9377e27f70","observation_id":"2915fa2e-646c-45da-864c-01e2ab1e96b6","resolution":{"observed_at":"2026-06-28T08:11:49.697876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:50.805905+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:50.805905+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.19849","doi":"10.48550/arxiv.2512.19849","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UCCL-EP: Portable Expert-Parallel Communication","venue":"arXiv (Cornell University)","work_id":"9a6a4508-3329-42b8-b6c5-90e4e59c5c65","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:8a8f0b05b7e9d5bd55634adc0f98e49911685445c71ec73692215e87ac24d093","observation_id":"9bf7dda2-2829-45f3-86e4-958b8fd4692f","resolution":{"observed_at":"2026-06-28T08:11:49.707344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:7ff930210726de7901fdb60b598db43c225cf6b68c4427e69adec5b188062d99","observation_id":"a9372b82-b588-40f4-adff-c81994bc29d2","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2026.Driving vLLM WideEP and Large- Scale Serving Toward Maturity on Blackwell (Part I)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:66b89df7c7950da56d1d681e65193bfc973a5962fde0a903c7dd901528a2acc4","observation_id":"8f6ac7fe-be5b-4fda-b2bb-61131353c4cf","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1301.335949","doi":"10.1145/3341301.3359490","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":null,"venue":null,"work_id":"ecd17d6f-fe87-4358-9154-3cc2f7070ca5","year":2019},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:ea7ca8bb10d9cab91425910769c34304dccc15e46307467ab053b2e5ae8f59df","observation_id":"7b248074-f50c-42cf-9942-bdd8e00eb2c7","resolution":{"observed_at":"2026-06-28T08:11:49.716815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:c6b50e62ec03dc4b018b60dcd227029654bbe386bf887f1aae5c3c62498aa583","observation_id":"18e424d8-dad5-41d9-aa88-707161824d6b","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3588964","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lu, P., Bansal, H., Xia, T., Liu, J., Li, C., Hajishirzi, H., Cheng, H., Chang, K.-W., Galley, M., and Gao, J","venue":"Proceedings of the ACM on Management of Data","work_id":"61cb5a0e-a898-44bb-93eb-25cb99960865","year":2023},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:61594215e611f5e3bffa39688e92c8af724e32a2710d25ad6b3a28f5b2efc0ff","observation_id":"f86ace38-47fe-4c8c-992b-ef59158e6f18","resolution":{"observed_at":"2026-06-28T08:11:49.690484Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T20:49:12.529031+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T20:49:12.529031+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:15a53321ce47b2805c29189950888994fd3404832a5fcee2a7a5a3e4e985d665","observation_id":"73757e30-5a7b-4fd8-ab96-cffc5442bb37","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2024.NVIDIA Blackwell Architecture Technical Overview","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:d44e9c9dfd8cd4f3bee124aaa592fa7dbea708460855d7a7fd871a92072ef476","observation_id":"22710105-3327-46c0-a561-920b50b46b1c","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2025.NVIDIA NVLink and NVLink Switch","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:91a8baebe6cf3731a8b87ac45bc4540d7892ebe245092d403c6ca6fcdbe0c881","observation_id":"3e477079-7ec1-4737-9d73-b89a4a6c7103","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:885cb000b592e64003796765c26e11f2f6cf4b850e1b1f265bad625f1aa7378e","observation_id":"cd7e5ebb-61bd-4b80-96a5-4a2d933e8e2b","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2026.NVIDIA Vera Rubin POD: Seven Chips, Five Rack-Scale Systems, One AI Supercomputer","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:c7abb2b3271d2ec639b1aab14c4ec05094fc22e7b785488b6d84cb79857ade96","observation_id":"7f8e3de4-d663-4e40-b19a-d6c86c19b7f6","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:ea2a8b8c22e76c03490abdd0862389a01527a009415b48501849179568a6614e","observation_id":"877e47d5-2984-4ad4-8b9e-c21dece56151","resolution":{"observed_at":"2026-07-02T05:26:40.109218Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9940.370727","doi":"10.1145/3669940.3707272","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moat: Securely mitigating rowhammer with per-row activation counters,","venue":null,"work_id":"54b481cb-3d17-4701-a154-5aa5b9635985","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:a832355aa5749ff84a22c0c24f0dd622b8a51995d057a106e271fda549fcc46d","observation_id":"e4b23a80-bc6d-4821-99bd-be938243d7fe","resolution":{"observed_at":"2026-06-28T08:11:49.700345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:e6890597b7748a5fba7ce6957fd345bc7b96fa6b6b65b6d47e54cd295d4170d6","observation_id":"42084e18-c639-47f5-af2d-0eb28dc8654e","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:b1d92d15c065a59859e3acbe69e02f6323bc5898dae6fa17ea9db97311d1dfd7","observation_id":"b12db7dc-812c-4d8e-bedd-cdd834b2e0a9","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:4831978f3d86008ed5466a15e112c40628311c0b3b43f3e84a34fcc8a84d3979","observation_id":"809265b2-7263-4221-9c8a-5e9252c0cfc2","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:a54ea99d1f42d69cc41887be717c265ff78f1272902cfa78d250caed630963ab","observation_id":"c6b32e43-3664-4035-9b8c-95feba705e45","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1405.2020","last_updated":"2014-05-08T17:04:15Z","snapshot_observed_at":"2026-08-04T16:50:32.529025Z","submitted_at":"2014-05-08T17:04:15Z","title":"Generalized Slow Roll for Tensors","version":1},"cited_work":{"arxiv_id":"1405.2020","doi":"10.1109/sc41405.2020","metadata_source":"pith","pith_arxiv_id":"1405.2020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Generalized Slow Roll for Tensors","venue":"astro-ph.CO","work_id":"32348cef-09e4-43f2-b53c-d785fa1937a5","year":2014},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1405.2020","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:4049601efd6e7613f0a748ab4d906c5f21779647ab2dbd96f4ead169d16cd3f8","observation_id":"8b6d480d-a47d-4d87-87ec-7bab13f07e4a","resolution":{"observed_at":"2026-06-28T08:11:49.681441Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.178338+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.178338+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:8ccea82153eb878a757db59a9743b51a6ac0f37eb267a5277c2debfdaa4da7cc","observation_id":"57aa2d50-5950-4b6e-a5a7-90a40136f889","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"2025.Deploying DeepSeek with PD Disaggregation and Large- Scale Expert Parallelism on 96 H100 GPUs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:7017816ea8b0e01b7edcf1cee35006e3c332b368793c6e3ef2b979af9c0d5fb2","observation_id":"70936724-4669-4871-bbdb-3467a1ec5582","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:12026ea23792f6ff3f7d587a933e2030ad1fe07ff9268d014d25922a99873168","observation_id":"05a97457-8acf-4631-930f-e797550ba836","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:e290cdc8f87237db5dc4c0dfb9e39fce17ad9f6c1ca8420c9165df5cd37572bf","observation_id":"aaf0263b-1ceb-49ea-bc0f-958b20317209","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:c9fd0161ed54f1de2af109754b586f821afbb0abf295a78fb09ce7d5a778044c","observation_id":"00138461-1e46-407d-80a0-248f27e3b01b","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3939.2023","doi":"10.1109/infocom53939.2023","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Amitai Uzrad 17 35 Kathrin Hanauer, Monika Henzinger, Lara Ost, and Stefan Schmid","venue":null,"work_id":"70febad8-b69b-4024-bffa-48572718c2f1","year":2023},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:cb9367a76be01123bde20a56c74050c457c9870eaa165bc34fa5a068316f5035","observation_id":"d23eabb9-1e39-48a5-812b-8b4f79439f7f","resolution":{"observed_at":"2026-07-02T05:26:40.130765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7703.365008","doi":"10.1145/3627703.3650080","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ZKML: An Optimizing System for ML Inference in Zero-Knowledge Proofs","venue":null,"work_id":"3eae0d9d-5ded-4fa5-9f8e-c8ca3d7eb04b","year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:528b4c3140b14f40eac6f3f5e0e833d5cdba82c1a173dd253cc49765600b0cf2","observation_id":"11d50405-0a3c-4a08-b27e-bb9c5caa4a6a","resolution":{"observed_at":"2026-06-28T08:11:49.695389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:8e2e02e56812fe8ca066eba0635a44ee300eb0592aa56d8c81a60012eb113ab0","observation_id":"574fbb56-e993-4016-9b08-8ed7591b1669","resolution":{"observed_at":"2026-06-28T08:11:49.686245Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:57908ea95182e080b94f162b89e33b8e570dfcd7c3a0e8a3b037164535feca09","observation_id":"88afece3-1bd3-4193-aefa-9d25ec0e8e08","resolution":{"observed_at":"2026-07-02T05:26:40.123089Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"UALink Consortium","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:82589a4505c5d5b0d10f8eda7a7115a18b49ed7f574b513fce3bf652be2c0bc6","observation_id":"5fa55272-3b0a-489c-8b0a-2ffe397a6a73","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:356a07f34473a627b8f0a289fcd0038e4ab933b2adb13fea3c80f85482240936","observation_id":"cfaeb97b-7357-4f57-9345-b5cae6701df7","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:1bae4e982d73a1652b814344581694f0f5824e045129acbeb0cfd19d9d3c7d58","observation_id":"c92e572c-5d5a-43df-ad56-c5b5c3865194","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15664","last_updated":"2024-08-28T09:31:09Z","snapshot_observed_at":"2026-08-03T02:22:36.564849Z","submitted_at":"2024-08-28T09:31:09Z","title":"Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2408.15664","doi":"10.48550/arxiv.2408.15664","metadata_source":"pith","pith_arxiv_id":"2408.15664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts","venue":"cs.LG","work_id":"267500ca-1512-478f-8a1b-6ecbdb09771d","year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2408.15664","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:24103029ac548599fc9f0ff2e2c8462955e0524626751ba40e1a5a0379f981ff","observation_id":"0a368de7-7351-4625-8255-2723d1b5964b","resolution":{"observed_at":"2026-07-02T05:26:40.111592Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07685","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T05:26:40.105572Z","title":"Scalable training of mixture-of-experts models with megatron core.arXiv preprint arXiv:2603.07685","venue":null,"work_id":"11511547-c58a-4542-b026-eee453e6b5c3","year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:384c82592a4c23de60944db68c2142e02a7625d70175e4543b27423aac9c7815","observation_id":"4afc81e6-ee73-4119-b7e2-3282e3c43f9c","resolution":{"observed_at":"2026-07-02T05:26:40.107036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:85bd468e9566b4027a6ca85158ce4a39aef25ae29264631f8ad136eb36d770e0","observation_id":"47e37024-9a9b-4b1b-9d37-4116197fc90e","resolution":{"observed_at":"2026-07-02T05:26:40.105321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:833653a8621d9d22fdcb03756b9191ea2a3c146f187555eca65c89857977fa79","observation_id":"b395835a-4256-459f-9818-75e75b22ecf5","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:cf1258df919022292ce8dd7a33dd8e9d4c15ec3ff3f818151b5b4562b56c4af8","observation_id":"df9c0c73-e265-4a18-9766-c53af9b23384","resolution":{"observed_at":"2026-07-02T05:26:40.118369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:fc515e7df9568610c0d58c317647882cccf13c4dc9f3632a013bfaf426c0e4d8","observation_id":"06ae1261-33fa-4fd5-8b59-486d8bdeb15e","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:d33bca5a9d00f4a7780c96a8719c6a21aeab54b3419d3d934d5fdca28696f587","observation_id":"6c0c294c-c598-46f6-978c-1f090fbcc54a","resolution":{"observed_at":"2026-06-28T08:11:49.683846Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.353929","doi":"10.1109/tpds.2025.3539297","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"IEEE Transactions on Parallel and Distributed Systems","work_id":"df5b582d-f519-4208-8b58-3112df8a1052","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:8f8372a04d4d9eeb1c333c99003d714158e7d3bd2ddeb802ec506e58efaeeb30","observation_id":"f3f6645f-01e8-4b92-bb9c-2293beebd41a","resolution":{"observed_at":"2026-06-28T08:11:49.688613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:30246930ab77214a5c6025665d121bd6d9091a9a94e38a599fe3d6d7a6a8f96a","observation_id":"109c1224-014b-43b2-9901-260ef73ca520","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:d44f0aece564b89ad0f2c1890f678046ae0a40e55c44563e68b055d0e0841f1d","observation_id":"f603a058-64d6-4d53-9a67-2db5b7f894ac","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:caefc594d2d47a7058be6b03f0a9882e9340b75d80fe294c1c57e9f0b6be7ce5","observation_id":"5bd1e58b-0c07-4fd4-8237-d12a82b8631f","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:8193544c71eb098215e7b175806e7e653cc5c44ce898fd9e376d4efd5b8f35a9","observation_id":"1c5ff151-8805-4f3e-a98f-10b7108de064","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:09:19.921804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:6916a9fcc5419ab51bb7bb2d0e3bed0567928c38c5748d376165041a99a67927","observation_id":"f812dcbc-c649-4589-b8d6-5fb75eba24a1","resolution":{"observed_at":"2026-06-28T08:09:19.921804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.00509","doi":"10.48550/arxiv.2602.00509","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Open MIND","work_id":"48eab8a0-5610-4e53-a1c7-de805e1aaa6f","year":2026},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:d4e07309202c44d7e60dd350e0136911ba5de214a803e531bebac4b4270e4037","observation_id":"a83f6358-3dda-4b15-bce0-4c33b62e0764","resolution":{"observed_at":"2026-06-28T08:11:49.692950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:b382096c102c02904e97e88b7ec316ffd5acb76defcf95f029eea2b38463c2d4","observation_id":"cf2e897a-cf69-4a9e-90f6-74c77b6f1086","resolution":{"observed_at":"2026-07-02T05:26:40.120807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","latest_version":3,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":49,"verified_exact":25,"verified_fuzzy":0},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 1 inbound Pith citation observation for arXiv:2606.04101."}