{"as_of":"2026-08-04T00:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d7faf1dc166ee309e0fcfd9df68bd484f9e1144e758dcb2fb10e0930f0bdb0d4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:33:40.263979Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":null,"work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2512.12476","last_updated":"2026-04-11T14:05:07Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-13T22:20:51Z","title":"HetRL: Efficient Reinforcement Learning for LLMs in Heterogeneous Environments","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-16T22:21:26.271796Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2512.12476"},"observation_digest":"sha256:56a8e6254d7ac5b7751ccd5ecdfef5258b8274857aef7f81e020573b54ab16e1","observation_id":"9bac683c-ab8e-428f-83f6-c22cf25fc492","resolution":{"observed_at":"2026-05-16T22:23:36.605292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":null,"work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2604.19241","last_updated":"2026-04-21T08:49:27Z","snapshot_observed_at":"2026-07-06T23:05:58.167533Z","submitted_at":"2026-04-21T08:49:27Z","title":"UniEP: Unified Expert-Parallel MoE MegaKernel for LLM Training","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T02:20:00.625923Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2604.19241"},"observation_digest":"sha256:68ae19d078c98543d807934837c316975239aca7b00d897b3d10ab2e815d5e84","observation_id":"8d7c778e-2d3e-43e1-a02c-b76f054756b3","resolution":{"observed_at":"2026-05-10T02:22:20.798325Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":null,"work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2605.11005","last_updated":"2026-05-10T05:57:05Z","snapshot_observed_at":"2026-07-06T23:22:52.369277Z","submitted_at":"2026-05-10T05:57:05Z","title":"DisagMoE: Computation-Communication overlapped MoE Training via Disaggregated AF-Pipe Parallelism","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T01:08:45.674652Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2605.11005"},"observation_digest":"sha256:4b2f2d51132ce7c6c181b9ef64feb68bd458845e648e44e510f278c0697c4eb2","observation_id":"f3d9f39d-42f0-4ce3-8b2b-310170deda5c","resolution":{"observed_at":"2026-05-13T01:52:06.246426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":null,"work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2605.20982","last_updated":"2026-07-17T08:33:40Z","snapshot_observed_at":"2026-08-02T13:33:38.641735Z","submitted_at":"2026-05-20T10:14:00Z","title":"Diagnosing Overhead in Dispatch Operations: Cross-architecture Observatory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T02:11:11.003259Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2605.20982"},"observation_digest":"sha256:43b64251dc695c65715f46fc96ab9c656a875aaec3cbe87f0c4a7a8cdd01a627","observation_id":"eb532d72-1c50-4332-b932-ad5748e901c8","resolution":{"observed_at":"2026-05-21T02:13:55.955085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-02T13:33:40.263979Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.20982","last_updated":"2026-07-17T08:33:40Z","snapshot_observed_at":"2026-08-02T13:33:38.641735Z","submitted_at":"2026-05-20T10:14:00Z","title":"Diagnosing Overhead in Dispatch Operations: Cross-architecture Observatory","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T13:33:40.263979Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2605.20982"},"observation_digest":"sha256:f7941ad0b75053a1b5762c75fd3aedf8296375dd5cd7c34f5285c2ee0ce6eb49","observation_id":"9d7712e8-5e1e-4855-b8d2-651549a2597e","resolution":{"observed_at":"2026-08-02T13:33:40.263979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":null,"work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2606.26633","last_updated":"2026-06-25T05:50:46Z","snapshot_observed_at":"2026-08-03T04:19:46.697799Z","submitted_at":"2026-06-25T05:50:46Z","title":"Simulating Unified Tensor Resharding in heterogeneous AI systems","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-26T04:00:26.409243Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2606.26633"},"observation_digest":"sha256:b86b84e3d96f0e3c83ab0ee84eaaab4876a5af0be0852ecb37d3717985cff679","observation_id":"f86ca2d7-8180-4d8c-b3b9-67078792f97b","resolution":{"observed_at":"2026-07-04T14:19:54.701427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.03871/citation-record","integrity":"/paper/2504.03871/integrity","json":"/paper/2504.03871/citation-record.json","paper":"/paper/2504.03871"},"outbound":[],"paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T21:04:38.019194Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2504.03871."}