{"as_of":"2026-08-18T07:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56096c4215d7382d3bde7700cf3c57c43f032218f98634ae5eb8d53a0948addf","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:28:53.702929Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T06:55:28.727134Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-08-10T18:56:37.681866Z","title":"CompeteSMoE–effective training of sparse mixture of experts via competition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16352","last_updated":"2025-01-18T20:17:31Z","snapshot_observed_at":"2026-08-15T11:20:35.669597Z","submitted_at":"2025-01-18T20:17:31Z","title":"Mixture of Experts (MoE): A Big Data Perspective","version":1},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-08-10T18:56:37.681866Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2501.16352"},"observation_digest":"sha256:cbca64f91a78bd1320fbc14ce68066324ff107976bdbb83f5aeb2f62751c4ae8","observation_id":"59b2eb58-168b-46c6-808f-7472d60e26a0","resolution":{"observed_at":"2026-08-10T18:56:37.681866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-08-09T10:14:21.584560Z","title":"T., Ramasamy, S., Li, X., Hoi, S., and Ho, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03029","last_updated":"2025-06-18T12:24:26Z","snapshot_observed_at":"2026-08-10T16:11:53.988251Z","submitted_at":"2025-02-05T09:31:27Z","title":"On Zero-Initialized Attention: Optimal Prompt and Gating Factor Estimation","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T10:14:21.584560Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2502.03029"},"observation_digest":"sha256:3c44bc1ab72ec7b9252228025018ccb86c6316c4113ce34d9875316f89c4c90c","observation_id":"09deff6c-b76a-4633-9d1c-e1d8cbc0d151","resolution":{"observed_at":"2026-08-09T10:14:21.584560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":"2402.02526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-07-01T06:55:28.727134Z","title":"Competesmoe--effective training of sparse mixture of experts via competition","venue":null,"work_id":"9524b89e-1e1c-4b87-8fee-b8fb18fe5f8e","year":2024},"citing_paper":{"arxiv_id":"2502.15315","last_updated":"2026-04-19T13:09:18Z","snapshot_observed_at":"2026-08-13T10:10:29.362987Z","submitted_at":"2025-02-21T09:10:54Z","title":"Tight Clusters Make Specialized Experts","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-23T02:54:12.217351Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2502.15315"},"observation_digest":"sha256:a73eea24414654a29b17d8e1d9b9c80d51ca5a5c5b8f1b9a6c358b185bc54d5f","observation_id":"3556a21c-2f4a-4912-8f0b-2d1d4446012f","resolution":{"observed_at":"2026-05-23T02:55:19.557538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-08-15T20:28:53.702929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13052","last_updated":"2025-05-23T13:21:08Z","snapshot_observed_at":"2026-08-15T23:46:32.011180Z","submitted_at":"2025-05-19T12:41:19Z","title":"Model Selection for Gaussian-gated Gaussian Mixture of Experts Using Dendrograms of Mixing Measures","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T20:28:53.702929Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2505.13052"},"observation_digest":"sha256:46927904ac38818320f1e5c942aec15f71ea641613c4d0545192c6b8d0a9629a","observation_id":"831efb16-5a97-4f81-a1bb-f8879cc5ec62","resolution":{"observed_at":"2026-08-15T20:28:53.702929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-08-04T09:56:32.280124Z","title":"T., Ramasamy, S., Li, X., Hoi, S., & others (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12744","last_updated":"2026-06-08T01:14:11Z","snapshot_observed_at":"2026-08-15T15:12:30.655468Z","submitted_at":"2025-10-14T17:23:44Z","title":"Dendrograms of Mixing Measures for Softmax-Gated Gaussian Mixture of Experts: Consistency Without Model Sweeps","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T09:56:32.280124Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2510.12744"},"observation_digest":"sha256:d51f426bc4b7346746c9f71bed07c090219b93cc2ac10257113a5cf87dea0078","observation_id":"68d5f31c-14b0-4398-ba93-db6532d68bc8","resolution":{"observed_at":"2026-08-04T09:56:32.280124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-08-04T09:21:50.318705Z","title":"Nguyen, Savitha Ramasamy, Xiaoli Li, Steven Hoi, and Nhat Ho","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.16138","last_updated":"2026-05-29T09:45:22Z","snapshot_observed_at":"2026-08-11T09:59:54.138696Z","submitted_at":"2025-10-17T18:23:01Z","title":"Expert Merging in Sparse Mixture of Experts with Nash Bargaining","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T09:21:50.318705Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2510.16138"},"observation_digest":"sha256:a044ab752ac41b45a767aa9c89ac83639b67e64e258b45c23834878c98411953","observation_id":"06ef333c-dc1c-48c6-8cba-5d4feaf8bfa0","resolution":{"observed_at":"2026-08-04T09:21:50.318705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":"2402.02526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-07-01T06:55:28.727134Z","title":"Competesmoe--effective training of sparse mixture of experts via competition","venue":null,"work_id":"9524b89e-1e1c-4b87-8fee-b8fb18fe5f8e","year":2024},"citing_paper":{"arxiv_id":"2605.06845","last_updated":"2026-06-29T07:27:51Z","snapshot_observed_at":"2026-08-14T18:05:41.463130Z","submitted_at":"2026-05-07T18:47:51Z","title":"Convergence Rates for Latent Mixing Measures in Infinite Homoscedastic Location-Scale Mixture Models","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-11T01:03:12.737706Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2605.06845"},"observation_digest":"sha256:d13fc4aa0556c5a86379fb509c245a8298572d4146082743060536fa3cf55f71","observation_id":"4eba4202-aa8f-4c58-a5b4-edd01fdcb1fb","resolution":{"observed_at":"2026-05-11T04:50:55.250128Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":"2402.02526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-07-01T06:55:28.727134Z","title":"Competesmoe--effective training of sparse mixture of experts via competition","venue":null,"work_id":"9524b89e-1e1c-4b87-8fee-b8fb18fe5f8e","year":2024},"citing_paper":{"arxiv_id":"2606.31397","last_updated":"2026-06-30T09:25:37Z","snapshot_observed_at":"2026-08-03T17:48:59.429755Z","submitted_at":"2026-06-30T09:25:37Z","title":"Mixture-of-Control: State-Aware Fine-Tuning for Transformer-based Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-01T06:55:06.270685Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2606.31397"},"observation_digest":"sha256:7c66a7442d84d0915cd620096a81e443c810b438373a169e7f237cffc98affdb","observation_id":"2761d56a-e9b8-4c0d-88ab-c37b88cbb400","resolution":{"observed_at":"2026-07-01T06:55:28.729420Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02526","snapshot_observed_at":"2026-08-14T04:45:35.876314Z","title":"arXiv preprint arXiv:2402.02526 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08597","last_updated":"2026-08-09T09:22:27Z","snapshot_observed_at":"2026-08-16T19:17:08.283794Z","submitted_at":"2026-08-09T09:22:27Z","title":"Partial Differential Equation Barriers to Identifiability in Infinite Mixture Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:45:35.876314Z"},"links":{"cited_paper":"/paper/2402.02526","citing_paper":"/paper/2608.08597"},"observation_digest":"sha256:6c2286e8a16f8d92888af05b2f3f2131a6582b49c98fd1b65a1a65a42be3531d","observation_id":"1b15a1f7-6a2b-4465-a235-622ede8b8ffa","resolution":{"observed_at":"2026-08-14T04:45:35.876314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.02526/citation-record","integrity":"/paper/2402.02526/integrity","json":"/paper/2402.02526/citation-record.json","paper":"/paper/2402.02526"},"outbound":[],"paper":{"arxiv_id":"2402.02526","last_updated":"2024-02-04T15:17:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T05:43:11.459485Z","submitted_at":"2024-02-04T15:17:09Z","title":"CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2402.02526."}