{"as_of":"2026-08-07T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f0e43e8b576a44f54ab539f95d8d40fda2f9599c43138b1866749300090e331c","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:01:45.680930Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16427/citation-record","integrity":"/paper/2607.16427/integrity","json":"/paper/2607.16427/citation-record.json","paper":"/paper/2607.16427"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.196314Z","title":"Scaling Laws Across Model Architectures:","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.196314Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:dd01a0166c11ce76367bdfb54c60de49e418e666dd650b041d80185b310cb4bc","observation_id":"306b6af1-6f07-4216-9c07-8ab01eaf57c6","resolution":{"observed_at":"2026-08-01T21:01:42.196314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20750","last_updated":"2025-03-26T17:33:38Z","snapshot_observed_at":"2026-07-06T20:59:09.299613Z","submitted_at":"2025-03-26T17:33:38Z","title":"Optimal Scaling Laws for Efficiency Gains in a Theoretical Transformer-Augmented Sectional MoE Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20750","snapshot_observed_at":"2026-08-01T21:01:42.273281Z","title":"arXiv preprint arXiv:2503.20750 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.273281Z"},"links":{"cited_paper":"/paper/2503.20750","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:c899f6e86a141b57434bf276a4c272e16712efaa23c2946ff622100509d9cebd","observation_id":"43ba4ce7-7cf0-4719-b9f4-3e1febc181cc","resolution":{"observed_at":"2026-08-01T21:01:42.273281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.386683Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.386683Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:4c2ff9d5958877e66a8a64421aa29d9d3193aaafa033bb5cc72e82793da0538e","observation_id":"f2ce6276-b812-4b4d-bc03-309cb78e18f2","resolution":{"observed_at":"2026-08-01T21:01:42.386683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.533172Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.533172Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:03385a036cff95881cc77f15aef29fd29244b1410c68013c34ac6211f701296e","observation_id":"197ee4ba-7bfe-485d-a4be-9c9c9bb4beae","resolution":{"observed_at":"2026-08-01T21:01:42.533172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.609177Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.609177Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:189c69cccb15a452447d0e016a6b83a45e78239df9661875c572e6f50ae779b0","observation_id":"b92379b3-cc49-4aa3-949b-1610faaf542a","resolution":{"observed_at":"2026-08-01T21:01:42.609177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.696866Z","title":"IEEE Transactions on Parallel and Distributed Systems , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.696866Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:da1978acb9a2def991568b9e36fa3d90b9b6f489b28e1e8376716d0c7b5c5b29","observation_id":"f81a6464-fbf1-4859-a300-a6cedfab4507","resolution":{"observed_at":"2026-08-01T21:01:42.696866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.769157Z","title":"JOURNAL OF IEEE TRANSACTIONS ON ARTIFICIAL INTELLIGENCE , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.769157Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:726622e541fe66506bac79b9b91fe03beeee282282ac0fa03133da6511de4b35","observation_id":"25f58908-ae22-4a92-8732-5ca872a8a9ed","resolution":{"observed_at":"2026-08-01T21:01:42.769157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15052","last_updated":"2024-06-28T19:39:45Z","snapshot_observed_at":"2026-08-03T23:12:30.037322Z","submitted_at":"2024-05-23T21:00:53Z","title":"Revisiting MoE and Dense Speed-Accuracy Comparisons for LLM Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15052","snapshot_observed_at":"2026-08-01T21:01:42.897579Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.897579Z"},"links":{"cited_paper":"/paper/2405.15052","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:0f179e91848800ccee8a1c89868ceb772bb2df4f4dce2c0ddaf6592242f7bf6e","observation_id":"e9430e14-a9f1-4186-b8ea-18e2ccd84f87","resolution":{"observed_at":"2026-08-01T21:01:42.897579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.028026Z","title":"Scaling Vision with Sparse Mixture of Experts , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.028026Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:842175c7e68d45b1ff1f4c3747c9da708c2c0fe6e3be5053ed81694239f76bee","observation_id":"710d82a9-5937-4fb3-a030-56d45b9e30c7","resolution":{"observed_at":"2026-08-01T21:01:43.028026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.135375Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.135375Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:ccf209ea8b16a7b502ad3b33944c9ffc1314643c0cf25ea2055d960f07bc50f8","observation_id":"6590902d-e0fb-488f-8a8a-f6ca13a33984","resolution":{"observed_at":"2026-08-01T21:01:43.135375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.249370Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.249370Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:18927d66001170b8f0bf5f9b3f1c57f9dd565acf17fbfd554bebe6364057828d","observation_id":"eb8a1944-7517-4be3-918c-c050228da509","resolution":{"observed_at":"2026-08-01T21:01:43.249370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.346274Z","title":"Le and Geoffrey E","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.346274Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:b9c02c56a28f58f3e8c1b69d7946c0d3d8732740b31a6a55df6c8872e6ba738a","observation_id":"03692010-1474-4107-9c89-1d44a2e84ec4","resolution":{"observed_at":"2026-08-01T21:01:43.346274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.477025Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.477025Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:09a76100763f9de7a08a5ada83b7ca1cb6b63a3b2f37b56b4b4f004b62f21ca7","observation_id":"42c3c63b-86a5-4b3e-af61-38fed0f3c557","resolution":{"observed_at":"2026-08-01T21:01:43.477025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.586604Z","title":"The Eleventh International Conference on Learning Representations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.586604Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:fe7577468fff310ae71d10775aeaa775d87e853314854e47df38dc61ba0e116e","observation_id":"dad253c0-edef-468f-972b-5f79ca131f91","resolution":{"observed_at":"2026-08-01T21:01:43.586604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.703624Z","title":"On the Representation Collapse of Sparse Mixture of Experts , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.703624Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:9c9a86a1b534acc9b600cd5169a697dfbee29a32932086343056b5aca1b03635","observation_id":"7bf08ba7-f390-4ffd-962b-d20095dcc995","resolution":{"observed_at":"2026-08-01T21:01:43.703624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.107","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimSMoE: Toward Efficient Training Mixture of Experts via Solving Representational Collapse , booktitle =","venue":null,"work_id":"1ef5c950-b47d-4886-8709-d04a795ef04d","year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.812014Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:49c23d39d5fb8eb6b11b6c3e1658cbe750a854d48ff77c734b61ab32d9a175cf","observation_id":"6df381eb-d2bd-438f-8ce7-9b20336d7aa4","resolution":{"observed_at":"2026-08-01T21:04:37.940446Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.351","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HyperRouter: Towards Efficient Training and Inference of Sparse Mixture of Experts , booktitle =","venue":null,"work_id":"48124e98-315e-482e-abc2-8f0a6cadae79","year":2023},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.917892Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:81450a6d373af436559c45eb563f66b7e2e31c4f689a0327d3cfd7779ae5fa71","observation_id":"815987c6-2914-495d-947f-39bee5a5a231","resolution":{"observed_at":"2026-08-01T21:04:37.781518Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.998637Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.998637Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:7f161aad4903eb70b9cd4a57f0f7133d8701701ff83fb2c618ef3fffa921e0fc","observation_id":"e91fc752-bf5b-41e2-a028-f5d4337d1bb7","resolution":{"observed_at":"2026-08-01T21:01:43.998637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04444","last_updated":"2025-04-06T11:31:55Z","snapshot_observed_at":"2026-07-06T21:05:01.982500Z","submitted_at":"2025-04-06T11:31:55Z","title":"On the Spatial Structure of Mixture-of-Experts in Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04444","snapshot_observed_at":"2026-08-01T21:01:44.172037Z","title":"Oseledets , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.172037Z"},"links":{"cited_paper":"/paper/2504.04444","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:5760d2451e316b14fd66ac3165374f52b1242e5593b48c5df575fcd564ec97d2","observation_id":"2966cd7d-3d22-4f3f-8d4f-0a23bdc13775","resolution":{"observed_at":"2026-08-01T21:01:44.172037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.338246Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.338246Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:dab28f798a04c80832ec3a24a722d4a4ffa894a00994607c3d0dfc506d1fbd4b","observation_id":"5dbd08e9-89c2-4412-af7c-5729dd35c667","resolution":{"observed_at":"2026-08-01T21:01:44.338246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14107","last_updated":"2024-09-21T11:25:19Z","snapshot_observed_at":"2026-07-06T19:19:11.152731Z","submitted_at":"2024-09-21T11:25:19Z","title":"Routing in Sparsely-gated Language Models responds to Context","version":1},"cited_work":{"arxiv_id":"2409.14107","doi":"10.48550/arxiv.2409.14107","metadata_source":"pith","pith_arxiv_id":"2409.14107","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Routing in Sparsely-gated Language Models responds to Context","venue":"cs.CL","work_id":"f192581f-e5b9-4c69-a1e1-42eec95e1719","year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.446222Z"},"links":{"cited_paper":"/paper/2409.14107","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:76ac4dad78955890499ca88110d238549b293571a8c5d83d77f3ad67b9584771","observation_id":"1a894290-b6f6-4992-b6f1-f0f802bc0f88","resolution":{"observed_at":"2026-08-01T21:04:37.576067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.579116Z","title":"arXiv preprint arXiv:2406.00023 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.579116Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:d2a84984c5a9b866d603c5c0de2e6de66120234c974f38966c2f30c1ee2560f8","observation_id":"b3eb1676-d9b5-45fa-b5dc-933c48aaa32b","resolution":{"observed_at":"2026-08-01T21:01:44.579116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.724025Z","title":"StableMoE: Stable Routing Strategy for Mixture of Experts , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.724025Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:35ed9c0761353bc40fc696fdf13a13609f49e21424ce0f716923996662fff4c5","observation_id":"1ba42d76-4540-4001-9202-3e99a26a5a37","resolution":{"observed_at":"2026-08-01T21:01:44.724025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.835247Z","title":"THOR-MoE: Hierarchical Task-Guided and Context-Responsive Routing for Neural Machine Translation , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.835247Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:b6b391c2dc5fee571c0462de47952f765c2457a637c55856734e941dbbe37008","observation_id":"4aca609d-a384-416a-bc03-bf869e737e4c","resolution":{"observed_at":"2026-08-01T21:01:44.835247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.967343Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.967343Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:13c484677a2383f2762487d64746bc5d6f2d884710d6812f235c2846817b2f47","observation_id":"6521630b-9f55-44bd-8e4e-519af4ce3809","resolution":{"observed_at":"2026-08-01T21:01:44.967343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.087341Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.087341Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:b69a2e8983e3fdf231e25c70a7b165e65fd881d73ff3850b4894f1d9b65746ee","observation_id":"a3716d93-af71-445c-bde2-3fde07e00687","resolution":{"observed_at":"2026-08-01T21:01:45.087341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.156775Z","title":"Cross-Attention is All You Need: Adapting Pretrained Transformers for Machine Translation , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.156775Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:4b6e1da20542a7752f3cae4fc5ec0a46db84c05dd51a32913c8bc5beb431a435","observation_id":"a178d931-d408-4599-a0bb-1c4d2d7920bd","resolution":{"observed_at":"2026-08-01T21:01:45.156775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.223896Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.223896Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:ed49c1288b73fcf3f6c53ca5690906c7c8373ef21ef72c3a00119a7fc8f6fe54","observation_id":"16e9ff11-e312-4341-891e-8a9754355d2e","resolution":{"observed_at":"2026-08-01T21:01:45.223896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.303347Z","title":"Carbonell and Quoc Viet Le and Ruslan Salakhutdinov , editor =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.303347Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:51211f013dd973af92d10da6a3f273f1fd8230ac190d4ac374a3d53fc3df062c","observation_id":"b2a9e037-6f41-454d-9618-60224c408e70","resolution":{"observed_at":"2026-08-01T21:01:45.303347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.348669Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.348669Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:1ee218fb2ed61f5605f36ec735c4ae15c3c80946747eec509a6ecd6a421fe1d8","observation_id":"c9db6a07-d923-4031-8676-1cbc4775a6bb","resolution":{"observed_at":"2026-08-01T21:01:45.348669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-01T21:01:45.409030Z","title":"arXiv preprint arXiv:1609.07843 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.409030Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:fe526bddbed66192d6c74b5d4dcb391d1284a65bd377b6ec9d82edbf0b862ec5","observation_id":"c979e64f-b1a2-4efc-85eb-a46977936354","resolution":{"observed_at":"2026-08-01T21:01:45.409030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.449827Z","title":"Manning and Andrew Y","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.449827Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:d391622e0afc75895cb514d7e7b40acb3d41cacff3050c3136b3527b6b372b0f","observation_id":"7b22b3fc-ce7d-43b3-b6be-fb1b726ce9ca","resolution":{"observed_at":"2026-08-01T21:01:45.449827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-01T21:01:45.502744Z","title":"arXiv preprint arXiv:1804.07461 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.502744Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:a5a5da0eb430ef152d7ea56447eb4eeeed0f615a43b39280ec8b012a0658658f","observation_id":"94f57983-b277-423d-8748-5255bc16dd7d","resolution":{"observed_at":"2026-08-01T21:01:45.502744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07983","last_updated":"2024-11-12T18:08:45Z","snapshot_observed_at":"2026-08-04T05:34:51.547468Z","submitted_at":"2024-11-12T18:08:45Z","title":"Gini Coefficient as a Unified Metric for Evaluating Many-versus-Many Similarity in Vector Spaces","version":1},"cited_work":{"arxiv_id":"2411.07983","doi":"10.48550/arxiv.2411.07983","metadata_source":"pith","pith_arxiv_id":"2411.07983","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Gini Coefficient as a Unified Metric for Evaluating Many-versus-Many Similarity in Vector Spaces","venue":"cs.AI","work_id":"92cbdc6e-b78e-48b5-aeaa-5846703039aa","year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.560163Z"},"links":{"cited_paper":"/paper/2411.07983","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:5f02913ff4f99f2b26fff5df554bc107e41d9d3c5f932abe119fc86c1fbeaba0","observation_id":"825cfe30-6d4b-4711-ae38-d260cbb63a50","resolution":{"observed_at":"2026-08-01T21:04:37.386942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i11.26617","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MoEC: Mixture of Expert Clusters , booktitle =","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"7f601f24-2fbd-4219-afd7-c243ee645b08","year":2023},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.624588Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:1a1be1c8cf3f98395e83c6a780c50bd1fe5d9fa194f1795d64bf43299bb2ec5c","observation_id":"361cc15f-a4b3-4256-8aba-1799c31ad435","resolution":{"observed_at":"2026-08-01T21:04:37.303952Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.680930Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.680930Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:fd9841b8a85741e3a13c0138eb8dbca80f05b7aa5c5e85cce54b279a283e753d","observation_id":"a8bf9005-b0ac-45c4-a20a-e491d257c94f","resolution":{"observed_at":"2026-08-01T21:01:45.680930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T21:23:43.624597Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.16427."}