{"as_of":"2026-08-05T09:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce97381831ab2fa49bc7f02c8da77f72a4f2126bcc27ed8b3d9449ecb5cb772c","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.27866/citation-record","integrity":"/paper/2606.27866/integrity","json":"/paper/2606.27866/citation-record.json","paper":"/paper/2606.27866"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:99c75478b5815f1905b6fa37761ccab6ac6ccb7f0fc13578f48e27c28cdb9eff","observation_id":"dda9ace5-2d07-4ed1-bfe3-a35583141733","resolution":{"observed_at":"2026-06-29T20:03:56.523531Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:37:08.966401Z","title":"MathQA: Towards interpretable math word problem solving with operation-based formalisms","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:f20b89a2ad12f5a25d3d72593e77a1ac5a627e8cd112b6cc02f3d4bb566ff8a7","observation_id":"1dde4f77-1f5e-4e2f-8554-b8d455f554f7","resolution":{"observed_at":"2026-06-29T04:37:08.966401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1245","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MathQA: Towards interpretable math word problem solving with operation-based formalisms","venue":null,"work_id":"b73d762e-5f33-41a0-a44d-b2e613bffd36","year":2019},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:afe1a40725162d05ea184e4c3a8b54a6b70a9ee886833629f1c6960c81a6fe36","observation_id":"354bcda2-c298-44cc-87cd-e44282c17c0d","resolution":{"observed_at":"2026-06-29T04:43:06.471057Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T22:22:22.182129+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T22:22:22.182129+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.08589","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T11:36:55.533537Z","title":"Retraining- free merging of sparse moe via hierarchical clustering.arXiv preprint arXiv:2410.08589","venue":null,"work_id":"81b2d590-9175-41d4-9f66-4496d684f275","year":2024},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:29ce79e39ee51c6a03a9b8422e669c68a30c010a34648e867219c636dd53c645","observation_id":"68fc2839-8960-441c-8ddb-bac9d93de5b6","resolution":{"observed_at":"2026-06-29T20:03:56.500944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:65cce8bdbd15bdd4183c89ee5abf1868498274331373d88f749a5d67a400565b","observation_id":"f4550058-a002-4d67-9944-be9174f6001b","resolution":{"observed_at":"2026-06-29T20:03:56.513437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7916.374237","doi":"10.5555/3737916.3742377","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gongfan Fang, Hongxu Yin, Saurav Muralidharan, Greg Heinrich, Jeff Pool, Jan Kautz, Pavlo Molchanov, and Xinchao Wang","venue":null,"work_id":"03e3fd9f-4740-4c74-b2b2-3f3a22a86296","year":null},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:fcd24d1720cfc5c24b9c26ad432606be71a27512cf5061f468b44ef5d183dbff","observation_id":"7f0485a2-8708-4e2b-bf7b-074d2bdc8362","resolution":{"observed_at":"2026-06-29T04:43:06.474104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.22593","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:03:56.534829Z","title":"Flying serving: On-the-fly parallelism switching for large language model serving.arXiv preprint arXiv:2602.22593,","venue":null,"work_id":"10a28c45-b2fa-43ae-a4d3-03bcdd13dd0c","year":2026},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:66e833721fa286ccce0fca738a101302a27dc29cd2eb8a82d98038b61da12001","observation_id":"da44ce67-482d-4860-9717-68eeaaf9d7f3","resolution":{"observed_at":"2026-06-29T20:03:56.536878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:bd42bc04a6abfb7b85421ee82bdfc9b0401b24caca1a0bc9f58f2bc65c32a5ea","observation_id":"e05c7e9f-7246-4177-8d84-300ff70353e3","resolution":{"observed_at":"2026-06-29T20:03:56.530055Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08155","last_updated":"2025-02-25T18:29:54Z","snapshot_observed_at":"2026-07-06T18:29:34.538901Z","submitted_at":"2024-06-12T12:44:48Z","title":"QuantMoE-Bench: Examining Post-Training Quantization for Mixture-of-Experts","version":2},"cited_work":{"arxiv_id":"2406.08155","doi":"10.48550/arxiv.2406.08155","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evoagent: Towards automatic multi-agent generation via evolutionary algorithms","venue":"arXiv (Cornell University)","work_id":"f8093074-4efb-4b3a-83c2-1ee357c79686","year":2021},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/2406.08155","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:bd78a259cb3ddf27f01904065b47142b58f0997503d8fcad0ab6ebb6ac5d2e99","observation_id":"fdf20858-6652-41a7-b4ad-f5e9836ccf75","resolution":{"observed_at":"2026-06-29T20:03:56.504800Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2024.acl-long","venue":null,"work_id":"e64e1390-0d6b-4cce-8ac9-ae2f912f16f6","year":2024},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:3ad5fad2058a1ee7111ad22b66dc1cd58485ed14756a7f72a5d0a255eb6ff911","observation_id":"fcabb9f8-d22d-43e8-99e5-337f6b42e878","resolution":{"observed_at":"2026-06-29T04:43:06.479502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-16T20:20:45.990552+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T20:20:45.990552+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.10729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:03:56.524835Z","title":"OrbitFlow: SLO-Aware Long-Context LLM Serving with Fine-Grained KV Cache Reconfigura- tion","venue":null,"work_id":"9d7204b5-5307-42ad-9b32-43b24fff0b4b","year":2025},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:f374d39650a7f7673f25ca408d4b92bdb2aa48adcd6bf2a08f50dd43f70ec1ac","observation_id":"af6375dc-4982-4d37-a915-573de76b4f25","resolution":{"observed_at":"2026-06-29T20:03:56.526734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:37:08.966401Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:a599117f2de186fa0791f1dca2358ab939ff57a3151bc6ad46715174d5946ef2","observation_id":"30b60e8a-f8ce-44c6-842f-30f643f48e28","resolution":{"observed_at":"2026-06-29T04:37:08.966401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22438","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:09:01.191887Z","title":"Towards resiliency in large language model serving with KevlarFlow","venue":null,"work_id":"e44ed12b-69d2-439e-9cd5-83cbd7f5654c","year":2026},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:0513ac1ad174d1f9712b9293622de50d68af2037b592ca632a6abcb25ed8402e","observation_id":"4b2c6672-96e8-41c0-abdd-eff78024985f","resolution":{"observed_at":"2026-06-29T20:03:56.496188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06154","last_updated":"2026-06-16T12:59:35Z","snapshot_observed_at":"2026-08-03T04:04:30.065158Z","submitted_at":"2026-02-05T19:48:41Z","title":"MoSE: Mixture of Slimmable Experts for Efficient and Adaptive Language Models","version":2},"cited_work":{"arxiv_id":"2602.06154","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.06154","snapshot_observed_at":"2026-06-29T20:03:56.509103Z","title":"MoSE: Mixture of slimmable experts for efficient and adaptive inference","venue":"cs.LG","work_id":"b5a3742c-fc65-4fc1-908f-172d87f03c63","year":2026},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/2602.06154","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:4493ae9ec5c52000882ba84937cce370c80ebb12958536d91dd565ea269b3545","observation_id":"5aa9c4fb-a10b-441a-9f4a-c6fbbdd54349","resolution":{"observed_at":"2026-06-29T20:03:56.510930Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06068","last_updated":"2024-11-09T04:57:41Z","snapshot_observed_at":"2026-07-06T19:47:47.232714Z","submitted_at":"2024-11-09T04:57:41Z","title":"Zyda-2: a 5 Trillion Token High-Quality Dataset","version":1},"cited_work":{"arxiv_id":"2411.06068","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.06068","snapshot_observed_at":"2026-06-29T20:03:56.518050Z","title":"Zyda-2: a 5 trillion token high-quality dataset.arXiv preprint arXiv:2411.06068,","venue":null,"work_id":"0963302c-a493-4ab8-a88f-253db60da7ea","year":null},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/2411.06068","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:7d16db7f4609c1201243f9b84da85ff4d7db7b3180ba84cbbd81d9581c34294f","observation_id":"df4a5a16-2c6d-4530-ba0a-6ae200110bbb","resolution":{"observed_at":"2026-06-29T20:03:56.520336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:03:56.514634Z","title":"Training matryoshka mixture-of-experts for elastic inference- time expert utilization","venue":null,"work_id":"29338c68-a4fd-4a9d-9017-06076d22bdd6","year":2025},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:b2bd7ce5be54794667dbd590beead263c016bbfcf7e2e54330b53ac6957380e7","observation_id":"04995abb-ca7b-428f-9b46-1aa5e55818d5","resolution":{"observed_at":"2026-06-29T20:03:56.516536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:3d0aa69917cc05f1a5c2e607a37a627169eadd260f6c2437cdff0513e40f3711","observation_id":"4d1f78ce-4c7a-49af-9c15-0aeea8013a19","resolution":{"observed_at":"2026-06-29T04:43:06.477135Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1472","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:07:03.406813Z","title":"URL https:// doi.org/10.18653/v1/p19-1472","venue":"Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics","work_id":"11bfc949-547c-40f3-a86d-953eb9b2154c","year":2019},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:1aeca7d5a2859a77e4f0c2ce6a93cf386da1c1fe7c1680032d398a22f1dc39f3","observation_id":"798cdc5b-1b67-4a21-8650-22082a646cf5","resolution":{"observed_at":"2026-06-29T04:43:06.482048Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T09:08:05.023254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T09:08:05.023254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":"2312.07104","doi":"10.48550/arxiv.2312.07104","metadata_source":"pith","pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","venue":"cs.AI","work_id":"bcc79aed-93ef-4b91-94e6-e62b5fa15ce7","year":2023},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:c8ea3221c4c1a54730e2e16dedb9650358562c89c490d7a22f18a1c65037ae94","observation_id":"fd90b1b6-c4c0-4a32-a506-6bfaa07c1a4f","resolution":{"observed_at":"2026-06-29T20:03:56.533297Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8661.8660","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:03:56.506474Z","title":"100 ranked","venue":null,"work_id":"50812e0d-9e6a-4af9-b3ca-9e87c8e1b621","year":2019},"citing_paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T04:37:08.966401Z"},"links":{"citing_paper":"/paper/2606.27866"},"observation_digest":"sha256:5cdfcd6a09813d638150da2cd04b99e1fc39635c699bdcf83f538dd6feafacde","observation_id":"2bee44cf-de8b-4689-8197-24a36c24dbea","resolution":{"observed_at":"2026-06-29T20:03:56.507908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.27866","last_updated":"2026-06-26T09:08:03Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-07T00:02:04.432452Z","submitted_at":"2026-06-26T09:08:03Z","title":"FlexMoE: One-for-All Nested Intra-Expert Pruning for MoE Language Models"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":2,"verified_exact":12,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2606.27866."}