{"as_of":"2026-08-08T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c44b980371eaafffe201f77e54df6d783767c9b41dc0903ebd5cdfb334326af9","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:59:18.904741Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T17:09:33.923627Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09351","snapshot_observed_at":"2026-08-03T17:09:33.923627Z","title":"Dive into moe: Diversity-enhanced reconstruction of large language mod- els from dense into mixture-of-experts.arXiv preprint arXiv:2506.09351, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10548","last_updated":"2026-05-23T16:19:27Z","snapshot_observed_at":"2026-08-06T16:23:04.267396Z","submitted_at":"2025-12-11T11:27:25Z","title":"Blink: Dynamic Visual Token Resolution for Enhanced Multimodal Understanding","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T17:09:33.923627Z"},"links":{"cited_paper":"/paper/2506.09351","citing_paper":"/paper/2512.10548"},"observation_digest":"sha256:85fb2f501dd5fd56efb51ba60d95d0755635592d6f2abe1b435fb37c564d2526","observation_id":"c15a0393-fed7-4933-8ab4-c68253dc1815","resolution":{"observed_at":"2026-08-03T17:09:33.923627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09351/citation-record","integrity":"/paper/2506.09351/integrity","json":"/paper/2506.09351/citation-record.json","paper":"/paper/2506.09351"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1803.08375","last_updated":"2026-04-14T12:21:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-22T14:30:17Z","title":"Deep Learning using Rectified Linear Units (ReLU)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08375","snapshot_observed_at":"2026-08-07T04:59:13.489818Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.489818Z"},"links":{"cited_paper":"/paper/1803.08375","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:2ce58b2bbcd53c4f4f5c17cee1abb2ed73b4185c078c39ffd14a14cc6167e8af","observation_id":"37bb7594-ad75-4074-a5da-e7bed7a47b9d","resolution":{"observed_at":"2026-08-07T04:59:13.489818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:13.638648Z","title":"Khatamifard, Minsik Cho, Carlo C Del Mundo, Mohammad Rastegari, and Mehrdad Farajtabar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.638648Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:f569b5244fe7281a6b9e437dbccbb173d482c5b88be56ad62c47266a871ebeb8","observation_id":"c0317fc8-f6e7-41c0-82e5-89a3a2878695","resolution":{"observed_at":"2026-08-07T04:59:13.638648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:13.756394Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.756394Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:239493c661bddde937e6ea4002a290c86568dc1cd54a7fad4101a50244210a61","observation_id":"8947c231-69b6-4036-8705-0ef4500d6af4","resolution":{"observed_at":"2026-08-07T04:59:13.756394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:13.877208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.877208Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:9cab27fab63a2c88f1c0a2f36902e45866b06cb53a09ed51a0df6a6eb619ffe7","observation_id":"d27e84bd-baa8-45b5-b6f9-91ccfeb3d09f","resolution":{"observed_at":"2026-08-07T04:59:13.877208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:21.702444Z","title":null,"venue":null,"work_id":"6723386b-42c1-4c3d-abb4-db9fc7258b20","year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.041580Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:c26355a64b1e7c8817193cda2cc6d4f58c66af50c4fa3f0f99e9f410009d7def","observation_id":"6b72537c-c43e-4b78-b3df-9ada06448ac6","resolution":{"observed_at":"2026-08-07T04:59:21.815095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.164066Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.164066Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:eb7893f229f26c0e13081400d9ac01d02067e3c5a1858001334427f668cd1495","observation_id":"d3dd5ae3-1a26-47cc-acb0-30f0de724ee0","resolution":{"observed_at":"2026-08-07T04:59:14.164066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T04:59:14.289861Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.289861Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:6e3d508cc13241d1669d0467dcf3831863936cc4dbb36c4c929b1a0d5362d0da","observation_id":"e6a8421c-1077-409b-9583-f88003c00e48","resolution":{"observed_at":"2026-08-07T04:59:14.289861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:59:14.407448Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.407448Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:402bac62f20a91c18ac70bf109f8773a526a2a047d930e2e01688f46f28a5508","observation_id":"ab7bcf53-64f5-4f3d-955b-7d36302d8d7d","resolution":{"observed_at":"2026-08-07T04:59:14.407448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.497381Z","title":"Smith, and Matt Gardner","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.497381Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:35b43840ffbda474cafd5c4380579fca7bb5fcfedb7ff5fb880e06e8ad7bf7bd","observation_id":"bea11bf4-e279-4190-9a23-52cc0acec178","resolution":{"observed_at":"2026-08-07T04:59:14.497381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02628","last_updated":"2023-07-05T19:59:09Z","snapshot_observed_at":"2026-07-06T15:50:49.116859Z","submitted_at":"2023-07-05T19:59:09Z","title":"SkipDecode: Autoregressive Skip Decoding with Batching and Caching for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02628","snapshot_observed_at":"2026-08-07T04:59:14.591057Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.591057Z"},"links":{"cited_paper":"/paper/2307.02628","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:84071424a275352e2105cc916f60f946f72b12929e4dd559238831256bfe7c50","observation_id":"f4905ae9-ab05-421f-bcd0-23469d277d8a","resolution":{"observed_at":"2026-08-07T04:59:14.591057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.708247Z","title":"Dolan and Chris Brockett","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.708247Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:abbc65064b3b7ee4de9c12a9bfdf294510013333b4cf7acc751c6bcab6a0ddaa","observation_id":"1bbae2ab-6eb4-4670-99c1-d2dad5a30f13","resolution":{"observed_at":"2026-08-07T04:59:14.708247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.820033Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.820033Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ae50b852c66866298e5a0708ca7ffc4e6595ccc813bd750208c519c983d80c01","observation_id":"e5104f6f-56c2-4918-8b24-ad045525579c","resolution":{"observed_at":"2026-08-07T04:59:14.820033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.902196Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.902196Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:929c53dd01db500cb1097cb60850d8dc97e3d806f62cea0b2032f8fbbea10500","observation_id":"67ea4802-e668-4bd2-89b9-bbcc9e3d19cf","resolution":{"observed_at":"2026-08-07T04:59:14.902196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:21.475978Z","title":null,"venue":null,"work_id":"a19b14e0-5d31-481b-8608-383c3533e6a7","year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.047779Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:60fefbf4f9bc5f2251309599e5448e8393edca94a506b0a30bf98c688fea88d7","observation_id":"77bbb43f-5e79-4fb1-a519-e08769290fb0","resolution":{"observed_at":"2026-08-07T04:59:21.582905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.116910Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.116910Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:02697b6859ff67b65bd31cc04099c38f9c29dd207630ac27b0d24c153f174e21","observation_id":"a6555135-76ab-42be-9d3a-eb989a28f791","resolution":{"observed_at":"2026-08-07T04:59:15.116910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.219941Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.219941Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:c3fd9d265faf19e2320ec75d508cb3e02f19bc4392ce04eba722df7ff06fd130","observation_id":"00148325-c4a5-4cce-af20-e0d1be6754cc","resolution":{"observed_at":"2026-08-07T04:59:15.219941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T04:59:15.311729Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.311729Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:a434545bdfa9a65f9536fd7e6b58e9fb40be5d2b67bbc34c1ee902abe2e227f7","observation_id":"127eaace-2b71-4175-9da8-cc202d6a6819","resolution":{"observed_at":"2026-08-07T04:59:15.311729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.380273Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.380273Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:465af5ad33d46515c0cb51bb861b61f3db296e879d3af41f1f48cd7ce9b7d9aa","observation_id":"14606bf8-8a88-42aa-8175-d6ad549c56bf","resolution":{"observed_at":"2026-08-07T04:59:15.380273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:21.240059Z","title":null,"venue":null,"work_id":"ef9b2054-d024-4097-a6e9-833f6a81c646","year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.446876Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:12317d66655f2502040c23eaa7fdab59c6c76a8ad0bbe14560d641addd91f800","observation_id":"cec1d0f5-1f4a-4e2a-8237-5f67467dcfed","resolution":{"observed_at":"2026-08-07T04:59:21.351536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.504085Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.504085Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:132da4c77f0f63ea15fa74699fbb2fc0efad2bf0428d514bac00ce23dec4478c","observation_id":"373b1bed-98de-430f-b395-f4be64b731b7","resolution":{"observed_at":"2026-08-07T04:59:15.504085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.596728Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.596728Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:625453531f05d448cc41af093ce6e42b4c8ebb7df2f94509becfa2578632deb2","observation_id":"5eab4b33-21e0-4f20-820e-b6bd5cc734f8","resolution":{"observed_at":"2026-08-07T04:59:15.596728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.951445Z","title":null,"venue":null,"work_id":"84156d7c-4828-405a-93e9-196c00477bd6","year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.697818Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:6f2b3dc53973a5f831bd5c01940fb37dbf57d381d022862012c71d202c5fb004","observation_id":"4d496967-6a9b-4cc0-a0d6-dcc132602958","resolution":{"observed_at":"2026-08-07T04:59:21.090739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.780729Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.780729Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:3468f979eb0f23683b8aa9f4c0b94d68a7bfd0c8ab86c78ae068759be0c89bbc","observation_id":"e8821c06-531e-4ec1-aa9b-97c8b76f9fed","resolution":{"observed_at":"2026-08-07T04:59:15.780729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"hash/4495695","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:19.771454Z","title":null,"venue":null,"work_id":"9b1ffc94-2af5-4931-8d2b-5f3ad64d0fe2","year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.856979Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:6c0f4111ee368c1d00d9cb9274e15a4bd073a3b9d6a73f9826ed8bfeb47b2b7c","observation_id":"507896b2-42e8-4640-839c-6544806c7c16","resolution":{"observed_at":"2026-08-07T04:59:19.856135Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.738736Z","title":null,"venue":null,"work_id":"53e66c04-beb1-42ca-9771-89d25e3e169f","year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.944598Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:cacb32bb7ff7d5ad2c774a4901d17c50b92c06fc44865487289967ae72bbcf72","observation_id":"1e397bac-483b-487e-8883-22e20db0990a","resolution":{"observed_at":"2026-08-07T04:59:20.841792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.044795Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.044795Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ca9e8d1c6de1b1a961661809193fc2579c528bb669567a7bff65e18e7550a1c4","observation_id":"e9bb0155-7a2f-422c-8eeb-80d23a0dfbec","resolution":{"observed_at":"2026-08-07T04:59:16.044795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.104181Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.104181Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:0acc091b1546bd29dcb7ef38cfbd332d65e0132b61585bf5ad5d317708caf09c","observation_id":"639d2781-f0e7-4677-b073-d7c61d207ed0","resolution":{"observed_at":"2026-08-07T04:59:16.104181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.195901Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.195901Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1ce7f1eff2b0a884b33a9bf7a3d854f0dc4c85268afff250df9737d286edd918","observation_id":"ed48d32f-b813-4ac7-b731-fcf30222ab31","resolution":{"observed_at":"2026-08-07T04:59:16.195901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.274506Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.274506Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:80037bb50f04f6065d989d57c6ce09307f0538864aa9f3e85aac0ee77639471c","observation_id":"8b6e8ff8-9cb9-4f5e-ae4b-b3e7894e2b56","resolution":{"observed_at":"2026-08-07T04:59:16.274506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.367208Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.367208Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1cc037d09e89c5315d63d63468368780f753a7a111dec0db38e8fbc84900cd29","observation_id":"ba791935-a2fe-4609-8983-43893dc6aa51","resolution":{"observed_at":"2026-08-07T04:59:16.367208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-07T04:59:16.447110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.447110Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:06de0fe7741e632caf1ed5480f5c74bce65fd90e490db4cfceacf0745ab5960e","observation_id":"4cdad05e-7c6b-462e-ae20-8333b5309e94","resolution":{"observed_at":"2026-08-07T04:59:16.447110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.541348Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.541348Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:9be9e197baa51cf55bac1cfedd6cb040afd5ac532a47af7f48b80f746d6b49b4","observation_id":"8a87c8c3-8b8e-47d3-972a-5c9f13f42391","resolution":{"observed_at":"2026-08-07T04:59:16.541348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.652218Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.652218Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:92996f96a26c39516b2f28702c684d39d9c0cdbb989bb3081aba5d85690d46a5","observation_id":"2d4b0e29-31ef-4716-bc19-588a553b3fe2","resolution":{"observed_at":"2026-08-07T04:59:16.652218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.531585Z","title":null,"venue":null,"work_id":"6d800886-17dc-4d3b-80c6-e702492020b0","year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.715024Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:19fb30e4d4262e4dcf9bfc8e42c8f32a5de2a8ebf03f0dc94dbe6ca49a6f2d31","observation_id":"202082f7-e1c0-415b-9674-14260c160e2f","resolution":{"observed_at":"2026-08-07T04:59:20.605616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-07T04:59:16.799983Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.799983Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:cda373d4dada72dfe07a0007b73b44f7505a8b34e453beb6821614781b7a5f8a","observation_id":"9959500b-304c-453f-aa2f-239419bc37b8","resolution":{"observed_at":"2026-08-07T04:59:16.799983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.112","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:19.246552Z","title":null,"venue":null,"work_id":"17d86501-66d0-4602-8887-d39b96113758","year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.869577Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:0d381204ab6ef7c2a3cd5452b957e119fdb8b2bca9fcba574fd37da313fc9871","observation_id":"25385227-8afc-453e-bb22-ef1ecad93448","resolution":{"observed_at":"2026-08-07T04:59:19.324843Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.582","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:19.104604Z","title":null,"venue":null,"work_id":"87b969e9-8b65-406c-aca8-aec7bf6ff5a0","year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.964224Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:935317774f6c5cb623460c0394608c3261e2b88b66424aa1db076587f8bb49e6","observation_id":"c4a0bc8f-37a6-482e-8dcb-7e208ec523a6","resolution":{"observed_at":"2026-08-07T04:59:19.176713Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.405496Z","title":null,"venue":null,"work_id":"4b60292a-65ab-4d3f-a44a-257823e2ad18","year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.040583Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:e76e2c9a6be0eb16cb51213a3acd5462e50483bdb78ad24eed0f46cb1949e88e","observation_id":"06a38402-679c-43c9-9178-4730d80ee0ac","resolution":{"observed_at":"2026-08-07T04:59:20.439941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.102585Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.102585Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:489d7fd98ad25c27ff2d73f7688c33137f458340e3dd5847d0f8324f3a979358","observation_id":"3f2dd55a-a5a3-479f-9664-2302e9a9cb30","resolution":{"observed_at":"2026-08-07T04:59:17.102585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12456","last_updated":"2024-12-12T12:38:12Z","snapshot_observed_at":"2026-08-07T20:41:48.188566Z","submitted_at":"2023-12-16T02:27:00Z","title":"PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12456","snapshot_observed_at":"2026-08-07T04:59:17.159468Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.159468Z"},"links":{"cited_paper":"/paper/2312.12456","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:2af7374c31924b18c4a2e20705b3d5fc79defb4b946a94ad95a59d923f33c2a7","observation_id":"8865263a-8f4e-44a8-b067-b61b5be100ea","resolution":{"observed_at":"2026-08-07T04:59:17.159468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.279742Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.279742Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:9f8f0d00b4f510a8403882da689ecf9f79b05a5245de11ba629a6a671968110f","observation_id":"179497e8-1703-414d-be4b-4956a247b389","resolution":{"observed_at":"2026-08-07T04:59:17.279742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.372100Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.372100Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:22cb1e117c32689f1d76177ba5a273de6e8488d0190414f899c9bf7745780701","observation_id":"015f93ed-a837-4aaf-9d22-679c7fa42053","resolution":{"observed_at":"2026-08-07T04:59:17.372100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.460031Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.460031Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ce5c38c1451bf232aec7f37b4a34998fb560dee088d1cb8643b81f6efd13e6fc","observation_id":"2a2f30e5-d289-42f7-a748-48f268459595","resolution":{"observed_at":"2026-08-07T04:59:17.460031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06563","last_updated":"2024-06-03T03:58:41Z","snapshot_observed_at":"2026-08-04T06:16:13.927362Z","submitted_at":"2024-06-03T03:58:41Z","title":"Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06563","snapshot_observed_at":"2026-08-07T04:59:17.558603Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.558603Z"},"links":{"cited_paper":"/paper/2406.06563","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:2c194e766abf51894c58c290fcb3dab9c17708c54c03f5e4ecb60618c3535be3","observation_id":"3d98011d-74f5-4087-8cc7-c93b55c577b7","resolution":{"observed_at":"2026-08-07T04:59:17.558603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.649112Z","title":"Liu, and Matt Gardner","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.649112Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:cfcfddd8a5709f71b144e82fa9e30fc2c72e0a30bfbeb7c9c95c1eea58110401","observation_id":"5cb146da-910f-4031-9220-88a847a704dd","resolution":{"observed_at":"2026-08-07T04:59:17.649112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.764546Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.764546Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:30c9eedc2075359dbad83c1b1f5ad916b5f1f7fe15a86ff20f176d12e3f05969","observation_id":"14cd0d54-fa17-4c12-8bca-33db0bb199da","resolution":{"observed_at":"2026-08-07T04:59:17.764546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.859068Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.859068Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:d904a50c609dfc0caf0f10d6e6dc71785046463dda4708303474b2be34e82b2d","observation_id":"1f36ad3c-02cf-465a-a4f1-d1acab38fb97","resolution":{"observed_at":"2026-08-07T04:59:17.859068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.239644Z","title":null,"venue":null,"work_id":"f10022f8-2d6d-4af6-b3c8-7d796b007ba8","year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.923041Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ee4b229744b54a3557f032360aca6786399531b0f4dc58735e504c0905237fb1","observation_id":"94b988c2-4b57-4531-8303-699529022377","resolution":{"observed_at":"2026-08-07T04:59:20.308910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.038045Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.038045Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:acab52a573a3467bd51ab1b19abeb36c30509a210b953093c66ca8917951e2e2","observation_id":"0fdb92f5-4082-44ad-a6cd-7d7b05258912","resolution":{"observed_at":"2026-08-07T04:59:18.038045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06282","last_updated":"2024-12-12T12:24:18Z","snapshot_observed_at":"2026-08-06T16:06:48.213787Z","submitted_at":"2024-06-10T14:01:21Z","title":"PowerInfer-2: Fast Large Language Model Inference on a Smartphone","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06282","snapshot_observed_at":"2026-08-07T04:59:18.087086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.087086Z"},"links":{"cited_paper":"/paper/2406.06282","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ba1955ce3c2543a681704c1fe1eee6456e604c90b366cde634b9580aed9142b3","observation_id":"6af74b8a-00e2-4fe4-9dec-a48a499e844f","resolution":{"observed_at":"2026-08-07T04:59:18.087086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.178728Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.178728Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:146549093571a6b22fe0644b0e9c68076dda7abf6a62d34cbab6d278d99e2549","observation_id":"b20e2450-e9a1-44e0-97fa-7ab776a8b854","resolution":{"observed_at":"2026-08-07T04:59:18.178728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-07T04:59:18.228663Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.228663Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:eaccbf6065600ff64f5a6fe722128a8e3326bccdb60173bc6fe5d1d390b5ed28","observation_id":"b2a25bf7-fac3-435e-96c7-4f03b93e6421","resolution":{"observed_at":"2026-08-07T04:59:18.228663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12885","last_updated":"2018-10-30T17:32:16Z","snapshot_observed_at":"2026-08-06T02:57:51.203477Z","submitted_at":"2018-10-30T17:32:16Z","title":"ReCoRD: Bridging the Gap between Human and Machine Commonsense Reading Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12885","snapshot_observed_at":"2026-08-07T04:59:18.333558Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.333558Z"},"links":{"cited_paper":"/paper/1810.12885","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1f8b84f8e2d1bf7a6fb47e0a810819618cb573a38866e633ff1a51ac42d0d9c0","observation_id":"d265852a-c670-4958-b0d4-57d518d5f8ab","resolution":{"observed_at":"2026-08-07T04:59:18.333558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.067852Z","title":null,"venue":null,"work_id":"bf78b86f-ccc4-4587-9ff3-a916ad5129c7","year":2015},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.437127Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:af081ff5f44abb5d4df254aa7019538b93164583abd267e4b12f569ce87a92b5","observation_id":"289adcfe-583f-4bc6-a0c9-759b92a659da","resolution":{"observed_at":"2026-08-07T04:59:20.155012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.508270Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.508270Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:94f7f0ead5e1531efd41b474a50b7c0bfd121837cedac64b9bdbe0dd1969a1ba","observation_id":"4dcdbeb0-2f3a-4efe-950b-aa2c16006ab6","resolution":{"observed_at":"2026-08-07T04:59:18.508270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.605388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.605388Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:216eec6c15e357d033a115d8feba13ca912904bd3dd841e77d0291b58d64f531","observation_id":"a7b5f4dc-19f8-4383-a090-edd8bdd301c9","resolution":{"observed_at":"2026-08-07T04:59:18.605388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-06T06:16:16.015146Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T04:59:18.685207Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.685207Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:59a3381da388f12fb6648daed80eddf030a3a747e36d95e930985e6c1830ccd4","observation_id":"fcbefac7-491d-4fa1-bdf5-25b2764ff8b6","resolution":{"observed_at":"2026-08-07T04:59:18.685207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.782487Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.782487Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:586d6b5d16be9be69364ee4074ccd2c4c4d465fe8f850ddb416edc94b26172a5","observation_id":"ed5bf860-324f-43dd-8793-735663e4f4a4","resolution":{"observed_at":"2026-08-07T04:59:18.782487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.904741Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.904741Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:0df4652ac87613dc523e4c932c9d7450a46b6a802bc1b2dcd65dd90928fc37af","observation_id":"fb99c6e9-90fd-403b-999c-72945e769f24","resolution":{"observed_at":"2026-08-07T04:59:18.904741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:42:24.080368Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2506.09351."}