{"as_of":"2026-08-20T05:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7019ce3cd7f79666de39ba93c06f62e54e62a0deeca0303dbdf148855198689","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:20:34.598158Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T22:38:30.674751Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T22:46:35.968689Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23830","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23830","snapshot_observed_at":"2026-07-09T22:46:35.968689Z","title":"Evomoe: Expert evolution in mixture of experts for multimodal large language models","venue":"cs.CL","work_id":"00eb9e03-1a3d-4ad0-80f8-c813b33e5b8b","year":2025},"citing_paper":{"arxiv_id":"2604.23996","last_updated":"2026-04-27T03:23:19Z","snapshot_observed_at":"2026-08-15T05:33:19.595727Z","submitted_at":"2026-04-27T03:23:19Z","title":"SMoES: Soft Modality-Guided Expert Specialization in MoE-VLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T04:41:52.098355Z"},"links":{"cited_paper":"/paper/2505.23830","citing_paper":"/paper/2604.23996"},"observation_digest":"sha256:eaa2b4870a58db10a47ff4e154e9b4d43c4b32d59caed1bbc39374073cd35f7f","observation_id":"3b74db3f-1ce1-4ee2-97ff-a976c9606164","resolution":{"observed_at":"2026-05-11T21:36:18.618979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23830","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23830","snapshot_observed_at":"2026-07-09T22:46:35.968689Z","title":"Evomoe: Expert evolution in mixture of experts for multimodal large language models","venue":"cs.CL","work_id":"00eb9e03-1a3d-4ad0-80f8-c813b33e5b8b","year":2025},"citing_paper":{"arxiv_id":"2607.06943","last_updated":"2026-07-08T03:13:43Z","snapshot_observed_at":"2026-08-13T09:04:28.526066Z","submitted_at":"2026-07-08T03:13:43Z","title":"General Incomplete Multimodal Learning via Dynamic Quality Perception","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-09T22:38:30.674751Z"},"links":{"cited_paper":"/paper/2505.23830","citing_paper":"/paper/2607.06943"},"observation_digest":"sha256:cacc3854e641587a19af57f6b6285c32e69a0383f9a166d82037ca025efb1393","observation_id":"b4a56742-d546-454b-ac7e-012ef9258e47","resolution":{"observed_at":"2026-07-09T22:46:35.970437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23830/citation-record","integrity":"/paper/2505.23830/integrity","json":"/paper/2505.23830/citation-record.json","paper":"/paper/2505.23830"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:20:30.271705Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.271705Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:7b0074a675c3c8bd0e1322ca472b5aae9eec89f469ff7aa33b786dd4c6f764dd","observation_id":"f624654a-f52d-469a-964a-c75488b69588","resolution":{"observed_at":"2026-08-07T13:20:30.271705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T13:20:30.313951Z","title":"arXiv preprint arXiv:2309.16609 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.313951Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:d6f3262527d053ddc5c49b288e5ac7f51f8a28096a7bcae046b3c25ba72c6a89","observation_id":"80f93a88-5a40-42f0-9736-63f6216aea63","resolution":{"observed_at":"2026-08-07T13:20:30.313951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T13:20:30.359727Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.359727Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:ff3f6175237e2ebff7b8feabde2bc38a71ffca2ed1cbf404c0fa3ce9a0305ddc","observation_id":"d2bb179d-63bd-426f-8505-1ee13ecd59e6","resolution":{"observed_at":"2026-08-07T13:20:30.359727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17834","last_updated":"2024-02-27T19:00:07Z","snapshot_observed_at":"2026-08-19T14:32:57.678714Z","submitted_at":"2024-02-27T19:00:07Z","title":"Stable LM 2 1.6B Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17834","snapshot_observed_at":"2026-08-07T13:20:30.438921Z","title":"arXiv preprint arXiv:2402.17834 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.438921Z"},"links":{"cited_paper":"/paper/2402.17834","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:f3a0823892b73c6dad1802d08f18233cf7f9d55feeb5b25cada0bbe7295dbdc5","observation_id":"0949492e-850b-4757-a66f-5666ff7f2d6e","resolution":{"observed_at":"2026-08-07T13:20:30.438921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:38.727626Z","title":"ACM transactions on intelligent systems and technology 15(3), 1–45 (2024)","venue":null,"work_id":"75abe4e1-b965-4da7-acfa-a0ad0ba4fe24","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.492057Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:e86746e9e19eb6c59951f319df1f986ef81ecce562367fa7354f2a801b9c9126","observation_id":"b3b95d16-be0c-475f-b3e1-849356fc518d","resolution":{"observed_at":"2026-08-07T13:20:38.839700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:38.600399Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"2949101e-0cdb-4a3a-8895-a4571e14a669","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.609520Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:a5ec266da62019d1d59471b8eb932f973a60d3accd2a634dd78df862672ea56e","observation_id":"3d839909-1c52-424c-b63b-662eb379e1fe","resolution":{"observed_at":"2026-08-07T13:20:38.662582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16160","last_updated":"2024-01-30T15:44:58Z","snapshot_observed_at":"2026-08-17T07:39:58.326895Z","submitted_at":"2024-01-29T13:48:36Z","title":"LLaVA-MoLE: Sparse Mixture of LoRA Experts for Mitigating Data Conflicts in Instruction Finetuning MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16160","snapshot_observed_at":"2026-08-07T13:20:30.667213Z","title":"arXiv preprint arXiv:2401.16160 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.667213Z"},"links":{"cited_paper":"/paper/2401.16160","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:930c149c9050d5d80c4b31d72de66e34ca6c279c5fbdf8a335d0376c7e29e9e7","observation_id":"63d240c0-17eb-426c-84cc-121c493e4f32","resolution":{"observed_at":"2026-08-07T13:20:30.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:30.755413Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.755413Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:76eba3734db69d6e55affb4acf3953b16839a340598f7505cb9f3f2b06267e45","observation_id":"3f7fc18a-481e-4dae-ad5c-28daddf1ccfa","resolution":{"observed_at":"2026-08-07T13:20:30.755413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:30.829169Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.829169Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:11f055bea1253ece112c6cf1e6fe527abb0fdbc11a3c043e93e39bf0c8c291f9","observation_id":"7f7d3812-0407-46b2-afff-bfc48a038b32","resolution":{"observed_at":"2026-08-07T13:20:30.829169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-07T13:20:30.968198Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:30.968198Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:586da20f41c1f6e9e05b956f9ce3b8dd382ce6713303a5e8e44693cb640f7993","observation_id":"648d15fc-6f79-43f0-9feb-0ef4497b1f23","resolution":{"observed_at":"2026-08-07T13:20:30.968198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03766","last_updated":"2024-02-06T07:16:36Z","snapshot_observed_at":"2026-08-09T19:28:34.281681Z","submitted_at":"2024-02-06T07:16:36Z","title":"MobileVLM V2: Faster and Stronger Baseline for Vision Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03766","snapshot_observed_at":"2026-08-07T13:20:31.067103Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.067103Z"},"links":{"cited_paper":"/paper/2402.03766","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:94eac4ef57339714b47da37d4ab19f58669af950f0f8f90ecf01970108e8e9e3","observation_id":"fe6c6223-effc-4819-be1e-fc57e34fbc5a","resolution":{"observed_at":"2026-08-07T13:20:31.067103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T13:20:31.150275Z","title":"ArXiv abs/2306.13394 (2023), https://api.semanticscholar.org/CorpusID: 259243928","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.150275Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:a316f2b1d5d51f9039b1d2294c684171b0385863bf2a67335cb3a5deca71b51c","observation_id":"40c2931c-fec7-4e7e-bc87-ff5b6e4afb9d","resolution":{"observed_at":"2026-08-07T13:20:31.150275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:31.283561Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.283561Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:c0760b1e6176b472d14417ba304c0a4dfd49fb5426b2e53e519d5516c53ac252","observation_id":"e459685c-31e7-4ebe-85ec-8da48a1fec35","resolution":{"observed_at":"2026-08-07T13:20:31.283561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:20:31.401238Z","title":"arXiv preprint arXiv:2407.21783 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.401238Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:2382c7e1208dc054449c249f8f5e648f5881e96c29f9af5df8b01c9c5efbaf2b","observation_id":"851d613a-82a2-40f0-a8a6-37c2b720f246","resolution":{"observed_at":"2026-08-07T13:20:31.401238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:31.484271Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.484271Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:1969e42f05d6de7addae50454983e7c3bd1318652ed99610bb3da005fe12d66e","observation_id":"20f3df6d-a45c-42fe-86a3-b4cdc0addd49","resolution":{"observed_at":"2026-08-07T13:20:31.484271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T13:20:31.573128Z","title":"arXiv preprint arXiv:2410.21276 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.573128Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:30c656cbfca43de559859824998640918ce3deb1d41de86c0f06121b9f0d439d","observation_id":"0eabdc05-40e2-435d-94f2-6790dc326d40","resolution":{"observed_at":"2026-08-07T13:20:31.573128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:38.322039Z","title":"Microsoft Research Blog 1(3), 3 (2023)","venue":null,"work_id":"ee09b6c9-d39c-469e-8c0e-7f1ba2e24ee2","year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.661509Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:55047208af9d6ced15c11d51caee80349b53157d927cc83f52a36e2f30abad43","observation_id":"ebb0b50f-bd58-4620-b42a-60bb598a5f0d","resolution":{"observed_at":"2026-08-07T13:20:38.436048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:38.079468Z","title":"IEEE Network (2024)","venue":null,"work_id":"5501c03c-a6f2-4446-a314-49a13e2c0f43","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.702157Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:c6b3b8a30f657aae689eca5426c3c9430d0e62f02a1fbb0cc409d752bb5a80f6","observation_id":"4fc195f8-b857-4c71-9d70-9afa6ce79021","resolution":{"observed_at":"2026-08-07T13:20:38.188828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:37.781012Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"35410910-bff0-44e4-8876-546f799aab55","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.731229Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:59c5d1d20b14bec3ff8074ecb48e748223c1414c8cd45c74e81993156e1e135e","observation_id":"27cc61d9-43ee-4628-ae39-668ff9fd7a0b","resolution":{"observed_at":"2026-08-07T13:20:37.911290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:37.580142Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"7c677df7-8f41-425f-8836-c20793422213","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.800176Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:baea7b9f22e076399dce03470e014d4df53cd1208998d4547ab755d3052a99d9","observation_id":"a46b1ef8-6e66-4042-bf2e-560d7d6115c7","resolution":{"observed_at":"2026-08-07T13:20:37.677671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08313","last_updated":"2025-01-14T18:50:05Z","snapshot_observed_at":"2026-08-13T08:34:05.764059Z","submitted_at":"2025-01-14T18:50:05Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08313","snapshot_observed_at":"2026-08-07T13:20:31.881428Z","title":"arXiv preprint arXiv:2501.08313 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.881428Z"},"links":{"cited_paper":"/paper/2501.08313","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:4133f971e9b80fa934261dbeeedf5bdd69e5cf98077d7bade87236e7c0b95dbc","observation_id":"caf95c9e-1e8b-4290-ae91-a4daa6825a17","resolution":{"observed_at":"2026-08-07T13:20:31.881428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05425","last_updated":"2023-06-08T17:59:56Z","snapshot_observed_at":"2026-08-16T15:25:23.093007Z","submitted_at":"2023-06-08T17:59:56Z","title":"MIMIC-IT: Multi-Modal In-Context Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05425","snapshot_observed_at":"2026-08-07T13:20:31.989594Z","title":"arXiv preprint arXiv:2306.05425 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:31.989594Z"},"links":{"cited_paper":"/paper/2306.05425","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:7d6cf731ed5d8ab6bdefa5fc5d9fba75a5b97dc9bfa923bd6a7bb57ca116d46a","observation_id":"2ae49aa6-1a19-4996-83ee-71f799f8bae8","resolution":{"observed_at":"2026-08-07T13:20:31.989594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-07T13:20:32.036065Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.036065Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:08e5d0b50d880e91363d15ddae9cc591bb383e263ffb9769ca9b30435b55bc45","observation_id":"bd0886bf-8a2f-492f-92b9-a27cb5892470","resolution":{"observed_at":"2026-08-07T13:20:32.036065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-07T13:20:32.102903Z","title":"arXiv preprint arXiv:2305.10355 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.102903Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:1458ebd41b88a9c1afeab20ad2bbd63fbbe0986e0c2c1790c070c2f834bdde6f","observation_id":"7b7497da-f65d-476a-a408-852f1f0b740f","resolution":{"observed_at":"2026-08-07T13:20:32.102903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-18T21:21:26.158966Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-08-07T13:20:32.190430Z","title":"arXiv preprint arXiv:2401.15947 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.190430Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:5c1fc3fd8556f39d915241ba52d8f68c942b06ae8cb68285c360f098c3c07ad6","observation_id":"183d07b9-ef2a-4c0d-bbcd-70f57c4e4f95","resolution":{"observed_at":"2026-08-07T13:20:32.190430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T13:20:32.265065Z","title":"arXiv preprint arXiv:2412.19437 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.265065Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:ea2bb14318e8ad166e424aafe4fa5a5b30c93c80b99e32ab1d9419f9a7bafaae","observation_id":"6891fdb5-d1af-4011-ac1d-5927ae076b21","resolution":{"observed_at":"2026-08-07T13:20:32.265065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:37.380611Z","title":"CoRR (2023)","venue":null,"work_id":"42dac10d-0338-4829-b34d-0240378de641","year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.306258Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:c4fb9ae41794b9772eace2a16c0aba5e1e74d0f81b8c501a694c7d3ffe52e701","observation_id":"c3efa5d9-edb5-41c1-8d14-017717735500","resolution":{"observed_at":"2026-08-07T13:20:37.500265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:32.361267Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.361267Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:2bb238c0028e7f99ccfad3f26d2c72baad04820330fa943bd7b675d2e280a236","observation_id":"903e10cc-bc2e-45ae-88c0-7fcc8dec158b","resolution":{"observed_at":"2026-08-07T13:20:32.361267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14219","last_updated":"2025-01-22T03:33:25Z","snapshot_observed_at":"2026-08-17T05:50:31.197474Z","submitted_at":"2024-12-18T14:11:15Z","title":"A Survey on Inference Optimization Techniques for Mixture of Experts Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14219","snapshot_observed_at":"2026-08-07T13:20:32.448368Z","title":"arXiv preprint arXiv:2412.14219 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.448368Z"},"links":{"cited_paper":"/paper/2412.14219","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:00a885bb732ff4b2718afd35bd47e6a62dc643da9d867e15f53895a88dbfc587","observation_id":"cad36c35-3160-41bb-8775-127ade344a8c","resolution":{"observed_at":"2026-08-07T13:20:32.448368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:37.192513Z","title":null,"venue":null,"work_id":"d5d339ce-b70a-41c2-bb0a-51afb600a246","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.507569Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:ac8c77d79a46a1a6c59b77cc18bbfcdb7299b39f8ef0a271017407c632b779b6","observation_id":"8acaa628-4394-4410-9ea6-8dd56f13a10a","resolution":{"observed_at":"2026-08-07T13:20:37.240375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-07T13:20:32.568307Z","title":"arXiv preprint arXiv:2403.05525 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.568307Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:ff5bfcc21b2835ca705e6092d272807110a7fb028c49b0fca9a95b65be9c6715","observation_id":"d983cb1d-80f2-43d3-88ed-0d6fc61e3731","resolution":{"observed_at":"2026-08-07T13:20:32.568307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:32.609234Z","title":"Advances in Neural Information Processing Systems 35, 2507–2521 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.609234Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:703198e7b24438d9b9edfe4a0d497b1bec1badf4715391d617a95026da580168","observation_id":"c9573e28-ed58-4c60-a49a-8b5bae23698f","resolution":{"observed_at":"2026-08-07T13:20:32.609234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:36.919189Z","title":"Advances in Neural Information Processing Systems 35, 9564–9576 (2022)","venue":null,"work_id":"a5cbfa6e-a43e-4b0b-97ec-423ce25a3774","year":2022},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.670272Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:5d558e17ffd8d2e769d93533fd16cc6d9d6c58f6488ce53e9acccc628499f25d","observation_id":"2c6bb227-8ca6-4cf5-ac6a-e0db8e34f991","resolution":{"observed_at":"2026-08-07T13:20:37.037378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-07T13:20:32.739393Z","title":"arXiv preprint arXiv:2307.06435 (2023) 11","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.739393Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:7d6df4fbc1b91e8f87f416263b0628e7825648774937cee6fc8e7ce9d9f8c993","observation_id":"173d928e-7302-4603-96e5-fbf4f78aa875","resolution":{"observed_at":"2026-08-07T13:20:32.739393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:32.801258Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.801258Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:2d0b11c38ee248681ae518cf6f065d34b1aea772636b8ec5544edea994260525","observation_id":"f2d8832e-b1a0-4d98-90bc-5134a7c0a743","resolution":{"observed_at":"2026-08-07T13:20:32.801258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:36.677627Z","title":"In: International conference on machine learning","venue":null,"work_id":"8ed94d65-0bb2-4a7c-848e-4d84e9558823","year":2022},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.840595Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:f759461c9e142d8e49fd623aae05bed03236c27a66fdb4c3f6ee1ab3aed49133","observation_id":"d105175f-7356-4254-a86f-9fc695457bc5","resolution":{"observed_at":"2026-08-07T13:20:36.789712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04322","last_updated":"2025-01-23T08:24:29Z","snapshot_observed_at":"2026-08-17T18:00:27.329541Z","submitted_at":"2025-01-08T07:42:54Z","title":"Eve: Efficient Multimodal Vision Language Models with Elastic Visual Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04322","snapshot_observed_at":"2026-08-07T13:20:32.873352Z","title":"arXiv preprint arXiv:2501.04322 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.873352Z"},"links":{"cited_paper":"/paper/2501.04322","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:4b2fcec01997b25842281057dc5a02014255f7240652cf92ae921048a32d16fe","observation_id":"cf10a8ec-9ea4-4941-9797-345210f4ae62","resolution":{"observed_at":"2026-08-07T13:20:32.873352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:36.419688Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"12e394d0-2b80-41b0-87db-a4a138f22431","year":2019},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.907647Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:58b6c511c8460ee1c66069a59390d46f2179cd5078b074d4bb98f76027ee288c","observation_id":"55fcd764-81fa-4543-9445-70173646f3ec","resolution":{"observed_at":"2026-08-07T13:20:36.553346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T13:20:32.961348Z","title":"arXiv preprint arXiv:2403.05530 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:32.961348Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:c9c1c28cc9e3b0be5277ae9137334302d8595e55764c41caa5a65edfa7598025","observation_id":"bd2b22cf-6711-46bf-a6d0-496110ad7cf1","resolution":{"observed_at":"2026-08-07T13:20:32.961348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-08-17T03:46:28.942551Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-07T13:20:33.044401Z","title":"arXiv preprint arXiv:2504.07491 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.044401Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:3156d9fadf2809e4dc6d2a17198fb2fed5b14f7d7f386ae2e00f7289d5a542b7","observation_id":"cc755c05-da6b-4f15-bba6-22033b3e0e66","resolution":{"observed_at":"2026-08-07T13:20:33.044401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:36.188919Z","title":"Nature medicine 29(8), 1930–1940 (2023)","venue":null,"work_id":"45097541-69c0-4fd9-b6a2-64e235a91dd0","year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.064436Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:b1e1402311f0d86c8897d17532a33f7fab89ed2d73644534d7793a1956cd95da","observation_id":"7431ef90-10d5-41db-872f-28be028d7057","resolution":{"observed_at":"2026-08-07T13:20:36.312219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11235","last_updated":"2024-03-16T04:32:25Z","snapshot_observed_at":"2026-08-18T02:33:26.792507Z","submitted_at":"2023-09-20T11:54:40Z","title":"OpenChat: Advancing Open-source Language Models with Mixed-Quality Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11235","snapshot_observed_at":"2026-08-07T13:20:33.151700Z","title":"arXiv preprint arXiv:2309.11235 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.151700Z"},"links":{"cited_paper":"/paper/2309.11235","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:0b3ad8ee6c3853d74bcb4dd97675b4e964802043d4b2f96c8b8af90463be987e","observation_id":"26dc3cd6-55f0-4253-8236-0df2805e689a","resolution":{"observed_at":"2026-08-07T13:20:33.151700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07574","last_updated":"2023-11-29T15:37:24Z","snapshot_observed_at":"2026-08-19T19:09:57.209068Z","submitted_at":"2023-11-13T18:59:31Z","title":"To See is to Believe: Prompting GPT-4V for Better Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07574","snapshot_observed_at":"2026-08-07T13:20:33.198713Z","title":"arXiv preprint arXiv:2311.07574 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.198713Z"},"links":{"cited_paper":"/paper/2311.07574","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:2ca0f6e294cd229aed1bca3805e6e83fb55159b1e722e3feff8d1dfeba693808","observation_id":"aa307276-50eb-488a-b3c3-61cad5c90d37","resolution":{"observed_at":"2026-08-07T13:20:33.198713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T13:20:33.250754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.250754Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:b42bb709a8e6879f5f7df06ea2f93e13c3bd852caef55976d29bec207bf13a26","observation_id":"daf581d6-0d83-4c97-b184-7cb376d372c9","resolution":{"observed_at":"2026-08-07T13:20:33.250754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:20:33.395499Z","title":"5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.395499Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:ed3b7bd8cd9b6dd9763b5ec55bb57578b8efb4457625024688cbb22f59d4758d","observation_id":"a237477e-9dbc-40cb-9b82-6c7c49d1ac48","resolution":{"observed_at":"2026-08-07T13:20:33.395499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16862","last_updated":"2024-06-21T07:08:59Z","snapshot_observed_at":"2026-08-19T13:39:19.209645Z","submitted_at":"2023-12-28T07:11:41Z","title":"TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16862","snapshot_observed_at":"2026-08-07T13:20:33.495378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.495378Z"},"links":{"cited_paper":"/paper/2312.16862","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:3f67b25048730377e6a2b87cf96ee074285f634ad13bbb657f79c92943c37eae","observation_id":"98136340-7b2c-42da-bf54-80601ce7418f","resolution":{"observed_at":"2026-08-07T13:20:33.495378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:35.878945Z","title":"In: 2023 USENIX Annual Technical Conference (USENIX ATC 23)","venue":null,"work_id":"feaad19e-dc41-4b1d-bb80-33efc618163c","year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.604113Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:f1f16ad21e6e1600c9772ee3b18c7a70555d2cc6304ff2b6c9c7c12e08472fb6","observation_id":"9e6c43f4-e12b-4f1a-872e-f5f539be1336","resolution":{"observed_at":"2026-08-07T13:20:36.060441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:35.633112Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"120ba18a-7046-4834-bab2-089159d0b224","year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.771237Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:fdf8c2d6d59ca547cbd83d65109b3f48a677c103cf8ca05dac1cbaf4832360c2","observation_id":"4d66300c-f574-479e-b8f0-0d13205bc633","resolution":{"observed_at":"2026-08-07T13:20:35.761159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13447","last_updated":"2024-03-20T09:42:43Z","snapshot_observed_at":"2026-08-16T14:08:06.107215Z","submitted_at":"2024-03-20T09:42:43Z","title":"HyperLLaVA: Dynamic Visual and Language Expert Tuning for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13447","snapshot_observed_at":"2026-08-07T13:20:33.922548Z","title":"arXiv preprint arXiv:2403.13447 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:33.922548Z"},"links":{"cited_paper":"/paper/2403.13447","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:bd15742bdd3cdba1eedb4d32fc3701b13bffbf8c36794e8475c467b13ad3733f","observation_id":"ff969bf6-1f68-412c-b487-3d4e152c9be7","resolution":{"observed_at":"2026-08-07T13:20:33.922548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04087","last_updated":"2023-12-28T16:01:36Z","snapshot_observed_at":"2026-08-16T15:17:42.537490Z","submitted_at":"2023-07-09T03:25:14Z","title":"SVIT: Scaling up Visual Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04087","snapshot_observed_at":"2026-08-07T13:20:34.070554Z","title":"arXiv preprint arXiv:2307.04087 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:34.070554Z"},"links":{"cited_paper":"/paper/2307.04087","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:f193407ced5acea0a1a5efe9fda38bc190ce9efc73295037e6d37a093612cfd7","observation_id":"1f62fce6-9aa9-49d0-be01-6a51329e294c","resolution":{"observed_at":"2026-08-07T13:20:34.070554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12656","last_updated":"2024-07-25T06:28:01Z","snapshot_observed_at":"2026-08-16T14:17:06.804304Z","submitted_at":"2024-02-20T02:09:55Z","title":"HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12656","snapshot_observed_at":"2026-08-07T13:20:34.208984Z","title":"arXiv preprint arXiv:2402.12656 (2024) 12","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:34.208984Z"},"links":{"cited_paper":"/paper/2402.12656","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:7da63e8bb377fbad0652505d302b94ee5eca01b345d338c2f23824532fed1d03","observation_id":"bd52a66f-475c-4c82-ba3d-b9b4b8f65ba1","resolution":{"observed_at":"2026-08-07T13:20:34.208984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:35.406869Z","title":"In: Proceedings of the 43rd IEEE/ACM International Conference on Computer-Aided Design","venue":null,"work_id":"48ed9e7b-9a7d-48b9-8307-5a53b5c2e023","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:34.313792Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:147e7a7e88befcf95e0788f18d93c5ab36d4e6e3ee4d281992c086d39350d9b2","observation_id":"0ddb9366-3b0d-41ff-8332-119569f4b7a0","resolution":{"observed_at":"2026-08-07T13:20:35.505652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:20:35.170577Z","title":"In: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"84c6f217-6617-4d15-8530-fb9fd9a674f9","year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:34.513204Z"},"links":{"citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:336e671a5cffdae6103054afa94a8ce17ec3d1c014c350608a967af16f91bad3","observation_id":"5423ee54-691d-4037-a926-fce55a327914","resolution":{"observed_at":"2026-08-07T13:20:35.277815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13046","last_updated":"2024-10-31T17:39:34Z","snapshot_observed_at":"2026-08-16T13:59:23.383222Z","submitted_at":"2024-04-19T17:59:48Z","title":"MoVA: Adapting Mixture of Vision Experts to Multimodal Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13046","snapshot_observed_at":"2026-08-07T13:20:34.598158Z","title":"Increasing Expert Diversity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:34.598158Z"},"links":{"cited_paper":"/paper/2404.13046","citing_paper":"/paper/2505.23830"},"observation_digest":"sha256:c20dc10d98c37deb40e54f119f1fd89d0a85fa3bfd02eb1ad3c8d569807a064d","observation_id":"ed79252a-bc64-4bbe-9b9d-f6c05a6b223f","resolution":{"observed_at":"2026-08-07T13:20:34.598158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23830","last_updated":"2025-05-28T08:38:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T18:11:33.461839Z","submitted_at":"2025-05-28T08:38:39Z","title":"EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 2 inbound Pith citation observations for arXiv:2505.23830."}