{"as_of":"2026-08-08T04:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ee8bc384996f85dd799bd3fd44a51b25013185c9f2032ed5b89bc4bf342fc96","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:56:26.322963Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12597/citation-record","integrity":"/paper/2506.12597/integrity","json":"/paper/2506.12597/citation-record.json","paper":"/paper/2506.12597"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.08477","last_updated":"2024-07-01T15:29:16Z","snapshot_observed_at":"2026-08-06T17:45:57.639013Z","submitted_at":"2024-03-13T12:46:03Z","title":"Unleashing the Power of Meta-tuning for Few-shot Generalization Through Sparse Interpolated Experts","version":3},"cited_work":{"arxiv_id":"2403.08477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.08477","snapshot_observed_at":"2026-08-07T00:56:26.631642Z","title":"Unleashing the Power of Meta-tuning for Few-shot Generalization Through Sparse Interpolated Experts","venue":"cs.CV","work_id":"16c065f2-014e-4d65-955e-dd2d9d6aeab1","year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.165504Z"},"links":{"cited_paper":"/paper/2403.08477","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:8ebb039fd633a50608efff8d55a87c3e80592fe415d669813c1980ea12a482ff","observation_id":"149c82aa-8745-4c92-8d97-b58920982af5","resolution":{"observed_at":"2026-08-07T00:56:26.637318Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-07T00:56:26.169776Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.169776Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:ff8b1fa6cfa79ec6f2faffc71f0d534dc521c85ab28cd4fdb511059a3f869fef","observation_id":"08f5f164-3286-4cd0-bf08-4dfada968dee","resolution":{"observed_at":"2026-08-07T00:56:26.169776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.173553Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.173553Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:d40b2b366f34cea3a69dd213683a5d5eae6558c499203c027c1cc3df0f55ae79","observation_id":"c05f71a8-b585-47f4-8f2f-e9659ff16cf2","resolution":{"observed_at":"2026-08-07T00:56:26.173553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.932056Z","title":null,"venue":null,"work_id":"9d2fc878-740a-4f1f-b22d-0bb60c484c12","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.177157Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:285b6b1928a7d6f5cad5efc416518832cd9d9d3dea7ee3e9883c8f39f07072c9","observation_id":"a468245e-e4d9-40b5-ace0-ae185c811aa7","resolution":{"observed_at":"2026-08-07T00:56:26.935993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.921522Z","title":null,"venue":null,"work_id":"031ed795-8b1b-4f6e-b5b3-4a5baed143bd","year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.180300Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:df38c6bb65315afcec23c60e693bd6d6fe4b8ba622d0f5ba1818f7c369e84f28","observation_id":"86705620-1c32-4167-b7fa-4a806b28cea5","resolution":{"observed_at":"2026-08-07T00:56:26.924768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14761","last_updated":"2024-10-22T22:46:15Z","snapshot_observed_at":"2026-07-30T23:06:42.747124Z","submitted_at":"2023-08-25T17:59:59Z","title":"Unified Concept Editing in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14761","snapshot_observed_at":"2026-08-07T00:56:26.183703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.183703Z"},"links":{"cited_paper":"/paper/2308.14761","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:d5eae54a99388cd2607b092e7afba9762f9793e2dbcd2df3887017b4d0f8315d","observation_id":"04641c3b-d6ca-4277-b074-c9090b6004c8","resolution":{"observed_at":"2026-08-07T00:56:26.183703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07524","last_updated":"2025-06-16T02:29:18Z","snapshot_observed_at":"2026-08-07T07:47:25.930763Z","submitted_at":"2024-10-10T01:36:03Z","title":"Upcycling Large Language Models into Mixture of Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07524","snapshot_observed_at":"2026-08-07T00:56:26.187530Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.187530Z"},"links":{"cited_paper":"/paper/2410.07524","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:594070af7bcac005b5084bae70af6a5f0d41bca55daa0bb5b5666cd14634854e","observation_id":"f319c1af-7c8e-430a-851d-df31903dabd4","resolution":{"observed_at":"2026-08-07T00:56:26.187530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.191044Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.191044Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:f33d493818d6e0270925329efda6cdf10207acb13e134e47933c7faa0e6bc12e","observation_id":"afbeef49-3f5a-424d-82e1-b10230b0c9a2","resolution":{"observed_at":"2026-08-07T00:56:26.191044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.194043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.194043Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:6db5bc91d4d56645e88c740e6e867cb0d8e7595c7f9bdba912d1bf2665c332a4","observation_id":"addb035f-f311-45ef-a9a3-e45ab9129239","resolution":{"observed_at":"2026-08-07T00:56:26.194043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-07T13:04:50.040909Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T00:56:26.197160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.197160Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:2bf97521a2191629231e828c65d701b068e2adfe8c75ce84c984b69e04720fbf","observation_id":"34a1f377-4fba-4a06-b4ff-4a8aa7f44336","resolution":{"observed_at":"2026-08-07T00:56:26.197160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.911861Z","title":null,"venue":null,"work_id":"5c9a812b-1329-41dd-a62d-fb21c468e08d","year":2025},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.200522Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:510f90bfa6ea271591f2ce4cc1a0622b76250d0f9663a86bb3ae3c764849a3fc","observation_id":"7a3948d6-9e35-432d-ba15-12a32fc67d56","resolution":{"observed_at":"2026-08-07T00:56:26.914955Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.902321Z","title":null,"venue":null,"work_id":"a8575d07-309b-49b0-a26c-11909ce26221","year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.203882Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:6f92c2de8365ce71edcffb615c327888c047792c2a58e39266a690c27e8f1bc5","observation_id":"e306f15e-8ee5-4e34-bfe8-ac65b6b1ef88","resolution":{"observed_at":"2026-08-07T00:56:26.905350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-07T00:56:26.207286Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.207286Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:dec3d5728d73b9076c99e9fda271dca9ae3bbc75ba3a7bf71d061745d107dd37","observation_id":"c7feb77a-938b-4778-b57d-76161f1a37c5","resolution":{"observed_at":"2026-08-07T00:56:26.207286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.892039Z","title":null,"venue":null,"work_id":"1e43b3b8-ea0f-4ed0-a88d-22fad4a4ef27","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.210869Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:92390947503052bea5bcfae5ed89762629fdba15f17a098de6a946d78ee69bca","observation_id":"571ce800-ed7a-464f-8da7-aeb9edfc39dc","resolution":{"observed_at":"2026-08-07T00:56:26.895834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.882514Z","title":null,"venue":null,"work_id":"0ee3f5d0-2823-476f-a18e-d356ccf99b98","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.213718Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:9eaac81cfc706741d49481a521406ff5a85c0494619e6bfe550cf92350ce974a","observation_id":"a7c89fc9-ecf0-4ffb-9250-5964a5255230","resolution":{"observed_at":"2026-08-07T00:56:26.885549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.03306","last_updated":"2022-08-05T17:46:38Z","snapshot_observed_at":"2026-07-06T13:39:17.572174Z","submitted_at":"2022-08-05T17:46:38Z","title":"Branch-Train-Merge: Embarrassingly Parallel Training of Expert Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.03306","snapshot_observed_at":"2026-08-07T00:56:26.216747Z","title":"Smith, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.216747Z"},"links":{"cited_paper":"/paper/2208.03306","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:949a7d90bcd0c9202dfe35cd590252cd49720df3c668f21f40679914b6e4e1eb","observation_id":"3719c411-dbc3-4766-89de-cea2be10bd24","resolution":{"observed_at":"2026-08-07T00:56:26.216747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.220009Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.220009Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:85028fae65d82038431e1a6eaa1dd470b7c463dcc8aebc09acf21ae720d0966c","observation_id":"06ab21f3-8a81-42d4-b4bf-34df1d34692b","resolution":{"observed_at":"2026-08-07T00:56:26.220009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.867039Z","title":null,"venue":null,"work_id":"92c62224-9af7-4989-a8c9-4b5964a5f93c","year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.223176Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:84adbb87b56cf1fec239001a1507195744bdd2a7f1c14d7ca040850a13b51531","observation_id":"ddd21e82-93eb-4014-868c-6bd10bfbb128","resolution":{"observed_at":"2026-08-07T00:56:26.869992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.857601Z","title":null,"venue":null,"work_id":"050e160c-798c-4e9c-b969-358f06d82549","year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.226230Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:2d96e29ea3b22e5140ce820640814bfaf1e268b24fec8d63ff47660e184c818a","observation_id":"68b1ddf7-46b2-4752-bfa7-3cad691ca982","resolution":{"observed_at":"2026-08-07T00:56:26.860655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.847238Z","title":"Longpre, Le Hou, Tu Vu, Albert Webson, Hyung Won Chung, Yi Tay, Denny Zhou, Quoc V","venue":null,"work_id":"459b5bd9-8b83-444d-95d3-203909d13998","year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.229640Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:173065ae050eb28763baa1f26567c708447cf1173bcb45ee49f7e5b5f7576353","observation_id":"56dc006e-b720-4ad4-bf2f-317ad163b71b","resolution":{"observed_at":"2026-08-07T00:56:26.850939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.836951Z","title":null,"venue":null,"work_id":"eb762be9-16a7-4491-b756-4a7dfac045bd","year":2018},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.232783Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:9647f9be090f41e53979b51d1a7f7aa5eb960f7976c3e9dc3938d3991e84cd30","observation_id":"ace95fe6-310d-4def-86a7-67c27d7afe79","resolution":{"observed_at":"2026-08-07T00:56:26.840163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.235982Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.235982Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:4a5cc049685607d08fcdd4894eb45a4155fc9c4f396aa4881a63ec80bc31c45d","observation_id":"6317c8fb-f912-42b2-9886-aab04fcdfe72","resolution":{"observed_at":"2026-08-07T00:56:26.235982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T00:56:26.239312Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.239312Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:de53d7b814bfb0d54614a89faa45dc803ebb5f2a1e39671fbc4b01cfd330e79e","observation_id":"9478a347-d516-4dde-8e24-7d92ce2c30e1","resolution":{"observed_at":"2026-08-07T00:56:26.239312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.820891Z","title":"Smith, Pang Wei Koh, Amanpreet Singh, and Hannaneh Hajishirzi","venue":null,"work_id":"64b6da89-2de4-42e6-b1f5-6f979e217610","year":2025},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.242941Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:921340579da7a3327615524376122b9b9966958cfd51afddbea2e8a4e650d29f","observation_id":"dd339a99-6fb6-45d0-8bee-25a18c27eca0","resolution":{"observed_at":"2026-08-07T00:56:26.824394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03745","last_updated":"2024-05-13T16:20:29Z","snapshot_observed_at":"2026-07-06T15:39:14.565475Z","submitted_at":"2023-06-06T15:04:31Z","title":"Soft Merging of Experts with Adaptive Routing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03745","snapshot_observed_at":"2026-08-07T00:56:26.245959Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.245959Z"},"links":{"cited_paper":"/paper/2306.03745","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:bb06303bf954b597b923a30d4aff607f8217411a0247d37c1a73a60cc6eda599","observation_id":"137ca168-5574-4685-b399-198c2827b237","resolution":{"observed_at":"2026-08-07T00:56:26.245959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.811034Z","title":null,"venue":null,"work_id":"9b18a2d6-e7c5-4e10-80e2-0d69ed3d4c54","year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.249091Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:0c106163e93f177c493e75546ea7cad05cf35eafe4f6c0fb0999d56566fbd778","observation_id":"f4a34708-bb41-4b75-8027-039bc05d1dc7","resolution":{"observed_at":"2026-08-07T00:56:26.814425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:56:26.252088Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.252088Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:a697d4b340862092022ddf5bf89a60b6f87731f6a2f0da079e91f94a83686965","observation_id":"3d89c436-4280-438d-bf2e-53d2f74dfbd2","resolution":{"observed_at":"2026-08-07T00:56:26.252088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.801522Z","title":null,"venue":null,"work_id":"48e551f8-7323-4129-9253-9a55c8bbc428","year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.256592Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:eea9dc4086f651ea5aaccb8ee6c2d4d7a6623d7f119c9048fb71d6ee84a118f7","observation_id":"169c8a84-72d2-4473-890c-1141831418f2","resolution":{"observed_at":"2026-08-07T00:56:26.804741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00951","last_updated":"2024-05-27T11:44:51Z","snapshot_observed_at":"2026-08-04T22:30:49.675313Z","submitted_at":"2023-08-02T05:20:55Z","title":"From Sparse to Soft Mixtures of Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00951","snapshot_observed_at":"2026-08-07T00:56:26.259692Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.259692Z"},"links":{"cited_paper":"/paper/2308.00951","citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:510b4a8387f68dbc4b4edf2e1817fb4cbe9c048e6a0f181ac071f48271afa2bb","observation_id":"e8015542-df26-4d4a-a1ad-cf5adccf0d39","resolution":{"observed_at":"2026-08-07T00:56:26.259692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.263039Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.263039Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:c3e1c7158b36d11aee66fc1eddb6b39f5d26506feb66bbb523b5ba9b17bfa910","observation_id":"8b74e893-f092-483e-9130-678f0c3ff61f","resolution":{"observed_at":"2026-08-07T00:56:26.263039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.266052Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.266052Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:fb43dac61e4570cfe2e471844a8d2cceb2e3db0782b9e97bedd5b4150786d529","observation_id":"9af0e932-39e9-41d3-9c30-5b1931fbff25","resolution":{"observed_at":"2026-08-07T00:56:26.266052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.778454Z","title":null,"venue":null,"work_id":"1597ec83-b480-47a5-a569-c93b0143eec7","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.269064Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:3f8d000b0a86f06490e21a0314bfed5fee17c5962c73bb468bd69fdaba337165","observation_id":"de30317a-177e-40db-b944-d448d40d4dcc","resolution":{"observed_at":"2026-08-07T00:56:26.781660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.767797Z","title":null,"venue":null,"work_id":"915079cd-1132-4ffd-844c-cb45dcbe6929","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.272094Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:14f837c43a634d566b24b9fb367f192eb3910021514aa9215374b4f4a7b2d136","observation_id":"1bd67fd6-7f49-4961-8510-8f4c92c7284e","resolution":{"observed_at":"2026-08-07T00:56:26.771305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.757244Z","title":null,"venue":null,"work_id":"cfc45eef-a87e-4da2-b410-e128c13aa99a","year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.275218Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:5015dbc22e869055063170163755d045b1e9673d077938226de29194785eb73b","observation_id":"a364da58-bbbf-4045-9c88-17074e739d5e","resolution":{"observed_at":"2026-08-07T00:56:26.760452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.747402Z","title":null,"venue":null,"work_id":"f2c02825-ca42-43bf-9981-ee81e2decf5a","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.278180Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:9ce2db16498aca46be10b0eb99a085590de415a74f298a5e22ee61fbf9c609fc","observation_id":"e99227d8-ae31-4c6f-8a92-c05a7699a4b9","resolution":{"observed_at":"2026-08-07T00:56:26.750930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.737946Z","title":null,"venue":null,"work_id":"17bf46ff-1f35-497b-bcc0-27bf81d2b5f8","year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.281515Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:c74d482af12c97f7ed432060da62e05c5077fc1d25d1a340375c3d06e8f0db3f","observation_id":"0a4acaf1-2dbe-4bb8-9f69-2ba0d9bd2844","resolution":{"observed_at":"2026-08-07T00:56:26.740948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.727890Z","title":null,"venue":null,"work_id":"315e7cb2-585d-49ad-8f2f-8091fd173e41","year":2017},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.284484Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:ef3645f2427220eac891189fb3fdca5ecc782bd9c3211f618d149ffe04eb0df9","observation_id":"e8d75ded-17f7-46e5-ab6f-33da8687c56e","resolution":{"observed_at":"2026-08-07T00:56:26.731217Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.287419Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.287419Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:08368ae5b3d70e701cd7973b3d563e038be8bf0b220ccf6c77c058dbbf20a52d","observation_id":"417420f8-d794-4090-925c-a19c80a992dd","resolution":{"observed_at":"2026-08-07T00:56:26.287419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.718133Z","title":null,"venue":null,"work_id":"7abdb830-eaf5-46b5-a277-0b3805e2a1ca","year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.290250Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:1d752e13f17a04d21baba915c6451dd291ea83851a780f09fc5c6f3e8f61167a","observation_id":"3dbf04da-ca96-44a0-a203-13cc4b4ba0a8","resolution":{"observed_at":"2026-08-07T00:56:26.721214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.293136Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.293136Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:e8a0155e13261849b37be96118b9320cf290f6d03f70819504f403d4d3b83b3a","observation_id":"7055f918-2695-4c36-bd5c-1fb899ec8518","resolution":{"observed_at":"2026-08-07T00:56:26.293136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.702415Z","title":null,"venue":null,"work_id":"b71ecd19-9e27-41cc-bd37-326e01b95742","year":2021},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.295972Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:d94a4397bc0ea233b7ba132424b60d842d685e236ec89d8b5d755684ca37ea9e","observation_id":"05c77475-dae2-4707-8628-d59de23ac906","resolution":{"observed_at":"2026-08-07T00:56:26.705510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.298812Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.298812Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:6678868fb036ed342a7e389f6719de9b7e8efc0c0a7e985544853298a2ea4940","observation_id":"0b12d88d-019e-42f3-b733-57bc96bdddd1","resolution":{"observed_at":"2026-08-07T00:56:26.298812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.301643Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.301643Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:51d211f21ce1f78701cc2b36f0e835f4fdef87f87efd6618631be73f5b54a087","observation_id":"8a44a49d-941a-4be7-9d51-c667967a9faa","resolution":{"observed_at":"2026-08-07T00:56:26.301643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.679247Z","title":null,"venue":null,"work_id":"61af3282-87f1-4404-8fc0-7a792f5a164c","year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.304899Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:a720ad44df77c8c5ea3326e58194003fe4f1feea3a6eaf65a340cad05c91a630","observation_id":"480ba3c4-dd69-4e54-a5e9-306b6103418c","resolution":{"observed_at":"2026-08-07T00:56:26.682568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.307893Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.307893Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:247eeb7dcf2d683c96f0258dc0d9f35a8fbdbbd15d19009db5fd3604f77e6da1","observation_id":"e44eb459-445e-4bb7-8298-4d9a097ce14d","resolution":{"observed_at":"2026-08-07T00:56:26.307893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.669049Z","title":"Dai, Zhifeng Chen, Quoc V Le, and James Laudon","venue":null,"work_id":"94f80106-3055-43af-a9a6-41c568e935cc","year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.310734Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:3f34048b1f43e0d1527192de5f47e71c630e68f71fe1fa6259c467ed633a0202","observation_id":"0022e5f7-a073-497f-922b-a169a6603577","resolution":{"observed_at":"2026-08-07T00:56:26.672354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.313533Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.313533Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:87e8e56f89e6db749c276eb8699a640f56bbf35aadf9f5e0a627f7680495564d","observation_id":"46269db3-6e0d-42bc-8364-39ea5eb65405","resolution":{"observed_at":"2026-08-07T00:56:26.313533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.659408Z","title":null,"venue":null,"work_id":"3c976f99-de4b-470c-8362-b932d6349f68","year":2022},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.316574Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:46cdc77e208f89feec8f5982dc465b083b29a6afb6f18f14ea64d4271e421f2e","observation_id":"d3d37a27-da43-4a5f-8db2-814a41fd46e3","resolution":{"observed_at":"2026-08-07T00:56:26.662474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.319425Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.319425Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:85b72f895f2c18e3a8ac5da097df766cb6682a2d408027454eefbab81716382f","observation_id":"92ea5d89-01ab-425f-b3dd-3260b0259696","resolution":{"observed_at":"2026-08-07T00:56:26.319425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:26.322963Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T00:56:26.322963Z"},"links":{"citing_paper":"/paper/2506.12597"},"observation_digest":"sha256:e5b34864add2c767fd6d0878dcf6521acdccf70e61ba4f8a1b8999d25d324eb8","observation_id":"1b686803-41ef-4caf-b2d1-f237f030afc1","resolution":{"observed_at":"2026-08-07T00:56:26.322963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12597","last_updated":"2025-06-14T18:34:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T00:43:00.229748Z","submitted_at":"2025-06-14T18:34:38Z","title":"Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2506.12597."}