{"as_of":"2026-08-09T12:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:afcfc228120a36062a307b351ba7d85edc79daf764001959ceebbf2b36a64cd4","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:55:13.064504Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T18:22:45.702572Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T16:17:08.639901Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2510.08008","last_updated":"2026-05-15T08:53:04Z","snapshot_observed_at":"2026-08-03T22:05:31.756040Z","submitted_at":"2025-10-09T09:45:45Z","title":"Beyond Sunk Costs: Boosting LLM Pre-training Efficiency via Orthogonal Growth of Mixture-of-Experts","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T20:36:22.974054Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2510.08008"},"observation_digest":"sha256:43450853e0a011b0c38b1363fd555017e08ea3b4094086bdf6326b05d5abf0ef","observation_id":"88da6abf-22c9-40c5-a791-ceb4895750e6","resolution":{"observed_at":"2026-05-21T20:40:36.521036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2604.19835","last_updated":"2026-05-10T18:33:52Z","snapshot_observed_at":"2026-08-08T23:43:56.161397Z","submitted_at":"2026-04-21T05:53:33Z","title":"Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T03:29:16.555166Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2604.19835"},"observation_digest":"sha256:9f83a81501677da4f5062c98c9d1c4feb0591f7c689cc9dd1655b87565fcab76","observation_id":"1cf4391e-e513-48dc-b90d-0ede8c0cb014","resolution":{"observed_at":"2026-05-10T03:29:21.508447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2604.19835","last_updated":"2026-05-10T18:33:52Z","snapshot_observed_at":"2026-08-08T23:43:56.161397Z","submitted_at":"2026-04-21T05:53:33Z","title":"Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T02:03:02.654035Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2604.19835"},"observation_digest":"sha256:c947cdead97ed4455a1754a6c9a9297e2ddbd8ec8c09ae85951e30ad84d60d61","observation_id":"b61a53bc-fb10-4999-8bab-62856c1f888f","resolution":{"observed_at":"2026-05-12T02:06:15.396431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2604.23996","last_updated":"2026-04-27T03:23:19Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:23:19Z","title":"SMoES: Soft Modality-Guided Expert Specialization in MoE-VLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T04:41:52.098355Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2604.23996"},"observation_digest":"sha256:4de31abde9d30821913adda15d763ed98d7103f2954bf7302bbc8ba54d793436","observation_id":"701af203-5b6b-41f6-8ce2-89c8d2d939ce","resolution":{"observed_at":"2026-05-11T21:36:18.687780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T12:00:35.496822Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:ee5bbf09b4d673b76751714c5b7c3fcbacc173c18e0d719c9967d4ce5e8fc5c9","observation_id":"23095635-0530-4661-aab8-4ce0832d69b3","resolution":{"observed_at":"2026-05-20T12:03:15.157753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T18:22:45.702572Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:58a6406486c14db842b60952b19a50fbe24ed64817b5a71d4d0e01ca837dd39f","observation_id":"5797a3b5-4da2-435d-81a7-c52fc706c5dd","resolution":{"observed_at":"2026-06-30T18:25:00.095976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2606.07404","last_updated":"2026-06-05T15:48:42Z","snapshot_observed_at":"2026-07-06T23:47:05.104295Z","submitted_at":"2026-06-05T15:48:42Z","title":"Reversible Foundations: Training a 120B Sparse MoE through State-Preserving Scaling","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-27T22:55:09.477413Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2606.07404"},"observation_digest":"sha256:13438bfa7aaf104c42fb13cc8fabe21be4d1ee64451e860c45f12e02506944d5","observation_id":"898f4dbc-f439-49a9-8f51-e5172c780184","resolution":{"observed_at":"2026-07-02T16:17:08.641657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.07785/citation-record","integrity":"/paper/2508.07785/integrity","json":"/paper/2508.07785/citation-record.json","paper":"/paper/2508.07785"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:06.816646Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:06.816646Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:e663d4932d18ab4f7e1221127367c648d4241d3b7f01eebbf27f3167e2e15311","observation_id":"7676596d-c99a-49b2-aa59-78e27fae7dad","resolution":{"observed_at":"2026-08-05T21:55:06.816646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.597049Z","title":"AIME Problems and Solutions , 2025","venue":null,"work_id":"a291dae7-656d-4144-80ba-41482f20a4ed","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:06.895195Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b7254dcee032ea85ff488c0d6e1b34e0a5d3213aadebd2971cfc0cf518015732","observation_id":"c68d5b98-d0ea-47dd-b79a-9a441f6a0837","resolution":{"observed_at":"2026-08-05T21:55:16.682909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.397273Z","title":"Alternating Updates for Efficient Transformers","venue":null,"work_id":"93f19d5c-ab8a-4d9b-9811-021adf8184a0","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.011725Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:6d19ae1a7ad74c9d5c7109f10bc1ea7eb836585c4efecf51cae17c4b4650ab0d","observation_id":"d02bad1b-39c1-4d8e-ad3b-78ac8b9c324e","resolution":{"observed_at":"2026-08-05T21:55:16.503512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.215253Z","title":"MultiPL-E: A Scalable and Polyglot Approach to Benchmarking Neural Code Generation","venue":null,"work_id":"0c2bdb0f-fe90-4f6b-8451-2485e8e41fed","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.127254Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:68fd0033e65074582b64cbff249e62938ec08a625c52b187e5ce4b38dbbe7b19","observation_id":"fefeb148-5bf1-4bc4-a7eb-c97d06c60276","resolution":{"observed_at":"2026-08-05T21:55:16.306383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10475","last_updated":"2025-05-15T16:24:45Z","snapshot_observed_at":"2026-08-07T15:45:00.286151Z","submitted_at":"2025-05-15T16:24:45Z","title":"Parallel Scaling Law for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10475","snapshot_observed_at":"2026-08-05T21:55:07.259301Z","title":"Parallel Scaling Law for Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.259301Z"},"links":{"cited_paper":"/paper/2505.10475","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:68ee7d7502342bf61790771250030cba1d550e13edc1d194434fb9baa2a092c4","observation_id":"86c53e88-b9b7-4736-9498-c8f3ad700b54","resolution":{"observed_at":"2026-08-05T21:55:07.259301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T21:55:07.431498Z","title":"Training Verifiers to Solve Math Word Problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.431498Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b009d02a48964a2f08c7456f62882e761e4ad80b800b67fca435280c6a5ce975","observation_id":"d95b45b3-cd18-4a39-8896-f107b38db248","resolution":{"observed_at":"2026-08-05T21:55:07.431498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-05T21:55:07.597205Z","title":"SuperGPQA: Scaling llm evaluation across 285 graduate disciplines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.597205Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:66bad0737bb629c0db582cb7ae0347e89b8cb0a164f5ffed053dcd972a464700","observation_id":"fd6e4cf4-29f3-4ed7-ae53-ba6c37202771","resolution":{"observed_at":"2026-08-05T21:55:07.597205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00161","last_updated":"2019-04-16T21:22:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-03-01T05:32:01Z","title":"DROP: A Reading Comprehension Benchmark Requiring Discrete Reasoning Over Paragraphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00161","snapshot_observed_at":"2026-08-05T21:55:07.713368Z","title":"DROP: A Reading Comprehension Benchmark Requiring Discrete Reasoning over Paragraphs","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.713368Z"},"links":{"cited_paper":"/paper/1903.00161","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:c00d4202c7e66d5879ec8acefa023812cdc99ad8d97b4ffc899b843f6e5d9376","observation_id":"4140f997-a7a4-40f2-aab9-82356fc314af","resolution":{"observed_at":"2026-08-05T21:55:07.713368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-05T09:35:42.754650Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-05T21:55:07.854608Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.854608Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:26514c4df81db4be3785a1856532c5e60930fcd1f8c92a4c4d15e60dddbd8e36","observation_id":"46efc729-4bcc-469c-9444-c125fa14dbf2","resolution":{"observed_at":"2026-08-05T21:55:07.854608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T21:55:07.978354Z","title":"Gemma 3 Technical Teport","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.978354Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:1305bec893d20b3fb430b588b43469458ab93d56dca28e5f943f45fcc88526b3","observation_id":"37ff43e3-a5ab-4578-99be-a70024fff0e8","resolution":{"observed_at":"2026-08-05T21:55:07.978354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.044331Z","title":"Gemini2.5 Pro","venue":null,"work_id":"377fad1e-ecbd-4f2a-b8d6-baf6829eae30","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.124675Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:5413c35dc5abf34fa03df55ab694635814ccccaaa4ab22ddcc28761cd588a5c9","observation_id":"78042d42-7a17-4dbe-a7d3-5e12b995001c","resolution":{"observed_at":"2026-08-05T21:55:16.098969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T21:55:08.272501Z","title":"The Llama 3 Herd of Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.272501Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:c452acc667fc5506e343cae1341381d77e4aeda431be61b844bf9b524b6f0c78","observation_id":"4bf8e837-e990-457e-be4f-de4e7b9b50d1","resolution":{"observed_at":"2026-08-05T21:55:08.272501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.847069Z","title":"big.LITTLE Processing with ARL Cortex-A15 & Cortex-A7","venue":null,"work_id":"f2bd09b9-ab3f-4a93-a4ff-9d64107ed10a","year":2011},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.447459Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:9ad112d408c4d80fe8868ac56e41462411497e1a7c79d265cdd0f2f2897ea7b6","observation_id":"6cb2f381-324d-4b12-b91f-3c0b76008cf6","resolution":{"observed_at":"2026-08-05T21:55:15.902931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03065","last_updated":"2024-01-05T20:53:51Z","snapshot_observed_at":"2026-07-06T17:12:10.787061Z","submitted_at":"2024-01-05T20:53:51Z","title":"CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03065","snapshot_observed_at":"2026-08-05T21:55:08.615607Z","title":"CruxEval: A Benchmark for Code Reasoning, Understanding and Execution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.615607Z"},"links":{"cited_paper":"/paper/2401.03065","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:c10ce56a48d4ced586950ea176152b294c56ddfb83f78059e37592bfdd3f55b0","observation_id":"b13f4784-d55b-4f6d-a596-d08a170f6b85","resolution":{"observed_at":"2026-08-05T21:55:08.615607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-07-06T18:18:25.746022Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-08-05T21:55:08.825228Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.825228Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:8d14f7629e670f20d539903266c46eedcae50731c92f715356ffa6f6eccc17a8","observation_id":"9c45b934-2f91-40d8-bfcb-6552f3c52bc9","resolution":{"observed_at":"2026-08-05T21:55:08.825228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-05T21:55:08.994598Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.994598Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:f300a5acd354568a49ad303c0d159fcb8f1bbb710dbe75343ca7c4bf4ef1b512","observation_id":"6dcf1869-0e67-41e1-ad5c-e49f477b41ca","resolution":{"observed_at":"2026-08-05T21:55:08.994598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T21:55:09.138629Z","title":"Measuring Massive Multitask Language Understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.138629Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:588764ce425df29ce990822bc4d11e19e3e3fa2fd84918acb438740c29342a23","observation_id":"763b8b34-4a12-49be-b432-b80d84a108db","resolution":{"observed_at":"2026-08-05T21:55:09.138629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T21:55:09.306553Z","title":"Measuring Mathematical Problem Solving with the Math Dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.306553Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:2bf5ad28099498febb96995a7e953b2354c185f32c270f8dc76e2e72606940ce","observation_id":"adead57f-9f1d-4a51-8870-45e2ff57f614","resolution":{"observed_at":"2026-08-05T21:55:09.306553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:09.449759Z","title":"Harder Tasks Need More Experts: Dynamic Routing in MoE Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.449759Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:e5d7e2b8a32ea8f1b866a3d5f5c8a4911eb0593396dcbce62f89a1062b2f21d0","observation_id":"01b10de9-14d1-4812-9f22-cce7dfc0fc34","resolution":{"observed_at":"2026-08-05T21:55:09.449759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.673204Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","venue":null,"work_id":"0a916ee1-e695-4077-bba3-8a1c4b3739a6","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.592352Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:fcb99a8a11acc1b4f53fe77f0b4cc04631d9f19c933c3abb5aad8d6877f2b56a","observation_id":"6d2cc0f5-0bb2-4567-8714-ac502c1b5e85","resolution":{"observed_at":"2026-08-05T21:55:15.766528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05767","last_updated":"2025-06-06T05:51:29Z","snapshot_observed_at":"2026-08-07T10:11:06.565253Z","submitted_at":"2025-06-06T05:51:29Z","title":"dots.llm1 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05767","snapshot_observed_at":"2026-08-05T21:55:09.763377Z","title":"dots.llm1 Technical Report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.763377Z"},"links":{"cited_paper":"/paper/2506.05767","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:6224be6e7138d53b1c487e9d643ed9398777c0c2223dbe12eb3762adb8e6c38d","observation_id":"7a2fae88-c8b7-441e-a300-6c77883d71e3","resolution":{"observed_at":"2026-08-05T21:55:09.763377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T21:55:09.900691Z","title":"GPT-4o System Card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.900691Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:f1ee7d11773e2d88c47545bff326f87d9f1861f7a3211c1da7bcd0794d96fa1a","observation_id":"f51f57a4-f0db-4722-a417-97110b83b206","resolution":{"observed_at":"2026-08-05T21:55:09.900691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T21:55:10.077000Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.077000Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:0b3bd6523715a435de8d80f6d2f469f7773c25a6493396e252e3cc987f8e45bd","observation_id":"87d074a1-00cd-4702-aa34-5b9acf2439d7","resolution":{"observed_at":"2026-08-05T21:55:10.077000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T21:55:10.279732Z","title":"Mixtral of Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.279732Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b547fdf394744b50d983192f31d450e7c3550be6ac6596b143c44b7d7977a187","observation_id":"fe5eb39e-ed16-42fa-b6bb-5cf5b6bb1b45","resolution":{"observed_at":"2026-08-05T21:55:10.279732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-05T21:55:10.476732Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.476732Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:18ef4462a6f47d254633d738d87077661be08afad908bef3cffdea55fe54283a","observation_id":"60b066d4-cd5a-4f24-bb97-1ac7c5b0d370","resolution":{"observed_at":"2026-08-05T21:55:10.476732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.512828Z","title":"Sparse Upcycling: Training mixture-of-experts from dense checkpoints","venue":null,"work_id":"498c8d1f-8589-4af2-a59d-e102420a0e10","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.662607Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:59bb49105ee0bc5964f9b336551795f79796f9bcbd528b8d071a558a4e50d613","observation_id":"84a7267f-9501-4e0a-acf0-b17ec6c8a55e","resolution":{"observed_at":"2026-08-05T21:55:15.591887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-05T21:55:10.829310Z","title":"CMMLU: Measuring Massive Multitask Language Understanding in Chinese","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.829310Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:ffe6ff6e1c6bf1ff275daa1405325ec9352d7be7143ec91b90119de50b2eac26","observation_id":"1f2df3e9-76d1-4a86-8b11-bbd865b874f8","resolution":{"observed_at":"2026-08-05T21:55:10.829310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-05T21:55:10.966584Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and Benchbuilder Pipeline","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.966584Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:f15db8ca0bbcb4073910085cf88c92c2527c9cd82834c8bdfe8dc5592b308210","observation_id":"3fb31cec-1f4f-4329-9cfb-9c0669e38bb7","resolution":{"observed_at":"2026-08-05T21:55:10.966584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.349047Z","title":"Let's Verify Step by Step","venue":null,"work_id":"b910b623-3d21-425b-a339-a6072d541249","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.049363Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:70fbdd3efceaf327a772977ee3dfe6aa3bc0b3515cff79145a8aa6a323e3069e","observation_id":"1ad87fe3-b066-46b6-8953-1a9cb4981def","resolution":{"observed_at":"2026-08-05T21:55:15.410461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T21:55:11.110692Z","title":"DeepSeek-V3 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.110692Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:340e4476bbacb122ff2a6f1b7708ecc03800c1e414096c9513cb210d3b892ab8","observation_id":"2d888468-3aab-40a5-985e-f451e40346d6","resolution":{"observed_at":"2026-08-05T21:55:11.110692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.198060Z","title":"Is Your Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation","venue":null,"work_id":"31c32341-1f65-47e1-99e2-d6c0fe2dda10","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.192787Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:51d24312e2c3e6746b8c5ebd48a2676b431f86365361fd66c0d0acafad327308","observation_id":"54ae30d0-78ff-41ea-b565-f86c823771c8","resolution":{"observed_at":"2026-08-05T21:55:15.253228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T21:55:11.279905Z","title":"Decoupled Weight Decay Regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.279905Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:4d44c9b876dcb1a0ed2f3247f9cbed7c2df9c23dfe5ec00c62f213379ee23c1f","observation_id":"b96b046b-199a-494b-b1ca-ca55d87d36e4","resolution":{"observed_at":"2026-08-05T21:55:11.279905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.030623Z","title":"The Llama 4 herd: The beginning of a new era of natively multimodal AI innovation , 2025","venue":null,"work_id":"375b8418-a70f-40bc-9496-b7bd25a6cfb9","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.389659Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:ccd48e67542286cb6b5199db7c63ab6665b40ec9b4a5408da8f8f651de3479a7","observation_id":"3e22ebaa-1bc4-486b-8595-765cab14ceec","resolution":{"observed_at":"2026-08-05T21:55:15.136131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.858135Z","title":"Mistral-Small-3.1","venue":null,"work_id":"beeb52c8-900a-48ae-9565-a30476fa8119","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.463331Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:306b0849b78ffef1784b95f9feab3d372950a25c4320c36cf04f53f9c0429090","observation_id":"c41a22d5-685c-4201-8fd1-d5395c8cf01e","resolution":{"observed_at":"2026-08-05T21:55:14.940663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19261","last_updated":"2025-03-15T14:50:33Z","snapshot_observed_at":"2026-08-08T22:53:37.996823Z","submitted_at":"2025-02-26T16:06:36Z","title":"Drop-Upcycling: Training Sparse Mixture of Experts with Partial Re-initialization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19261","snapshot_observed_at":"2026-08-05T21:55:11.541674Z","title":"Drop-Upcycling: Training Sparse Mixture of Experts with Partial Re-Initialization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.541674Z"},"links":{"cited_paper":"/paper/2502.19261","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:7bf861fc0c64fd4271092cf8b2850cf15caa021dee611f58d7cd7e1e5865f195","observation_id":"c7dd9abf-8bae-4531-9603-310de87de6fc","resolution":{"observed_at":"2026-08-05T21:55:11.541674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.723278Z","title":"GPQA: A Graduate-Level Google-Proof Q&Q Benchmark","venue":null,"work_id":"a16a2933-6bc8-42fb-92aa-7e993d65d0db","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.633823Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:ca89e90b56fe1592eb5ab717188749147097befe6d8d621d8482fb457f127f09","observation_id":"2a6ac5a3-c867-4bab-8509-570232ed60ab","resolution":{"observed_at":"2026-08-05T21:55:14.776307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.455628Z","title":null,"venue":null,"work_id":"8e96b465-0914-4c80-84aa-6a3fb29f35b2","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.768530Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:7bf75984bced111b80c78df0e5ee792be2851e0feae5b88d53d65efa8166a3b3","observation_id":"44db8fda-58fc-4b25-9cae-de6a99f4b59c","resolution":{"observed_at":"2026-08-05T21:55:14.608392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.251489Z","title":"MoE Travels 3 , 2025","venue":null,"work_id":"7321cd1b-571a-418c-b365-9a8a1ff0cac0","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.859201Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:5651d54baee1f97140b35294f64b4f6e663250b6c392e96c66efb03519267e4c","observation_id":"88a5e5cc-9338-4a73-bf29-022355545a49","resolution":{"observed_at":"2026-08-05T21:55:14.354341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02265","last_updated":"2024-11-06T09:15:27Z","snapshot_observed_at":"2026-08-04T12:39:25.666793Z","submitted_at":"2024-11-04T16:56:26Z","title":"Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02265","snapshot_observed_at":"2026-08-05T21:55:11.905074Z","title":"Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.905074Z"},"links":{"cited_paper":"/paper/2411.02265","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:09ba329ce99e0fb12cf20bcfa3264daafb051822e94291e100471e17c805a752","observation_id":"1ba115c0-06c2-41ad-b018-3de5f41d8e2c","resolution":{"observed_at":"2026-08-05T21:55:11.905074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-05T21:55:11.985304Z","title":"Challenging Big-Bench Tasks and Whether Chain-of-Thought Can Solve Them","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.985304Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:00dfbd180c3eacd88417048cee4688373b82a26845a7407a48b2357f8148436c","observation_id":"d881d742-b658-4c7b-9103-eb7fd2a6fc44","resolution":{"observed_at":"2026-08-05T21:55:11.985304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.061059Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","venue":null,"work_id":"55d90a9d-c518-4669-8ece-cc8d934db63b","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.071642Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:4d705fe26633c19bc94441c0604b9cc1678eb3619b98625d514276fe5771c4b6","observation_id":"cda85eb4-3161-48d4-9fb6-15107936552e","resolution":{"observed_at":"2026-08-05T21:55:14.166527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14711","last_updated":"2025-02-27T16:33:09Z","snapshot_observed_at":"2026-08-09T03:21:13.453412Z","submitted_at":"2024-12-19T10:21:20Z","title":"ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14711","snapshot_observed_at":"2026-08-05T21:55:12.177334Z","title":"ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.177334Z"},"links":{"cited_paper":"/paper/2412.14711","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:a856bb2804331027ce17223d8fb422bd6326751296d0b804bd14085555704c6d","observation_id":"878d5138-3799-4e4c-8c82-ff0eabd13369","resolution":{"observed_at":"2026-08-05T21:55:12.177334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-05T21:55:12.283379Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.283379Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:761e0363b3679c567e7226785771da31d1d767d1116d19e38bc383db16ce1f38","observation_id":"1b363cbf-77cf-4047-985d-32cec6091d2d","resolution":{"observed_at":"2026-08-05T21:55:12.283379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:13.823849Z","title":"Parameter-Efficient Sparsity Crafting from Dense to Mixture-of-Experts for Instruction Tuning on General Tasks","venue":null,"work_id":"2c7aada5-16b9-4296-9c7f-02b537747065","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.380426Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:e649dc9f4ac8b6fe55537dc85c63ec93268779c58b3e6543bae8cbb60a57c5fd","observation_id":"9bebb342-0395-4d26-9fe9-46fa482775ec","resolution":{"observed_at":"2026-08-05T21:55:13.927086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-05T21:55:12.444636Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.444636Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:448f9f008f87a653472bd17a4f5a459f64ab2eb100120f370dd04f93307071d6","observation_id":"d74ccebb-3105-4eed-a728-3562a9e3ddaf","resolution":{"observed_at":"2026-08-05T21:55:12.444636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:13.667496Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":"eb1dedc9-5a96-49a8-8ec2-948b8186eae5","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.543077Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b9706b8b7d6fe51ad49815ff36a29c06c0cc3c3dbbe67ddfdffc6f171a2d6379","observation_id":"554358da-f55a-4dfe-b8c3-e29382ae0344","resolution":{"observed_at":"2026-08-05T21:55:13.743015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T21:55:12.617089Z","title":"Qwen2.5 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.617089Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:1f1182c1845465d0b660905a1fb20d8e951149b2f29944d301bd52b3f77150d6","observation_id":"a8e25cb4-66e2-4655-9723-5cda2318714c","resolution":{"observed_at":"2026-08-05T21:55:12.617089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T21:55:12.751578Z","title":"Qwen3 Technical Report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.751578Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:00c4ed0eb464f5d1a98a351cc29bead5bbd00c5a794c75d87b1828226066c055","observation_id":"28a74e1a-399e-4588-b7bd-c20d935ce484","resolution":{"observed_at":"2026-08-05T21:55:12.751578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13233","last_updated":"2024-10-14T03:20:02Z","snapshot_observed_at":"2026-08-03T20:17:40.392222Z","submitted_at":"2024-06-19T05:47:10Z","title":"AdaMoE: Token-Adaptive Routing with Null Experts for Mixture-of-Experts Language Models","version":2},"cited_work":{"arxiv_id":"2406.13233","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13233","snapshot_observed_at":"2026-08-05T21:55:13.242980Z","title":"AdaMoE: Token-Adaptive Routing with Null Experts for Mixture-of-Experts Language Models","venue":"cs.AI","work_id":"b3d4c87c-9c42-4820-a8c5-57aa3f7008de","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.848542Z"},"links":{"cited_paper":"/paper/2406.13233","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:ad17628998c66e6a7c28b7633f7c2c2b16f05f97f359bac9035dc88fcf8d6c24","observation_id":"20139d0c-fe49-4c00-873a-d7cd5f43f916","resolution":{"observed_at":"2026-08-05T21:55:13.290078Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-05T21:55:12.954012Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.954012Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:d755ee3c29eca44aa171149aa2f66f0a34f9d250849814e0cf3662793ca2dfe7","observation_id":"ec54b7b3-8a57-4a66-9565-59282b8f0699","resolution":{"observed_at":"2026-08-05T21:55:12.954012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-05T21:55:13.064504Z","title":"Instruction-Following Evaluation for Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:13.064504Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:f3d952aa1221cad3661b6251a9b0ea348475fb8d6aa2724cbf2159bb258b880a","observation_id":"83a73289-26f4-4bc6-8d53-1478e10102a8","resolution":{"observed_at":"2026-08-05T21:55:13.064504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T03:22:47.270683Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 7 inbound Pith citation observations for arXiv:2508.07785."}