{"as_of":"2026-08-13T20:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35546883c4e722aa8bb5aca73607c8e047812b7f64f84c7291338c9a4e4cb3ff","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:49:01.961675Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":184,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:d06d0c9bcdf9fda770525cd74842705cc59061045e363b2ce3c94d4bbeef45be","observation_id":"e513c6f3-da10-40da-bc09-08cf589196e2","resolution":{"observed_at":"2026-05-15T02:39:33.172544Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2411.08982","last_updated":"2026-05-18T20:44:06Z","snapshot_observed_at":"2026-07-06T19:50:01.724540Z","submitted_at":"2024-11-13T19:18:08Z","title":"Lynx: Enabling Efficient MoE Inference through Dynamic Batch-Aware Expert Selection","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T17:04:13.905401Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2411.08982"},"observation_digest":"sha256:55ce892b0768e249e3d19c5ed0d3b24790fdc86ed585f615ed0ddf7733e28bae","observation_id":"c5939d3e-644c-4877-997a-02adddc7084c","resolution":{"observed_at":"2026-05-23T17:05:42.974851Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2412.00069","last_updated":"2026-04-18T21:44:35Z","snapshot_observed_at":"2026-07-06T19:59:06.645605Z","submitted_at":"2024-11-26T00:56:18Z","title":"Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-23T17:10:06.053994Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2412.00069"},"observation_digest":"sha256:7c8aed60275cece93c2854f54ce8267fd33f18c81ff0d2c20da68c041efeb48f","observation_id":"a89d51e7-941f-408c-b4ca-ff6c2c19a190","resolution":{"observed_at":"2026-05-23T17:13:14.044860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-11T12:44:35.812514Z","title":"Seer-moe: Sparse expert efficiency through regularization for mixture-of-experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14219","last_updated":"2025-01-22T03:33:25Z","snapshot_observed_at":"2026-08-13T20:22:39.395521Z","submitted_at":"2024-12-18T14:11:15Z","title":"A Survey on Inference Optimization Techniques for Mixture of Experts Models","version":2},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-08-11T12:44:35.812514Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2412.14219"},"observation_digest":"sha256:8e0ceb4e931654c775cebe250ad6cf0492ece3eed3c65672139394f6471bfa4e","observation_id":"5dba707c-f1aa-43c6-84da-bdc42cd319a5","resolution":{"observed_at":"2026-08-11T12:44:35.812514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:d2d740229100a5a483d9f1e8a04a06a6d3c5368a6d30d9f0e660f4395820a6d8","observation_id":"861bc117-a4c7-4512-aa1c-5b7327645a46","resolution":{"observed_at":"2026-05-15T14:35:55.630815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.02715","last_updated":"2026-04-30T13:29:54Z","snapshot_observed_at":"2026-08-11T06:59:20.722637Z","submitted_at":"2026-04-03T04:16:01Z","title":"FluxMoE: Decoupling Expert Residency for High-Performance MoE Serving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:16.466375Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.02715"},"observation_digest":"sha256:42701eab119b17591c3a34e363871befd01c3dac147fe21c34ee4f837dd269e0","observation_id":"b4805d89-44b9-4685-b984-4574c6d1a333","resolution":{"observed_at":"2026-05-13T20:18:13.315696Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.04356","last_updated":"2026-04-06T02:08:09Z","snapshot_observed_at":"2026-08-11T06:34:19.697476Z","submitted_at":"2026-04-06T02:08:09Z","title":"REAM: Merging Improves Pruning of Experts in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:55:16.464030Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.04356"},"observation_digest":"sha256:16e6c84c3bade171432f17ae730ed5de90ad98ca3863bb07c866320d1fdb8aa6","observation_id":"07acc7fa-6274-4c40-bc75-77f735f304a0","resolution":{"observed_at":"2026-05-10T22:20:49.455786Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.08133","last_updated":"2026-04-09T11:50:21Z","snapshot_observed_at":"2026-08-11T09:04:26.293657Z","submitted_at":"2026-04-09T11:50:21Z","title":"Alloc-MoE: Budget-Aware Expert Activation Allocation for Efficient Mixture-of-Experts Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T17:10:08.195849Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.08133"},"observation_digest":"sha256:ccee61ba1343160f70a148f11b144bd86e882357d24c5e6f9b1fddeffdb0bcd0","observation_id":"7ff85418-8b1f-4104-88f9-143722c4ce51","resolution":{"observed_at":"2026-05-11T07:30:57.607074Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.20156","last_updated":"2026-04-22T03:50:52Z","snapshot_observed_at":"2026-08-12T12:25:05.090002Z","submitted_at":"2026-04-22T03:50:52Z","title":"Temporally Extended Mixture-of-Experts Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T00:39:39.492135Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.20156"},"observation_digest":"sha256:2c857ad0599a4cffae5a52fc9c69e4cf0bb375e7addb65e0932043f46861bfe7","observation_id":"ee8514e3-f1c6-4114-8b8e-1febbacf5516","resolution":{"observed_at":"2026-05-10T00:39:48.308169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2605.11537","last_updated":"2026-05-12T05:03:53Z","snapshot_observed_at":"2026-08-12T19:05:56.915551Z","submitted_at":"2026-05-12T05:03:53Z","title":"Fast MoE Inference via Predictive Prefetching and Expert Replication","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T02:25:59.268868Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2605.11537"},"observation_digest":"sha256:fe6bfb4f50ee1984608fe7fd31572ae28d518eee9c03de97fd8a834f9a7ae44f","observation_id":"d5b70125-52c6-4d55-91b9-e24d818b4205","resolution":{"observed_at":"2026-05-13T02:27:06.980895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2606.05538","last_updated":"2026-06-04T00:43:20Z","snapshot_observed_at":"2026-08-12T18:39:40.723016Z","submitted_at":"2026-06-04T00:43:20Z","title":"Less is MoE: Trimming Experts in Domain-Specialist Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-28T03:11:23.755739Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2606.05538"},"observation_digest":"sha256:e2a334fb6996c71990154fe163ce7e28d5d37051e79c93c06535550abbb0fa1e","observation_id":"83f9de9c-db81-4a2b-b19c-ddcb39e44b50","resolution":{"observed_at":"2026-07-02T11:36:55.521337Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2606.18304","last_updated":"2026-06-16T06:53:27Z","snapshot_observed_at":"2026-08-09T12:16:25.770840Z","submitted_at":"2026-06-16T06:53:27Z","title":"Attribution-Guided and Coverage-Maximized Pruning for Structural MoE Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T02:07:44.237002Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2606.18304"},"observation_digest":"sha256:6b71d6012b37731fc0fd26e7bcfa3d523a2133b22550253c65be6267a261a17c","observation_id":"62e25931-7f66-40cc-836d-4c62876699a3","resolution":{"observed_at":"2026-06-27T02:10:21.740597Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2607.01444","last_updated":"2026-07-01T20:08:19Z","snapshot_observed_at":"2026-08-02T15:11:59.689585Z","submitted_at":"2026-07-01T20:08:19Z","title":"On the Utility and Factual Reliability of Pruned Mixture-of-Experts Models in the Biomedical Domain","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T21:13:47.973507Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2607.01444"},"observation_digest":"sha256:6ab80d383bd3e2cbc57e2303edce5faaa9738fa038ab50263c1a8674461d8409","observation_id":"37c26ce4-16ee-4383-8fe3-93f9bc83f13f","resolution":{"observed_at":"2026-07-03T21:18:58.240923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-12T00:49:01.961675Z","title":"SEER-MoE:Sparseexpertefficiencythroughregularization for mixture-of-experts.arXiv preprint arXiv:2404.05089, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07890","last_updated":"2026-08-08T03:36:41Z","snapshot_observed_at":"2026-08-13T20:14:28.264315Z","submitted_at":"2026-08-08T03:36:41Z","title":"Router Sensitivity Under Lightweight Fine-Tuning Identifies Prunable Experts in Mixture-of-Experts Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:49:01.961675Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2608.07890"},"observation_digest":"sha256:ff71042fd6c71394bb6fad5bc8552c42ba951101673db13c640317a6e9599c57","observation_id":"9e90403c-22a1-48db-9172-f5027fa6feb6","resolution":{"observed_at":"2026-08-12T00:49:01.961675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.05089/citation-record","integrity":"/paper/2404.05089/integrity","json":"/paper/2404.05089/citation-record.json","paper":"/paper/2404.05089"},"outbound":[],"paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T19:20:08.451485Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2404.05089."}