{"as_of":"2026-08-13T15:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:658f36af589dfbfede2b45176b1355e9300a18e73936fa61be7646b8051ee4a2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:49:01.961675Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":184,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:00303b00390583f4bf9f38d9976bf79e4054304762f1b3cd533de5cc5281122b","observation_id":"e513c6f3-da10-40da-bc09-08cf589196e2","resolution":{"observed_at":"2026-05-15T02:39:33.172544Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2411.08982","last_updated":"2026-05-18T20:44:06Z","snapshot_observed_at":"2026-07-06T19:50:01.724540Z","submitted_at":"2024-11-13T19:18:08Z","title":"Lynx: Enabling Efficient MoE Inference through Dynamic Batch-Aware Expert Selection","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T17:04:13.905401Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2411.08982"},"observation_digest":"sha256:a7a62f23602f5a848a01d902b6591ee4ffee3a16df4956d2cf7744eaa95dbf80","observation_id":"c5939d3e-644c-4877-997a-02adddc7084c","resolution":{"observed_at":"2026-05-23T17:05:42.974851Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2412.00069","last_updated":"2026-04-18T21:44:35Z","snapshot_observed_at":"2026-07-06T19:59:06.645605Z","submitted_at":"2024-11-26T00:56:18Z","title":"Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-23T17:10:06.053994Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2412.00069"},"observation_digest":"sha256:6c495befe6ce67bc0ef33d6e66bf876beb2d2703537ad4e042eb9341888767c9","observation_id":"a89d51e7-941f-408c-b4ca-ff6c2c19a190","resolution":{"observed_at":"2026-05-23T17:13:14.044860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-11T12:44:35.812514Z","title":"Seer-moe: Sparse expert efficiency through regularization for mixture-of-experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14219","last_updated":"2025-01-22T03:33:25Z","snapshot_observed_at":"2026-08-13T15:20:13.684577Z","submitted_at":"2024-12-18T14:11:15Z","title":"A Survey on Inference Optimization Techniques for Mixture of Experts Models","version":2},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-08-11T12:44:35.812514Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2412.14219"},"observation_digest":"sha256:b8f94b6f2a117d836aa6490a843719d96ba9873d2477da94a23b496fd92b620f","observation_id":"5dba707c-f1aa-43c6-84da-bdc42cd319a5","resolution":{"observed_at":"2026-08-11T12:44:35.812514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:ef5b628a916cfc3e819ce3a378b91792a059a0b68c867770d2d1a32c0fc3c8ce","observation_id":"861bc117-a4c7-4512-aa1c-5b7327645a46","resolution":{"observed_at":"2026-05-15T14:35:55.630815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.02715","last_updated":"2026-04-30T13:29:54Z","snapshot_observed_at":"2026-08-11T06:59:20.722637Z","submitted_at":"2026-04-03T04:16:01Z","title":"FluxMoE: Decoupling Expert Residency for High-Performance MoE Serving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:16.466375Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.02715"},"observation_digest":"sha256:7da75045bed8b9350488ed0403f16c30483dc9bcf2b171a79506407eb3c74198","observation_id":"b4805d89-44b9-4685-b984-4574c6d1a333","resolution":{"observed_at":"2026-05-13T20:18:13.315696Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.04356","last_updated":"2026-04-06T02:08:09Z","snapshot_observed_at":"2026-08-11T06:34:19.697476Z","submitted_at":"2026-04-06T02:08:09Z","title":"REAM: Merging Improves Pruning of Experts in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:55:16.464030Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.04356"},"observation_digest":"sha256:85bb7fa231c7f0751e88d632c3435ae4014898be9894e69e44e4e99d767439ab","observation_id":"07acc7fa-6274-4c40-bc75-77f735f304a0","resolution":{"observed_at":"2026-05-10T22:20:49.455786Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.08133","last_updated":"2026-04-09T11:50:21Z","snapshot_observed_at":"2026-08-11T09:04:26.293657Z","submitted_at":"2026-04-09T11:50:21Z","title":"Alloc-MoE: Budget-Aware Expert Activation Allocation for Efficient Mixture-of-Experts Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T17:10:08.195849Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.08133"},"observation_digest":"sha256:3ab217fd93e015ceeb096a8ba3941443af257b6a8cc506375cb44d96a3a01ac0","observation_id":"7ff85418-8b1f-4104-88f9-143722c4ce51","resolution":{"observed_at":"2026-05-11T07:30:57.607074Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2604.20156","last_updated":"2026-04-22T03:50:52Z","snapshot_observed_at":"2026-08-12T12:25:05.090002Z","submitted_at":"2026-04-22T03:50:52Z","title":"Temporally Extended Mixture-of-Experts Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T00:39:39.492135Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2604.20156"},"observation_digest":"sha256:25cedfdfbb9ce51ba5662fcf4e2a45db7eb12d9fe27a57eba29cc6305789225f","observation_id":"ee8514e3-f1c6-4114-8b8e-1febbacf5516","resolution":{"observed_at":"2026-05-10T00:39:48.308169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2605.11537","last_updated":"2026-05-12T05:03:53Z","snapshot_observed_at":"2026-08-12T19:05:56.915551Z","submitted_at":"2026-05-12T05:03:53Z","title":"Fast MoE Inference via Predictive Prefetching and Expert Replication","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T02:25:59.268868Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2605.11537"},"observation_digest":"sha256:d194b5ba8a672095786b088f7d2822f6b4dad1c7819bec0cb847fdb98a0789e8","observation_id":"d5b70125-52c6-4d55-91b9-e24d818b4205","resolution":{"observed_at":"2026-05-13T02:27:06.980895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2606.05538","last_updated":"2026-06-04T00:43:20Z","snapshot_observed_at":"2026-08-12T18:39:40.723016Z","submitted_at":"2026-06-04T00:43:20Z","title":"Less is MoE: Trimming Experts in Domain-Specialist Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-28T03:11:23.755739Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2606.05538"},"observation_digest":"sha256:a5ea9df055fd51f19a120a5e131f1caf65725f0fd5d7488791717b3432dc2e4a","observation_id":"83f9de9c-db81-4a2b-b19c-ddcb39e44b50","resolution":{"observed_at":"2026-07-02T11:36:55.521337Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2606.18304","last_updated":"2026-06-16T06:53:27Z","snapshot_observed_at":"2026-08-09T12:16:25.770840Z","submitted_at":"2026-06-16T06:53:27Z","title":"Attribution-Guided and Coverage-Maximized Pruning for Structural MoE Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T02:07:44.237002Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2606.18304"},"observation_digest":"sha256:c21fac85a318c334d036432b2c0692941d88d2c211d60d1941d348e244b121f5","observation_id":"62e25931-7f66-40cc-836d-4c62876699a3","resolution":{"observed_at":"2026-06-27T02:10:21.740597Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2404.05089","doi":"10.48550/arxiv.2404.05089","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"org/CorpusID:268253470","venue":"arXiv (Cornell University)","work_id":"99e526d7-ce14-4c4c-96a1-6942f7908390","year":2024},"citing_paper":{"arxiv_id":"2607.01444","last_updated":"2026-07-01T20:08:19Z","snapshot_observed_at":"2026-08-02T15:11:59.689585Z","submitted_at":"2026-07-01T20:08:19Z","title":"On the Utility and Factual Reliability of Pruned Mixture-of-Experts Models in the Biomedical Domain","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T21:13:47.973507Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2607.01444"},"observation_digest":"sha256:ad31a44e52d8849c5f2b3904def7e1f00716fe0fdb94740d726f181d80773309","observation_id":"37c26ce4-16ee-4383-8fe3-93f9bc83f13f","resolution":{"observed_at":"2026-07-03T21:18:58.240923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05089","snapshot_observed_at":"2026-08-12T00:49:01.961675Z","title":"SEER-MoE:Sparseexpertefficiencythroughregularization for mixture-of-experts.arXiv preprint arXiv:2404.05089, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07890","last_updated":"2026-08-08T03:36:41Z","snapshot_observed_at":"2026-08-13T15:13:38.489268Z","submitted_at":"2026-08-08T03:36:41Z","title":"Router Sensitivity Under Lightweight Fine-Tuning Identifies Prunable Experts in Mixture-of-Experts Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:49:01.961675Z"},"links":{"cited_paper":"/paper/2404.05089","citing_paper":"/paper/2608.07890"},"observation_digest":"sha256:e227b9424464370a7ec7a6c2685c99a1b24c6bee43be9a66ff307803d53a4a33","observation_id":"9e90403c-22a1-48db-9172-f5027fa6feb6","resolution":{"observed_at":"2026-08-12T00:49:01.961675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.05089/citation-record","integrity":"/paper/2404.05089/integrity","json":"/paper/2404.05089/citation-record.json","paper":"/paper/2404.05089"},"outbound":[],"paper":{"arxiv_id":"2404.05089","last_updated":"2024-04-07T22:13:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T00:35:26.554539Z","submitted_at":"2024-04-07T22:13:43Z","title":"SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2404.05089."}