{"as_of":"2026-08-07T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1df92445ea98ed752c949271e504be22331eef7b1e51c6bd8561a17708d8bf13","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:58:49.567474Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:39:56.479057Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-07T13:04:50.040909Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T04:09:15.921778Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2401.04088"},"observation_digest":"sha256:3713cb17c11a718d837853856761347334e58fdea0d14f1e8ae15216bf8690b3","observation_id":"b7b9dc76-8433-4408-b2b3-edbc5d6a2998","resolution":{"observed_at":"2026-05-24T04:13:53.768565Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2411.08982","last_updated":"2026-05-18T20:44:06Z","snapshot_observed_at":"2026-07-06T19:50:01.724540Z","submitted_at":"2024-11-13T19:18:08Z","title":"Lynx: Enabling Efficient MoE Inference through Dynamic Batch-Aware Expert Selection","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T17:04:13.905401Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2411.08982"},"observation_digest":"sha256:396220c9332d690d91b88095ca9ebc3be91830f68ae800535c89ce92f047249c","observation_id":"57cbe660-d453-4c4b-b85b-fd89038d3988","resolution":{"observed_at":"2026-05-23T17:05:42.962447Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-07T04:58:49.567474Z","title":"and Mazur, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09316","last_updated":"2025-06-17T04:56:46Z","snapshot_observed_at":"2026-08-07T11:02:36.129585Z","submitted_at":"2025-06-11T01:25:06Z","title":"On-the-Fly Adaptive Distillation of Transformer to Dual-State Linear Attention","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:58:49.567474Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2506.09316"},"observation_digest":"sha256:9ce1b9a448d059742a5c4f02cde53cf729c0bf8ac41c665d3d6967efb92ccc2b","observation_id":"55ab2dfb-5b33-4648-897b-1a4f4fa7ad5f","resolution":{"observed_at":"2026-08-07T04:58:49.567474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-05T11:48:30.265238Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02408","last_updated":"2025-09-02T15:19:06Z","snapshot_observed_at":"2026-08-07T01:26:56.395193Z","submitted_at":"2025-09-02T15:19:06Z","title":"Cache Management for Mixture-of-Experts LLMs -- extended version","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:48:30.265238Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2509.02408"},"observation_digest":"sha256:8253553a965e70f9dcd0cefe326c781bebb3a1732fdfe4eab9b2e83ed41ab558","observation_id":"6a3c1a15-ecce-4ede-abb9-dc516e42cffe","resolution":{"observed_at":"2026-08-05T11:48:30.265238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-04T21:51:04.085632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07727","last_updated":"2025-09-09T13:28:41Z","snapshot_observed_at":"2026-08-04T21:51:02.865764Z","submitted_at":"2025-09-09T13:28:41Z","title":"MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T21:51:04.085632Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2509.07727"},"observation_digest":"sha256:2042352bd7b6846a7c3331dc4aa0787c042bade9879964da266176ee17933991","observation_id":"50f6c9cc-1a75-4bd0-85ca-829cd62620d5","resolution":{"observed_at":"2026-08-04T21:51:04.085632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-04T20:55:18.824902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08342","last_updated":"2025-09-10T07:28:24Z","snapshot_observed_at":"2026-08-07T12:35:47.179422Z","submitted_at":"2025-09-10T07:28:24Z","title":"Accelerating Mixture-of-Expert Inference with Adaptive Expert Split Mechanism","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:55:18.824902Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2509.08342"},"observation_digest":"sha256:6a6e90f29a43e20ac606450bb1ad91b842bda27092ad77b1a11c5cc720ecee25","observation_id":"875b6dce-b865-416e-833d-d33894ade016","resolution":{"observed_at":"2026-08-04T20:55:18.824902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2510.05497","last_updated":"2026-05-12T10:04:18Z","snapshot_observed_at":"2026-07-06T22:31:53.944103Z","submitted_at":"2025-10-07T01:31:39Z","title":"Patterns behind Chaos: Forecasting Data Movement for Efficient Large-Scale MoE LLM Inference","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T09:52:48.027958Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2510.05497"},"observation_digest":"sha256:5a060f7896fd2869020eb414c80d73cf7da20fa89deb609889ded5ec84853fff","observation_id":"97cdaeee-e4d1-4928-81bc-99f65c599ee5","resolution":{"observed_at":"2026-05-18T09:56:13.364339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-03T12:12:46.908768Z","title":"Fast inference of mixture-of-experts language models with offloading,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03992","last_updated":"2026-01-07T15:02:57Z","snapshot_observed_at":"2026-08-05T20:26:32.251065Z","submitted_at":"2026-01-07T15:02:57Z","title":"A Scheduling Framework for Efficient MoE Inference on Edge GPU-NDP Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T12:12:46.908768Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2601.03992"},"observation_digest":"sha256:aa9f09eda55a19529418e1037e556d86a55ca3584bc860cae98c6885469bb0b2","observation_id":"55c79c1e-5af5-4994-ab70-2257e512a681","resolution":{"observed_at":"2026-08-03T12:12:46.908768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2601.21198","last_updated":"2026-05-22T06:53:25Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T02:51:59Z","title":"ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity Scheduling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T07:43:24.937953Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2601.21198"},"observation_digest":"sha256:88267eae177493fbc6f9b45b7a4bdee247d493b11bf29b21b042955d932e33da","observation_id":"f5ea1806-5533-4d32-b8f8-4fa5b08bc178","resolution":{"observed_at":"2026-05-25T07:45:29.258625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2604.20156","last_updated":"2026-04-22T03:50:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T03:50:52Z","title":"Temporally Extended Mixture-of-Experts Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T00:39:39.492135Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2604.20156"},"observation_digest":"sha256:f3aed25cf68408eaad88abb2946086b8b25825e502cf64d7c21c3750897f5374","observation_id":"279b913d-45ce-4afd-96e1-dee673e1c68f","resolution":{"observed_at":"2026-05-10T00:39:48.246838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2604.23150","last_updated":"2026-04-25T05:33:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-25T05:33:03Z","title":"Scaling Multi-Node Mixture-of-Experts Inference Using Expert Activation Patterns","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T08:29:17.149710Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2604.23150"},"observation_digest":"sha256:136341548110b2c89dc0644ccfed79a6754e9aa137ef234d9c09eb73f9ac4e78","observation_id":"f0d89220-01c7-4c6a-8d56-df888f7fefab","resolution":{"observed_at":"2026-05-11T20:36:10.827410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.05899","last_updated":"2026-05-07T09:11:41Z","snapshot_observed_at":"2026-08-05T02:12:24.336765Z","submitted_at":"2026-05-07T09:11:41Z","title":"VisMMOE: Exploiting Visual-Expert Affinity for Efficient Visual-Language MoE Offloading","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T16:10:22.588945Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.05899"},"observation_digest":"sha256:1fa6154e54a1385e5ee21f4c628b30e466a088b77d6099c912e2f484f6b82992","observation_id":"d8d31969-13bf-4095-be85-c883a2df96c4","resolution":{"observed_at":"2026-05-11T16:36:06.453365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:7c60d67b998fc23483ab158c4441facb7e2a3716f370215fde1d1c595715aede","observation_id":"27eaf72f-a32c-4b38-86b6-2340c878028f","resolution":{"observed_at":"2026-05-20T05:13:03.710574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.21427","last_updated":"2026-05-20T17:19:20Z","snapshot_observed_at":"2026-07-06T23:31:51.443407Z","submitted_at":"2026-05-20T17:19:20Z","title":"PALS: Power-Aware LLM Serving for Mixture-of-Experts Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T04:06:32.227076Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.21427"},"observation_digest":"sha256:c7060289fda07beb7b56fbb2b924a84914d893b6fb8e3090b07aef3f9b63e782","observation_id":"a20efcfd-4283-4bd5-b036-b37f7283b9fc","resolution":{"observed_at":"2026-05-21T04:09:33.685626Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-03T00:32:09.805300Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T12:30:55.628115Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:85cf5fd5e2fd26b79152847c4c0d3fc1abf7a07eed18e508917721ffb51e62b4","observation_id":"dd0db0fd-e662-4314-b0aa-de69969497cd","resolution":{"observed_at":"2026-07-04T07:59:39.570551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-12T13:05:17.273287Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-03T00:32:09.805300Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T13:05:17.273287Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:539196684a1be923cfd7b25727217289d7a84e04e014984ee9fdacfaed69a348","observation_id":"77fe61f6-e4f1-485d-a0f7-e05a193591eb","resolution":{"observed_at":"2026-07-12T13:05:17.273287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.21868","last_updated":"2026-06-20T04:10:34Z","snapshot_observed_at":"2026-08-06T05:17:32.033245Z","submitted_at":"2026-06-20T04:10:34Z","title":"WiSP: A Working-Set View of Mixture-of-Experts Serving on Extremely Low-Resource Hardware","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T12:40:53.103233Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.21868"},"observation_digest":"sha256:f0666c014f053ee7734e834974c56c03be76f26ca701e667c8aadbd4d57894d5","observation_id":"0ad6a6fe-0125-4b4e-8410-e7ef99d3df00","resolution":{"observed_at":"2026-07-04T07:49:39.572738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.26287","last_updated":"2026-06-24T18:34:00Z","snapshot_observed_at":"2026-07-07T00:00:36.766142Z","submitted_at":"2026-06-24T18:34:00Z","title":"GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T01:32:40.435742Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.26287"},"observation_digest":"sha256:7520cddfcb282b7102568682db76515546a04bc1c040bddfc8e76807dc758bf5","observation_id":"b47a5de4-1eeb-449d-bbfc-1e1b32b55484","resolution":{"observed_at":"2026-07-04T15:39:56.480301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.29982","last_updated":"2026-06-29T08:57:59Z","snapshot_observed_at":"2026-08-06T21:47:26.917202Z","submitted_at":"2026-06-29T08:57:59Z","title":"Beyond Uniform Experts: Cost-Aware Expert Execution for Efficient Multi-Device MoE Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T04:27:02.915854Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.29982"},"observation_digest":"sha256:a0a824f28687811484c2e72a28e8190f2f400e7b275495470ec283a7d146d52b","observation_id":"4b72e20b-0132-473b-bccb-7cc1e8163784","resolution":{"observed_at":"2026-06-30T17:14:57.447292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-04T09:01:16.896518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02341","last_updated":"2026-08-03T14:57:09Z","snapshot_observed_at":"2026-08-06T23:37:11.464842Z","submitted_at":"2026-08-03T14:57:09Z","title":"Broadcast Rate Limits in Wi-Fi: A Forgotten Bottleneck for Collaborative Edge LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T09:01:16.896518Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2608.02341"},"observation_digest":"sha256:b6475f81cb7bcc14f38d9c679a1d3f2b737589e5c5219c11b861facefefa4597","observation_id":"778f6169-e786-4b4a-afd2-887bcfc3461e","resolution":{"observed_at":"2026-08-04T09:01:16.896518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.17238/citation-record","integrity":"/paper/2312.17238/integrity","json":"/paper/2312.17238/citation-record.json","paper":"/paper/2312.17238"},"outbound":[],"paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2312.17238."}