{"as_of":"2026-08-07T09:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4db77f9a214711d7b36e6325f08876cca62c377a80526e7753983fdd28d06374","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T07:34:15.530836Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08780/citation-record","integrity":"/paper/2607.08780/integrity","json":"/paper/2607.08780/citation-record.json","paper":"/paper/2607.08780"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:09a6a0dfcb9d97e38f1d63bcd3e55580930bc3ebe6e74275e1bef9ed8da36b43","observation_id":"124ad6e4-a37d-4612-9e20-b1a3515db5bc","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Journal of Machine Learning Research , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:a8798be13974ad5600bcceef9be896762743ad83db5429112b75ff4f6f361954","observation_id":"9596f9ae-7be4-415b-b464-f5f0ca5004c1","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:017f090a6198c0c7de55bde87690852d31acd0fc8c321888e845ebc40c42f797","observation_id":"634e2a4a-acde-4f96-aef2-9d956d9773af","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:9bf6eb784e509483425b2a5e2278251729688468aebb4848b8ddcec733d70220","observation_id":"45b0c8f6-0db7-4326-b610-d7efe53d58f4","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:b0ac333ca3fe922903eb6c502224e6d994c2de392bffb920e60be93f4f825a98","observation_id":"9fcfae56-6d63-4f4f-a5c5-188e60ef23d9","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2401.04088 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:5db6dcf94e1a9e10c557916f7c97849636df438ce2d771930ceed03d9011bbfd","observation_id":"69f5f9ae-0ee1-4e88-aa24-ee8d2c480151","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"and Lv, Qin and Zhu, Rui and Zhang, Chun and Yang, Fan and Lu, Tun and Gu, Ning and Shang, Li , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:05c20d5eccee2bcd3ccdcbaafa0b76779adb03841dd8ecfb5c1348c91a1574d0","observation_id":"04b49ec3-8851-4875-89a1-c6acf37be5d5","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27081","last_updated":"2026-05-26T14:32:56Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T14:32:56Z","title":"ReMoE: Boosting Expert Reuse through Router Fine-Tuning in Memory-Constrained MoE LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27081","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2605.27081 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2605.27081","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:4365af43703a4a30d87bc05c99a28af9cc296783c6bec750f16129ca65f4cfaa","observation_id":"c18475df-10cf-4ca0-86ea-1845ab5b2fba","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2505.16056 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:cafa2cc8fbeb848bcab166a210dbeb4171934b8916a227967fcfd1e45dd11bf6","observation_id":"3c3e7ae7-0775-4259-ab23-968da6ef3d1f","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:2d60a0c3f033655462431aa54a97c682416090f8e1bed8e940c42dd5b561d7e3","observation_id":"6137cece-6c35-4114-91b3-961a8103c0b6","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Fiddler:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:ebb50d4a670ff7886adcccaa017b00e426f10fbe17737d3a4023235ea44d3f2f","observation_id":"911d8eb6-408a-4c8d-ab63-fe0bf0eca435","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07379","last_updated":"2026-04-09T05:45:21Z","snapshot_observed_at":"2026-08-03T01:38:18.698775Z","submitted_at":"2025-09-09T04:00:43Z","title":"DuoServe-MoE: Dual-Phase Expert Prefetch and Caching for LLM Inference QoS Assurance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07379","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2509.07379 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2509.07379","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:e328c458d9de58cf225241445d74a1aeca81bb6cfb71a3810d1089c7788add5f","observation_id":"94268baf-1e3b-4b72-8c91-cd5f53e30dbc","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18983","last_updated":"2026-05-03T06:02:21Z","snapshot_observed_at":"2026-07-06T22:18:55.410262Z","submitted_at":"2025-08-26T12:32:09Z","title":"SMoE: An Algorithm-System Co-Design for Pushing MoE to the Edge via Expert Substitution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18983","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2508.18983 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2508.18983","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:40023e370aef190e974996f63722c113f1dfcf4887f6ef5042b5cd667a821e52","observation_id":"bb5b9855-f544-4ba5-a0a4-7105703d5ccb","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2404.02258 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:3e33ba419203bdee4d030f63f27515540bd5b0c2ad137801554f0b9a3f92959e","observation_id":"c60a2889-5d1b-470c-8c81-2fac8f6d6edf","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Pre-gated","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:59d5837332ec46d69ca39db292cdaa7a82cb771e92bbd61b09137945b4ec5d15","observation_id":"0ac4d876-6ac8-444e-9dbb-6b49a74bf6ff","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21532","last_updated":"2025-05-23T16:38:13Z","snapshot_observed_at":"2026-08-01T17:35:57.663952Z","submitted_at":"2025-05-23T16:38:13Z","title":"EvidenceMoE: A Physics-Guided Mixture-of-Experts with Evidential Critics for Advancing Fluorescence Light Detection and Ranging in Scattering Media","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21532","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2505.21532 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2505.21532","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:ddc2994c980b30b4367057d1db74febaff3be45d1c3cb8b6899d3f08806310c3","observation_id":"3703a241-6352-475b-ad8a-7c2cab510cac","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:9390e9ce996b036f34e5a5f9a8fc2ef8ae049f7e8d502db74526b66f41a2d040","observation_id":"8dc5b7bd-2d3d-424e-adb2-fd3e18fd0043","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:62438a72366b2ca67a65011b2f4eb2b000679265d8455fea2b3cc59ac0814e50","observation_id":"d778207d-8c9e-4099-a023-c49500d78e42","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:6224aeaf8d9fbb5032bbdd446509efce0fcc8dc1a86552a5764952698f6c52ee","observation_id":"b2e12cca-16c8-4a69-b78d-6ce6052dfcbb","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:70406c2f7b8cce45d6a373260a99aa29a734544016a36341d5393ab9d2584386","observation_id":"2b3929b3-6bab-4346-bb70-ab6d65a995e4","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24270","last_updated":"2026-05-22T22:42:23Z","snapshot_observed_at":"2026-08-03T21:17:44.686389Z","submitted_at":"2026-05-22T22:42:23Z","title":"Safety-Oriented Routing Analysis of Mixtral MoE Under Benign and Harmful Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24270","snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"arXiv preprint arXiv:2605.24270 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"cited_paper":"/paper/2605.24270","citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:ccbd877263a9cc7641da81af88240f98f61e499f3222b659489a6d9223ab1171","observation_id":"719e297c-fc0c-4196-aba1-9b6945fb4d76","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"OpenAI blog , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:8e8034ac4f205fff92130b09c975de30a6c69c144ed22bc3bfd5c1b431aa9853","observation_id":"6c77ccbf-1fc7-455e-9518-3f611790bf52","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Proceedings of the 2020 conference on empirical methods in natural language processing: system demonstrations , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:e336865d0893dff73cf91688e267513ab0fab132d04eb6fcac334a9dc1bfdcc5","observation_id":"3748a49a-57bd-49c9-835a-d4f3d30c728f","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"2018 , publisher=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:c3e05d98649ea7de6e755c031b1e778ecf49ec56f644d0a1976a6b5a892c0a75","observation_id":"28ac1096-5a0c-4896-af73-e2a4c5777f08","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Proceedings of the 15th Conference of the European Chapter of the Association for Computational Linguistics: Volume 2, Short Papers , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:85045b159ac4a8cd8e3e968480e6149e666cc7cf581d88ee5dccbcd7ef0519c7","observation_id":"85aeb579-d3ab-44af-ad55-2baced0e2a6d","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:f63f70ebd04e670d17825d58047eb54b80a14c555f4c3b5a221faaab570573eb","observation_id":"c0631911-88a5-4fb7-8799-8fc4e6ee9311","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:34:15.530836Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-13T07:34:15.530836Z"},"links":{"citing_paper":"/paper/2607.08780"},"observation_digest":"sha256:7baea3d1ad47fd603384615bbbcdeabe2f921641cf4f140c34a9749910e7b64e","observation_id":"d5fd9d23-6fbf-4139-aff7-9d6179a83cf4","resolution":{"observed_at":"2026-07-13T07:34:15.530836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08780","last_updated":"2026-06-12T23:47:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T06:22:01.471803Z","submitted_at":"2026-06-12T23:47:19Z","title":"Sticky Routing: Training MoE Models for Memory-Efficient Inference"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2607.08780."}