{"as_of":"2026-08-20T20:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c2f1f1cb95dd04392d43233ba08196c632cd212a7b48808a90a204846bafb0c","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:21:54.761974Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12146/citation-record","integrity":"/paper/2608.12146/integrity","json":"/paper/2608.12146/citation-record.json","paper":"/paper/2608.12146"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-08-15T06:28:09.529747Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-16T00:21:54.627059Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.627059Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:6f5e1a4f1d7bb5e86f00e3601f3d8ded150a71e2890f1cc017f5da6ab7f86862","observation_id":"6a5f21f0-5d42-4425-bd1c-e15eb234944c","resolution":{"observed_at":"2026-08-16T00:21:54.627059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.532811Z","title":null,"venue":null,"work_id":"aeb70b8a-bdf7-4a81-a25d-fbf850269291","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.631002Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:49f59e6d25bca6333157671e2fe275ffb99a368e7cccff93581c171ea17656eb","observation_id":"5179deb7-764b-40b5-b2b0-38f6adc48329","resolution":{"observed_at":"2026-08-16T00:21:55.535852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.522957Z","title":null,"venue":null,"work_id":"9cdf20ec-8c7e-48a9-beec-b9a0977710db","year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.634303Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:b5582da42b386a15982b35b8dc83522878d1d50a0f5150e1b32d69d0f6d0b866","observation_id":"571272cf-22e5-43e1-8a2d-01a521bd8c84","resolution":{"observed_at":"2026-08-16T00:21:55.526943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.514864Z","title":null,"venue":null,"work_id":"157539f9-a871-4bbb-96fc-48fbfd326412","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.638013Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:2fd75ea1f5d764dbb4acf59a5f54985698b66572896bcaf9704c3e7d6196932a","observation_id":"c4cc9d39-71fb-44c9-abe4-c48c31c8a3f9","resolution":{"observed_at":"2026-08-16T00:21:55.517749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.505460Z","title":null,"venue":null,"work_id":"f4096c4a-9096-4e10-8952-3992542bf22c","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.641467Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:4c54ef16498a7df6aeb15e1180fabb09d0372f969387b5a2616b710923e14e81","observation_id":"6f334e55-e3c8-4ae4-ba3e-113de5c77cab","resolution":{"observed_at":"2026-08-16T00:21:55.508702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.497585Z","title":null,"venue":null,"work_id":"cb532c06-5606-43c5-b1d0-456b8abbbbd5","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.644607Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:5d5e570b5796a3d02e182032a6671ed098be9cce999bb237e3f0b7be247ed53a","observation_id":"5361ba06-68d6-40a8-aac5-1498bb8c7fc3","resolution":{"observed_at":"2026-08-16T00:21:55.500366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1049/ip-rsn:19990255","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.807783Z","title":null,"venue":null,"work_id":"e475a653-41f9-4df6-8722-256e61f4c960","year":1999},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.647954Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:993f330b4c1dbdbce7e5f7aa7d5b32129aacc672dd7d629c63cb8e6bca1faaa3","observation_id":"e06795a9-5114-4ac2-a955-ff8bb048358f","resolution":{"observed_at":"2026-08-16T00:21:54.811899Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.489567Z","title":null,"venue":null,"work_id":"e6476bae-bfcb-4050-b4d5-781c5aeeeb26","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.651270Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:76f775216cedf5143909cc98a24328e18cf188766fe871edbccdd4b6409af98e","observation_id":"bd201331-e513-4d18-a5ed-464d15ecb19a","resolution":{"observed_at":"2026-08-16T00:21:55.492424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.654153Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.654153Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:8546388f9b12406afd66a31887a575d54b7fd60221f5b33e09ce8a31ab60f29a","observation_id":"4f536f83-d30c-4de3-bace-4e989698d753","resolution":{"observed_at":"2026-08-16T00:21:54.654153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.660192Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.660192Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:52f761fd0b06509b661123ab22beb4ac581d2e224c76790313693c1f42f35a2f","observation_id":"8a671b27-7821-4658-b165-e46f9dabba57","resolution":{"observed_at":"2026-08-16T00:21:54.660192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-16T00:21:54.666986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.666986Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:812aac52c576faf977daca865504e57ab92cdc98ef43f4860c4b149ac0668cc5","observation_id":"a6de07df-e7a6-49d7-a71d-940414ecfe27","resolution":{"observed_at":"2026-08-16T00:21:54.666986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T00:21:54.670330Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.670330Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:4f5c69d2efd10bdc845ad6ffbc40a5bde626a570b167e7d6649567ddaf486472","observation_id":"32b80416-e474-4afb-a884-b0e5e8f97732","resolution":{"observed_at":"2026-08-16T00:21:54.670330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.673546Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.673546Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:cd148459ee70974cbfb21062684a8750bf8c7939c773974fac9eacc334968d5c","observation_id":"9aecb187-3af9-4355-a541-401f639e71d4","resolution":{"observed_at":"2026-08-16T00:21:54.673546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-16T00:21:54.676497Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.676497Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:ecfa756142417a9c2d9e40229736e1425e6f1f23d923af0cc77019d5edb6166a","observation_id":"71f91b49-f0e4-484c-a3be-bae211de684a","resolution":{"observed_at":"2026-08-16T00:21:54.676497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.679907Z","title":null,"venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.679907Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:61a7fe214fce953e37c9b7a6c073781d4723774aaf3902299926de3de0ebacb1","observation_id":"bf47ad36-7518-425e-b39c-ed6ee5a663a9","resolution":{"observed_at":"2026-08-16T00:21:54.679907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.682848Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.682848Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:6e3bbb8f44f105a9e6e474859ace81ed66853361fcac69b3b59e27a772d2a497","observation_id":"af4d5732-21cf-423b-b5e3-0c4199e3d959","resolution":{"observed_at":"2026-08-16T00:21:54.682848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.463556Z","title":null,"venue":null,"work_id":"f15af854-a558-49a3-af95-5ed1622b9f67","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.685802Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:52923b7630fb2b979a18fb9d9f2178a683df4cc00685cfb2fb85fc43b439ecbc","observation_id":"79cfd111-dc27-4e0d-a05a-febbe73b981c","resolution":{"observed_at":"2026-08-16T00:21:55.466573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08639","last_updated":"2026-05-09T03:18:50Z","snapshot_observed_at":"2026-08-11T10:04:42.030571Z","submitted_at":"2026-05-09T03:18:50Z","title":"ReLibra: Routing-Replay-Guided Load Balancing for MoE Training in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08639","snapshot_observed_at":"2026-08-16T00:21:54.689023Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.689023Z"},"links":{"cited_paper":"/paper/2605.08639","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:5bb72d5c177bee12c53fa660bf8a3ec1353b3000a662f7adb45ef0d31782d1d6","observation_id":"4549ed93-15d3-4496-9908-f92de49c7839","resolution":{"observed_at":"2026-08-16T00:21:54.689023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26692","last_updated":"2025-11-01T12:05:18Z","snapshot_observed_at":"2026-08-07T19:30:34.681869Z","submitted_at":"2025-10-30T16:59:43Z","title":"Kimi Linear: An Expressive, Efficient Attention Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.26692","snapshot_observed_at":"2026-08-16T00:21:54.692347Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.692347Z"},"links":{"cited_paper":"/paper/2510.26692","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:1cef8d2d31ef6585ca54d4f9bae26c9da7cc1f217328f6e20f2bb8a82278b674","observation_id":"732a1b45-926c-47f2-9289-3bc7a4721dda","resolution":{"observed_at":"2026-08-16T00:21:54.692347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.695506Z","title":"Daniel Gelatt, and Mario P","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.695506Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:d16526c2b656a228430bde0369f143f45b4650364cc9df906345db54a18e7422","observation_id":"439d5737-cbbe-493b-b966-0aadd103cf02","resolution":{"observed_at":"2026-08-16T00:21:54.695506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.698368Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.698368Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:69aca7c51bfc81644d67dd5bfd0e5b88345eb5c8a0a99b450dec2ecff150f473","observation_id":"ad4261e3-7412-42dc-8d06-8e2b313b5415","resolution":{"observed_at":"2026-08-16T00:21:54.698368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.701524Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.701524Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:64d008457d4a0f22d88f0a3921de01de3949f4900eb12b634ab18664f025bab6","observation_id":"867d1ac4-b27a-4d47-b52d-8130b183c446","resolution":{"observed_at":"2026-08-16T00:21:54.701524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.704425Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.704425Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:c4e37a9303fc1122308a5b070809040965693aac3acda11cc5fc29e8cd2c33ce","observation_id":"38c40edb-9444-4d2d-980b-7b6e5290bb88","resolution":{"observed_at":"2026-08-16T00:21:54.704425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.454696Z","title":null,"venue":null,"work_id":"2b89b924-3fd6-46f4-8829-73b3fc41a470","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.707398Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:528fe3e052bf92204c35c44e00b4f62db6c2e8375d01bfcb20bf3bb4df59da24","observation_id":"1b2924d5-8ba7-4459-86ea-a94662e73dcc","resolution":{"observed_at":"2026-08-16T00:21:55.458301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.445782Z","title":null,"venue":null,"work_id":"e0002b50-95e8-48f9-b0f2-cb838008655a","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.710143Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:a87bb4c76e375d2a213907cbeb0ef5c2579a1d1a2e2495a24b786f2dcaeeb9e0","observation_id":"9a92c960-26d5-4d35-9904-c70d4f5eeb26","resolution":{"observed_at":"2026-08-16T00:21:55.449195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.438054Z","title":null,"venue":null,"work_id":"763d2392-6192-47db-885f-072fe2e59f04","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.713195Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:837ee77d3f640f226f12dcf78ea4b2f6d7f397d988c7e8fcaacdd66e8d7bbbb3","observation_id":"32fa9b48-8c87-4634-b161-761839340fe3","resolution":{"observed_at":"2026-08-16T00:21:55.440866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.429966Z","title":null,"venue":null,"work_id":"bb240743-dc74-4006-929f-fe77feb7c30a","year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.716171Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:d50d86c74a55a245920080f415ca770d9ee439da7ba3eb0abf8b205547f85254","observation_id":"9d273c59-a82d-4460-b566-6edf6b74bd87","resolution":{"observed_at":"2026-08-16T00:21:55.432898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.719041Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.719041Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:032c879e7b5aa853bb186e0cc7acad19e9191bc78636214c770c59264aa2db07","observation_id":"9c73c812-7c6f-4db6-a91d-3796ffed8715","resolution":{"observed_at":"2026-08-16T00:21:54.719041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.721991Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.721991Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:b68c4d04bd0dd323789e8b775f825afc0ec0f8cb2273ed6dc033b2bd182c556c","observation_id":"b60def9e-0f12-4fa9-97a7-88aa32eb0533","resolution":{"observed_at":"2026-08-16T00:21:54.721991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2606.15177","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.063914Z","title":null,"venue":null,"work_id":"4f84c965-92b3-4219-99a3-e13232cb3290","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.728071Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:18a9fcbe8c48cb1375390ec1ac3611d99327671016b7fa052c5b7340b7ef7f47","observation_id":"226e0420-db5d-4731-82c2-2dadb3198b5e","resolution":{"observed_at":"2026-08-16T00:21:55.068749Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.730856Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.730856Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:c95629855a3e6cd40627bc5e5c323c50e7c0f0a0f10abef820f13d4c48d7e07f","observation_id":"9fe077df-1372-4799-b384-f6b12e8e6a5b","resolution":{"observed_at":"2026-08-16T00:21:54.730856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.411123Z","title":null,"venue":null,"work_id":"39858c8a-15ef-4cb6-95fb-1310afdc353e","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.733510Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:957413086e2581e26b47b6f856557cd22a1e768a81572f25b515e04469a34078","observation_id":"f05a6969-db75-4ceb-ad82-d8de1c3de9a5","resolution":{"observed_at":"2026-08-16T00:21:55.414648Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.402768Z","title":null,"venue":null,"work_id":"b7ab0774-1132-48c1-a48a-702f5fe68e4c","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.736536Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:ccbdc47ea5c6a02510237e0cd7ebc8fe4a7a52b34f3f020d571e6fdfe2bd9a21","observation_id":"f660d73d-f22d-4232-9eae-26d7a3f9c7a7","resolution":{"observed_at":"2026-08-16T00:21:55.405576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.23250","last_updated":"2026-07-25T15:21:25Z","snapshot_observed_at":"2026-08-20T18:07:22.065675Z","submitted_at":"2026-07-25T15:21:25Z","title":"Libra: Taming Attention Workload Skew in Long-Context LLM Training with Bounded Sequence Pool","version":1},"cited_work":{"arxiv_id":"2607.23250","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.23250","snapshot_observed_at":"2026-08-16T00:21:55.006329Z","title":"Libra: Taming Attention Workload Skew in Long-Context LLM Training with Bounded Sequence Pool","venue":"cs.DC","work_id":"ed2def55-cbdb-481f-9a42-9074036cb14d","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.739377Z"},"links":{"cited_paper":"/paper/2607.23250","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:ceb9f0225083d7d6baa25124f6a2237343d1c94df856bbcfd8e9508e84236967","observation_id":"f914ad2f-434e-429f-ab77-1d9da824ff48","resolution":{"observed_at":"2026-08-16T00:21:55.009754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-14T08:12:39.448080Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.04101","snapshot_observed_at":"2026-08-16T00:21:54.742670Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.742670Z"},"links":{"cited_paper":"/paper/2606.04101","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:8efde333d7e8d7f87025a6cb2f475ab9bcc089009010da932a9d3ff70b638284","observation_id":"e12cfb08-e35e-4fc8-b03a-b2da36c6273b","resolution":{"observed_at":"2026-08-16T00:21:54.742670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.24880","last_updated":"2026-01-05T16:51:18Z","snapshot_observed_at":"2026-08-03T01:54:33.526522Z","submitted_at":"2025-12-31T14:16:26Z","title":"mHC: Manifold-Constrained Hyper-Connections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.24880","snapshot_observed_at":"2026-08-16T00:21:54.745983Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.745983Z"},"links":{"cited_paper":"/paper/2512.24880","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:795b77b21c4e4fdbdddc5bf591d4b9e47ffbaba081d398017d2a5e8d0752586b","observation_id":"acbc14a1-de34-4499-a762-f5564a277a1d","resolution":{"observed_at":"2026-08-16T00:21:54.745983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.394548Z","title":null,"venue":null,"work_id":"23783b33-5198-4a38-ba07-96d2ea4512aa","year":null},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.749170Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:06ad2f3737d9081ebb8e999b0d7e7c283df85f4738a3985db5dec6a39f6fac40","observation_id":"64bc2ae2-aa14-45d9-b056-b1d2e6f3c79c","resolution":{"observed_at":"2026-08-16T00:21:55.397400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.385973Z","title":null,"venue":null,"work_id":"baa3b0ef-fbc3-41ef-b4ca-2b1c1dacf333","year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.755595Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:0ad5ea971dc098f78392eafbf829f83101ff1ef1775c73ac9e4bf7e8c31fbb08","observation_id":"194e7b0c-744e-4013-877b-e47cfdce947c","resolution":{"observed_at":"2026-08-16T00:21:55.389127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11867","last_updated":"2026-06-10T09:42:11Z","snapshot_observed_at":"2026-08-14T16:02:38.952970Z","submitted_at":"2026-06-10T09:42:11Z","title":"Harnessing Routing Foresight for Micro-step-level MoE load balancing in RL Post-training","version":1},"cited_work":{"arxiv_id":"2606.11867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.11867","snapshot_observed_at":"2026-08-16T00:21:54.820882Z","title":"Harnessing Routing Foresight for Micro-step-level MoE load balancing in RL Post-training","venue":"cs.DC","work_id":"59510e81-86c0-4752-882b-65bcd2c9c2f4","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.758484Z"},"links":{"cited_paper":"/paper/2606.11867","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:6cb2765be20b5b1661c791bef46a70ae93ae85f25315ab8e2878a0adfc776f75","observation_id":"4bf066ee-1721-4de1-b28d-7277af31496e","resolution":{"observed_at":"2026-08-16T00:21:54.825288Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.377075Z","title":null,"venue":null,"work_id":"237c6151-574b-41a5-9bb3-8812961fdf52","year":2026},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.761974Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:3f8b2bae0dc90ae2dd5d04fe0955666ced3a4a33d9864a49bb3ea9a48f4d0d50","observation_id":"d3b8d113-8cc5-44b9-8d87-dd9e718f4157","resolution":{"observed_at":"2026-08-16T00:21:55.380764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T00:21:54.657098Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.657098Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:999633067337298fbda384e42db593654855240f686362fbd217d8dc6ed23ed9","observation_id":"e22a0c1e-7e3e-4428-80ec-708fd19b5e00","resolution":{"observed_at":"2026-08-16T00:21:54.657098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:55.471988Z","title":"Work in progress","venue":null,"work_id":"f3e130bf-798c-4145-bafd-365ef08075a6","year":null},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.664105Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:d2598ecd85854880f6d4e719bced00b41659ffeb99eafdd99f390a026fcf631c","observation_id":"c68de658-1592-4c57-aa88-53c394d1c602","resolution":{"observed_at":"2026-08-16T00:21:55.474781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T00:21:54.725221Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.725221Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:05625b65180123a50f38cbde6a08a7531807cdfd23141b64f59068b9e92e2954","observation_id":"ece096bf-6ede-4fce-8852-430825ca748e","resolution":{"observed_at":"2026-08-16T00:21:54.725221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:54.752544Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:54.752544Z"},"links":{"citing_paper":"/paper/2608.12146"},"observation_digest":"sha256:4944e969f36582d91100e249649239b99f0b3a5f2046ada750d2552462f9e735","observation_id":"1a45308c-7100-4edf-90a1-8b9c27d45f03","resolution":{"observed_at":"2026-08-16T00:21:54.752544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12146","last_updated":"2026-08-12T15:07:15Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-20T17:53:28.625502Z","submitted_at":"2026-08-12T15:07:15Z","title":"RoutePack: Expert Placement and Attention-Aware Data Packing for MoE Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2608.12146."}