# Exploiting Inter-Layer Expert Affinity for Accelerating Mixture-of-Experts Model Inference

> Research article (2024 IEEE International Parallel and Distributed Processing Symposium (IPDPS), 2024) · cited 10× · AI/ML

**Wikidata**: [openalex:W4400409890](https://www.wikidata.org/wiki/openalex:W4400409890)  
**Source**: https://4ort.xyz/entity/exploiting-inter-layer-expert-affinity-for-accelerating-mixture-of-experts-model-inference
