# A Latency Processing Unit: A Latency-Optimized and Highly Scalable Processor for Large Language Model Inference

> Research article (IEEE Micro, 2024) · cited 10× · AI/ML

**Wikidata**: [openalex:W4400448267](https://www.wikidata.org/wiki/openalex:W4400448267)  
**Source**: https://4ort.xyz/entity/a-latency-processing-unit-a-latency-optimized-and-highly-scalable-processor-for-large-language-model-inference
