# Batch policy learning in average reward Markov decision processes

> Research article (The Annals of Statistics, 2022) · cited 17× · AI/ML

**Wikidata**: [openalex:W4312072401](https://www.wikidata.org/wiki/openalex:W4312072401)  
**Source**: https://4ort.xyz/entity/batch-policy-learning-in-average-reward-markov-decision-processes
