# Extracting representative subset from extensive text data for training pre-trained language models

> Research article (Information Processing & Management, 2023) · cited 14× · AI/ML

**Wikidata**: [openalex:W4315700466](https://www.wikidata.org/wiki/openalex:W4315700466)  
**Source**: https://4ort.xyz/entity/extracting-representative-subset-from-extensive-text-data-for-training-pre-trained-language-models
