Lancement de CommonLingua par PleIAs
Une nouvelle collection de corpus textuels massifs pour le pré-entraînement.
Pleias (Hugging Face)·28 avril 2026

Image · Source originale
PleIAs publie CommonLingua, une collection de datasets massifs conçus pour le pré-entraînement de LLM. Disponible sur Hugging Face, cette ressource vise à fournir des données textuelles de haute qualité.