Toutes les news taguées avec ce sujet.
Une méthode pour agrandir le vocabulaire d'un modèle déjà entraîné sans repartir de zéro, appliquée à LFM2.5-8B-A1B.
Un nouveau consortium allemand publie Soofi S, un modèle open de 30 milliards de paramètres qui surpasse les benchmarks en anglais et en allemand.
Un vaste corpus multilingue pour l'entraînement de modèles IA.
Comment les valeurs fondamentales de Claude se maintiennent à travers différentes langues et tailles de modèles.
Le laboratoire français dévoile une collection multilingue destinée à enrichir l'entraînement de modèles de langage.
Le lab français Pleias met en ligne CommonLingua sur Hugging Face, une ressource destinée à l'entraînement de modèles de langage.
Une intervention simple et sans entraînement améliore significativement les pipelines de traduction-raisonnement multilingues en préservant le contexte original.
PaddlePaddle publie PP-OCRv6 sur Hugging Face, une suite OCR multilingue couvrant 50 langues avec des modèles allant de 1,5 à 34,5 millions de paramètres.