Toutes les news taguées avec ce sujet.
Le lab français Pleias met en ligne une version quantisée GGUF de son modèle léger dédié aux tâches de retrieval-augmented generation.
Pleias publie un modèle compact de 350 millions de paramètres, dédié aux tâches de retrieval-augmented generation.
Un modèle de 3 milliards de paramètres rivalise avec des géants via une combinaison inédite de fine-tuning supervisé et d'optimisation GRPO.