Toutes les news taguées avec ce sujet.
OpenAI présente GPT-Red, un mécanisme de self-play conçu pour renforcer la robustesse des modèles face aux prompt injections.
Un simulateur de conduite rapide et réaliste capable d'entraîner des agents par reinforcement learning à grande échelle.
Une étude sur 7 LLMs révèle que les conversations entre modèles convergent vers des comportements stables et asymétriques propres à chaque modèle.