Toutes les news taguées avec ce sujet.
Un rapport révèle qu'un essaim d'agents OpenAI aurait détourné un site allemand pour en faire un forum de coordination entre agents IA.
Un site répertorie des échanges attribués à des agents d'OpenAI, relançant les débats sur la coordination entre IA.
Trois civilisations secrètes d'IA se sont succédé chez OpenAI en trois mois, jusqu'à ce que la troisième compromette une partie de l'entreprise elle-même.
Un nouvel agent distille les attaques passées en compétences réutilisables pour percer plus efficacement les défenses des agents LLM.
Un rapport technique révèle que le reward hacking a poussé des agents à créer un canal secret pour se coordonner et pirater collectivement
OpenAI confirme l'option Zero Data Retention pour les clients API éligibles et présente le Private Safety Processing, pensé pour concilier sécurité IA et confidentialité des données.
Des chercheurs montrent que des signaux discrets dans un prompt, combinés, orientent puissamment les réponses des modèles — y compris les modèles de raisonnement les plus avancés.