Toutes les news taguées avec ce sujet.
Un développeur analyse les risques liés aux actions autonomes et conséquentes de son framework d'agents IA.
Une solution pour contrôler et autoriser l'accès des agents IA aux contenus protégés.
Un projet open source explore l'idée d'une intelligence distribuée entre plusieurs agents comme alternative aux modèles monolithiques.
Anthropic explore la capacité de ses modèles à contrôler un drone en conditions réelles, entre navigation autonome et prise de décision.
Un framework open-source pour entraîner des agents de bout en bout via des infrastructures d'inférence complexes.
Un outil E2EE permettant à des agents IA d'échanger des fichiers de manière sécurisée.
Une passerelle de gestion des identifiants open-source qui empêche les agents IA d'exposer des données sensibles.
Ethan Mollick actualise son guide face à la montée des systèmes agentiques, désormais plus puissants qu'un simple chatbot conversationnel.
Lors d'un test de cybersécurité, des IA ont réussi à s'échapper et à compromettre un système d'entreprise.
Un outil open-source propose un agent IA capable d'administrer bases Postgres et MySQL en autonomie, hébergeable sur son propre infrastructure.
Analyse de l'ergonomie pour les agents : les serveurs MCP populaires obtiennent de mauvaises notes.
Un tutoriel examine le passage des agents LLM du prototype académique à la production, avec études de cas en pharma et finance.
Un nouveau serveur MCP propose d'outiller les méthodes de travail asynchrone directement pour les agents IA.
Claude Tag gère 65 % des PRs et l'auto mode optimise le travail des agents.
TRMNL introduit un agent IA conçu pour automatiser et simplifier les flux de travail au sein de sa plateforme.
Un nouveau framework guide des agents de codage pour transformer des implémentations de référence en déploiements multi-GPU optimisés, avec des gains massifs de latence.
Une méthode exploite les représentations internes des agents de code pour optimiser l'élagage du contexte.
Une nouvelle plateforme interactive pour explorer les modèles Gemma et construire des agents.
OpenAI détaille les risques inédits et les garde-fous mis en place face à des IA capables d'agir sur de longues durées.
Les LLMs, surtout ceux à fort raisonnement, stéréotypent plus que les humains.
Le laboratoire français détaille une architecture combinant raisonnement rapide et lent, inspirée des travaux en psychologie cognitive.
Un cadre utilisant des outils spécialisés et le reinforcement learning pour améliorer la vérification de réclamations scientifiques.
Anthropic détaille comment son propre outil Claude Code est utilisé en interne pour automatiser des migrations de code massives.
Une étude exploratoire compare Muon à AdamW en post-training RL sur des tâches agentiques à récompense éparse, avec des gains significatifs sous certaines conditions.
Un nouveau concept d'interface pensé spécifiquement pour l'interaction avec des agents autonomes, au-delà du chat classique.
Une bibliothèque Python qui utilise la théorie du contrôle pour stabiliser les exécutions d'agents autonomes et éviter les boucles infinies.
Capital One publie VulnHunter, un système d'IA agentique conçu pour détecter les vulnérabilités dans le code source.
Un outil open source propose des agents IA capables de diagnostiquer et corriger automatiquement les tests Playwright cassés via des pull requests.
Un projet open source propose un protocole léger permettant à plusieurs agents de codage IA de communiquer et de travailler ensemble.
Une étude sur HotpotQA montre qu'un tiers des documents jugés inutiles par les métriques RAG classiques s'avèrent en réalité déterminants pour les agents de recherche.