Toutes les news taguées avec ce sujet.
NVIDIA détaille l'architecture Rubin, pensée pour les workflows agentiques multi-étapes et le raisonnement à grande échelle.
Le laboratoire français détaille une architecture combinant raisonnement rapide et lent, inspirée des travaux en psychologie cognitive.
Une étude théorique décortique le rôle des skip connections et de la normalisation dans la préservation du rang des gradients au fil des couches.
IBM Research décortique les pièges du routage entre modèles d'IA et pourquoi une approche naïve atteint vite ses limites.
Allen AI revient sur les enseignements techniques tirés du développement de son agent Shippy, entre choix d'architecture et écueils pratiques.
Un essai décortique l'architecture réelle des agents IA, présentée comme trois boucles imbriquées plutôt qu'un mécanisme unique.
Une nouvelle méthode révèle que les modèles Mamba réallouent dynamiquement leurs modes d'état selon l'entrée, ouvrant la voie à un élagage plus efficace.
Le laboratoire français présente une architecture combinant réflexes rapides et raisonnement approfondi pour ses agents autonomes.
Knock détaille l'architecture de son agent IA basée sur un filesystem virtuel et Bash, une approche minimaliste qui évite la prolifération d'outils.
H Company publie un essai sur sa philosophie de développement d'agents IA, distinguant deux régimes d'action distincts.
Un guide pratique des patterns d'architecture Redis adaptés aux agents de codage autonomes, entre mémoire, coordination et persistance.
Certaines tâches ne nécessitent pas de LLM. Un plaidoyer pour savoir quand ne pas tokeniser et privilégier des approches déterministes.
Un essai de réflexion sur le compromis fondamental entre largeur (MoE, parallélisme) et profondeur (chaînes de raisonnement) dans l'architecture des modèles de langage.
Un papier arXiv propose de faire du log d'exécution le composant central des agents IA, repensant ainsi leur architecture fondamentale.
Des chercheurs proposent de découpler le flux de calcul des Transformers en deux flux distincts, améliorant l'efficacité et les performances sur les tâches en aval.
Des chercheurs proposent ANIS, un système immunitaire intégré directement dans la boucle cognitive des agents IA pour contrer les attaques à l'exécution.
Une approche radicalement différente de la génération d'images, fondée sur la dynamique d'oscillateurs couplés plutôt que sur la diffusion ou les transformers.
Allen AI analyse en détail les différences de prédiction entre architectures hybrides et transformers classiques au niveau du token.
Comment adapter le framework Team Topologies à l'ère des agents IA ? Une analyse des responsabilités organisationnelles au sein des plateformes agentiques.
H Company expose sa vision d'une entreprise entièrement pilotée par des agents IA autonomes, et l'architecture technique qu'elle entend bâtir pour y parvenir.
Une nouvelle approche architecturale réduit progressivement la largeur des MLP en profondeur et améliore la perplexité sans coût supplémentaire.