Toute la veille IA Fellow publiée en juin 2026.
Anthropic élargit la compatibilité de son application desktop : Claude est maintenant accessible nativement sous Linux, en version bêta.
Le DGX Spark de NVIDIA s'attaque au marché des stations de travail IA compactes, face au Mac Studio d'Apple et d'autres alternatives.
Amazon Web Services crée une nouvelle division dédiée à l'IA avec un budget d'un milliard de dollars pour déployer des ingénieurs directement auprès des entreprises clientes.
La communauté Hacker News s'interroge sur les solutions d'isolation et de sécurité pour encadrer les agents de codage autonomes.
Des utilisateurs signalent que l'installation de l'app Cursor sur iOS entraîne des modifications permanentes des réglages de confidentialité, sans possibilité de retour arrière.
Des strings inédites découvertes dans l'application Claude laissent entrevoir de nouvelles fonctionnalités, tandis que Fable 5 reviendrait conditionné à une vérification.
Un tweet viral accuse Anthropic d'avoir dissimulé du code à comportement espion dans son outil de coding Claude Code.
L'initiative d'identité numérique de l'UE repose sur les infrastructures de deux géants américains, soulevant des questions de souveraineté.
OpenAI dévoile Genebench-Pro, un benchmark dédié à l'évaluation des capacités des modèles d'IA sur des tâches de génomique.
DeepMind publie Gemini Flash Lite, une version allégée de ses modèles de génération d'images, ciblant les usages à faible latence.
Hugging Face affiche désormais les évaluations de la communauté directement sur les fiches de modèles, centralisant les benchmarks tiers.
Des ingénieurs d'OpenAI ont utilisé l'analyse massive de core dumps pour traquer des crashs rares d'infrastructure et découvrir un bug logiciel dormant depuis 18 ans.
Un chercheur découvre que Claude Code insère des marqueurs invisibles dans ses requêtes HTTP pour signaler son identité à l'API Anthropic.
NVIDIA détaille comment ses outils Nsight permettent d'optimiser NuRec, son pipeline de reconstruction 3D neuronale pour véhicules autonomes et robotique.
Anthropic présente Claude Science, une déclinaison de Claude spécialement conçue pour accélérer les travaux de recherche scientifique.
Anthropic lance Claude Science, une plateforme spécialisée destinée aux chercheurs et scientifiques pour accélérer leurs travaux grâce à l'IA.
Les LLM généralistes atteignent leurs limites : Hugging Face argumente que l'avenir appartient aux modèles spécialisés par domaine.
OpenAI dévoile GeneBench-Pro, un benchmark conçu pour évaluer les capacités des modèles d'IA dans les domaines de la génomique, de la biologie et de la recherche scientifique.
Microsoft Research transforme les fichiers de compétences d'agents en paramètres optimisables, sans modifier les poids du modèle cible.
Le créateur de 3Blue1Brown analyse comment l'IA progresse plus vite en maths que dans d'autres domaines, et ce que cela révèle pour l'avenir.
La version 1.10 de shot-scraper introduit une commande permettant aux agents de coder de générer automatiquement des vidéos de démonstration de leurs travaux.
Anthropic dévoile Claude Sonnet 4.5, un nouveau modèle intermédiaire promettant des performances accrues pour les usages quotidiens.
NVIDIA détaille comment ses avancées matérielles — HBM, NVLink-C2C et décompression dédiée — lèvent les goulots d'étranglement mémoire et I/O des moteurs de requêtes GPU.
IBM Research publie ScarfBench, un benchmark dédié à l'évaluation des agents IA sur des tâches réelles de migration de frameworks Java en contexte enterprise.
DeepMind ouvre l'accès à deux nouveaux modèles Gemini optimisés pour la légèreté et la rapidité d'inférence.
OpenAI publie de nouvelles données Signals montrant la croissance de ChatGPT : davantage d'utilisateurs, plus de fonctionnalités explorées, expansion régionale et multilingue.
Le projet ZLUDA franchit une nouvelle étape avec sa version 6, permettant de faire tourner des workloads CUDA natifs sur du matériel AMD ou Intel.
Les promesses de l'IA agricole sont réelles, mais sans fondation de données solide, les modèles prédictifs risquent de produire des résultats trompeurs.
Cerebras annonce le support de Gemma 4 sur son infrastructure, combinant sa vitesse d'inférence record avec les capacités multimodales du modèle de Google.
Une étude sur 7 LLMs révèle que les conversations entre modèles convergent vers des comportements stables et asymétriques propres à chaque modèle.
Un nouveau testbed évalue les agents IA sur des tâches de développement logiciel interactives et évolutives, révélant un écart important avec les benchmarks classiques.
Des chercheurs proposent une architecture Mixture of Experts unifiée capables de classifier, détecter le packing et identifier les familles de malwares simultanément.
Un nouveau dataset de 220 000 paires sol-satellite et drone-satellite, couplé à un framework single-stage intégrant contraintes 3D et géométrie caméra.
Un cadre minimax rigoureux pour borner la complexité statistique des méthodes génératives basées sur le transport, dont les diffusion models et le flow matching.
Une nouvelle approche combinant analyse de trafic réseau et ML atteint 99,64 % de précision pour détecter les ransomwares ciblant les serveurs de fichiers.
Des chercheurs appliquent la théorie bayésienne de la décision aux LLMs pour améliorer leurs choix dans des tâches subjectives comme le tutorat ou la révision par les pairs.
Une étude révèle que huit LLMs majeurs sont sensibles aux biais cognitifs humains lors de l'analyse de vulnérabilités dans du code.
Un framework sans étiquettes classe les canaux de communication les plus critiques dans les systèmes multi-agents, avant même qu'une attaque ne soit détectée.
Des chercheurs démontrent comment un adversaire peut manipuler l'inférence sémantique d'un utilisateur via un signal déclencheur basse puissance dans un réseau partagé.
Une nouvelle méthode de régularisation combat le fractionnement et l'absorption de features dans les SAEs, deux pathologies qui nuisent à l'interprétabilité des LLMs.
Agents-A1 démontre qu'élargir l'horizon agentic d'un modèle MoE 35B suffit à rivaliser avec des LLM mille fois plus grands.
Roberto Serrano, économiste à l'Université Brown, a détecté un recours généralisé à l'IA dans les travaux de ses étudiants, déclenchant un débat sur l'intégrité académique.
Des chercheurs montrent que la magnitude des embeddings, pourtant ignorée par la similarité cosinus, capture naturellement des propriétés sémantiques clés.
Une nouvelle licence open-source pensée pour l'IA, qui impose des obligations d'auditabilité aux modèles déployés commercialement.
Un nouveau paradigme de distillation pour LLM et VLM qui contourne l'illusion de privilège en routant dynamiquement la supervision token par token.
Un chercheur en IA de l'UC Berkeley plaide pour ralentir délibérément le rythme du développement de l'IA, une position qui tranche avec le consensus dominant.
Comparaison tête-à-tête des performances cryptographiques de wolfSSL et MbedTLS sur quatre architectures matérielles différentes.
DoorDash open-source un orchestrateur en interface terminal pour superviser des agents de codage autonomes sur des tâches prolongées.
Un système hiérarchique combinant VLMs et modèles de vision 3D permet aux robots d'identifier et localiser des outils non conventionnels en monde ouvert.
Une étude empirique montre que plus un modèle est conservateur en offline, plus il est vulnérable au reward hacking lors de l'adaptation online.
Une approche multi-agents légère intégrée à l'API de vLLM permettrait de dépasser les performances des grands modèles frontier sans coût supplémentaire.
Une étude démontre que l'instabilité du pipeline parallèle asynchrone dépend du choix d'optimiseur, pas d'une limite intrinsèque.
Un protocole open-source vise à unifier la gestion de la mémoire entre différents assistants IA, dont Claude, ChatGPT et Cursor.
Un framework hybride LLM-Diffusion capable de générer des chansons complètes en combinant planification sémantique et raffinement acoustique par piste.
Un framework qui améliore la clairvoyance des agents LLM sans modifier leurs paramètres, grâce à une mémoire épisodique et sémantique évolutive.
Séoul annonce un plan d'investissement massif d'un trillion de dollars pour renforcer sa position dans les semi-conducteurs et la robotique humanoïde.
Google publie son rapport d'impact économique pour le Royaume-Uni et présente sa feuille de route pour démocratiser l'accès aux technologies IA.
Microsoft Research présente Memora, un système de mémoire scalable pour agents IA qui réduit jusqu'à 98 % les tokens de contexte tout en battant l'état de l'art sur deux benchmarks.
Entre workshops à l'AIEWF et la défaite de l'Allemagne, la journée fut discrète — mais Brain2Qwerty v2 de Meta et Cursor iOS ont retenu l'attention.
L'équipe Moondream remet en question l'hypothèse d'une pénurie durable de GPU et analyse les dynamiques réelles du marché des puces IA.
Un pipeline génère 48 000 trajectoires synthétiques pour entraîner un robot humanoïde à naviguer et manipuler des objets à partir d'observations egocentriques.
Un essai critique sur le paradoxe des organisations qui détruisent la confiance interne tout en exigeant davantage de performance de leurs équipes.
Meta a développé un ASIC CXL maison permettant de recycler la mémoire DDR4 de serveurs obsolètes, réduisant la taille de certaines flottes d'inférence d'un quart.
Fame propose une couche de mémoire persistante et de contrôle de sécurité des outils pour les agents de codage fonctionnant en local.
Une exploration de la conscience de soi des modèles de langage à travers le prisme du classique test du miroir utilisé en éthologie.
La plateforme de streaming musical Tidal dévoile sa politique encadrant l'usage de l'intelligence artificielle vis-à-vis des artistes et de leurs œuvres.
Séoul annonce un programme massif pour renforcer sa position dans la course mondiale aux puces et à l'intelligence artificielle.
Le créateur de htmx partage son expérience pratique de collaboration avec les outils d'IA, entre gains de productivité et limites concrètes.
L'éditeur de code assisté par IA Cursor annonce son arrivée sur iPhone, étendant son environnement de développement au mobile.
Des livres de guides vidéoludiques produits par IA prolifèrent sur Amazon, certains portant sur des jeux pas encore sortis.
Le MIT Technology Review analyse l'adoption des agents IA dans les équipes tech et identifie les facteurs qui freinent encore leur déploiement en entreprise.
Un tour d'horizon technique et pédagogique du cycle de vie complet d'un kernel CUDA, du code hôte jusqu'à l'exécution sur GPU.
DeepReinforce AI publie Ornith-1.0, une famille de modèles open-source conçus pour s'améliorer en autonomie sur des tâches de codage agentique.
Appeler un agent IA « employé » plutôt qu'outil logiciel dégrade la vigilance des managers, révèle une étude de Boston University.
AllenAI publie DiScoFormer, une architecture transformer unifiée capablede d'estimer densité et score simultaneously sur des distributions variées.
Un expert Google détaille la stratégie full-stack en IA : du matériel aux modèles en passant par les produits, une philosophie au cœur de l'approche du groupe.
À mesure que les agents IA accèdent à des données sensibles et agissent sur des systèmes critiques, NVIDIA détaille les exigences de gouvernance pour les déploiements en entreprise.
Dario Amodei, PDG d'Anthropic, exprime ses inquiétudes sur les risques posés par la diffusion de modèles d'IA open-source.
Un rapport OpenAI analyse comment l'IA pourrait transformer les emplois dans l'UE, entre automatisation, création de postes et évolution des pratiques.
Un outil de monitoring temps réel conçu pour suivre les événements générés par des agents autonomes, présenté sur Hacker News.
Une étude sur 930 000 pull requests générées par des agents révèle que le risque d'intégration est une propriété du dépôt, pas de l'agent.
Une nouvelle approche théorique établit des conditions d'identifiabilité pour les modèles de représentation causale en temps continu à base d'équations différentielles stochastiques.
Une approche auto-rectificatrice du biais d'exposition en Flow Matching, sans contraintes statiques ni heuristiques externes.
Une initiative propose des visuels plus nuancés et réalistes pour illustrer l'intelligence artificielle, en remplacement des clichés habituels.
Un framework d'optimisation par préférences à plusieurs niveaux pour améliorer l'expressivité émotionnelle des modèles TTS basés sur les LLM.
Une étude théorique révèle un diagramme de phases pour la généralisation selon la taille du modèle et le volume de données, via des réseaux à deux couches quadratiques.
Des chercheurs proposent une architecture hybride classique-quantique à variables continues pour détecter le cancer buccal sur des appareils edge à faible ressource.
Un framework intégrant l'analyse topologique des données dans le pipeline TTA pour améliorer la segmentation d'anomalies complexes en 2D et 3D.
Des chercheurs proposent ANIS, un système immunitaire intégré directement dans la boucle cognitive des agents IA pour contrer les attaques à l'exécution.
Une étude mécanistique révèle qu'un petit groupe de têtes d'attention (2,5–4,8 %) contrôle la résolution des conflits entre vision et connaissance mémorisée dans les modèles multimodaux.
Appaca propose un environnement de travail IA conçu pour les opérateurs, présenté en avant-première sur Hacker News.
Un nouveau framework combine LoRA et fusion multimodale pour prédire le trafic cellulaire en intégrant mobilité et congestion urbaine.
Plusieurs banques centrales tirent la sonnette d'alarme : la bulle spéculative autour de l'IA pourrait déclencher une crise financière globale.
Google présente PAT, un framework agentique capable d'évaluer des articles scientifiques complets et d'améliorer la détection d'erreurs mathématiques de 34 %.
Un framework d'agents auto-évolutifs atteint 100 % de complétion sur plusieurs benchmarks de conception de circuits, en traitant le HDL comme un dépôt git vivant.
Ornith-1.0 propose une approche où les LLM construisent eux-mêmes leur propre scaffolding pour exécuter des tâches de codage de manière autonome.
Un framework PAC-Bayes fournit des garanties d'apprentissage pour le contrôle optimal quadratique via la paramétrisation System Level Synthesis.
Un plafond à 76 % serait atteint par les LLMs pour la lecture de documents difficiles — et seule l'expertise humaine permettrait de le dépasser.
Des réseaux de neurones guidés par les symétries SU(3) et SU(4) de la physique nucléaire atteignent des performances compétitives tout en révélant la physique sous-jacente.
Un document historique de 1968 explore l'utilisation de l'ordinateur pour développer le langage chez des enfants incapables de parler.
Une nouvelle méthode exploite des débats entre personas pour extraire des principes d'alignement plus riches et plus fidèles aux préférences humaines.
Un outil en pur Bash pour interroger les APIs de grands modèles de langage, sans aucune dépendance externe requise.
Un nouveau sampler discret guide la génération par récompense dans les modèles de diffusion masqués, avec une complexité quadratique prouvée.
Une analyse théorique du Bregman ADMM démontre la convergence presque sûre vers des points stationnaires du second ordre, sans hypothèse de gradient Lipschitz global.
Les solveurs de jeux à somme nulle ne sont pas interchangeables : l'algorithme utilisé détermine quel équilibre de Nash est sélectionné, de façon systématique.
Un projet communautaire vise à débloquer les fonctionnalités avancées des AirPods sur les plateformes non-Apple, sans dépendance à l'écosystème propriétaire.
Lore est un outil open-source qui contextualise les agents de code avec les conventions et décisions architecturales propres à une équipe.
Une étude règle une question ouverte depuis 1987 sur l'apprentissage PAC à partir d'exemples positifs uniquement, révélant un paysage combinatoire inattendu.
Un nouveau framework compositionnel permet de combiner des politiques de manipulation préentraînées sans interférence destructrice entre les doigts.
HP Inc. élargit son accord avec OpenAI pour déployer l'IA dans ses expériences clients, son développement logiciel et ses opérations d'entreprise.
Herdr permet de lancer et orchestrer plusieurs agents IA en parallèle depuis la ligne de commande, sans quitter le terminal.
Semgrep publie ses résultats internes : le modèle GLM 5.2 devance Claude sur leurs benchmarks spécialisés en sécurité applicative.
Un ingénieur logiciel partage ses observations sur la transformation du métier face à la montée en puissance des outils d'IA.
Un enseignant de Brown University alerte sur l'utilisation généralisée de l'IA par ses étudiants lors d'un examen, relançant le débat sur l'intégrité académique.
Une analyse critique de l'évolution du tokenmaxxing dans les systèmes agentiques : la stratégie est-elle dépassée ou en mutation ?
Vienne courtise activement Anthropic pour l'inciter à s'établir en Europe, après que des restrictions d'accès imposées par Washington ont poussé l'entreprise à envisager une implantation hors des États-Unis.
L'écosystème des modèles ouverts se fragmente et s'élargit : tour d'horizon des dernières sorties et des motivations des acteurs.
Un utilisateur raconte comment il a soumis ses images IRM à Claude Code (Opus) pour obtenir une analyse médicale complémentaire.
Selon le Financial Times, Google aurait imposé des limitations à Meta concernant l'utilisation de ses modèles d'IA Gemini, révélant les tensions croissantes entre les géants du secteur.
Retour sur le modèle éducatif humboldtien et son ambition originelle : cultiver l'esprit critique plutôt que former des exécutants.
Un ticket ouvert sur le dépôt GitHub de Codex pointe l'absence de mécanisme natif pour exclure des fichiers sensibles de l'agent.
Le Département de Justice américain aurait invoqué la sécurité nationale pour justifier la priorité donnée à l'IA de xAI sur les normes environnementales.
DeepSeek publie DeepSpec sur Hugging Face, une collection dont les détails techniques restent à préciser mais qui attire déjà l'attention.
Alors que le débat sur l'IA se focalisait sur une prise de contrôle autonome, le risque réel serait une concentration du pouvoir entre quelques mains.
Un essai choc sur la recomposition brutale de l'industrie IA, publié sur The Algorithmic Bridge et repéré en tête de Hacker News.
Un outil expérimental exploite les métriques de pression mémoire du noyau Linux (PSI) pour décider dynamiquement quand réduire le KV cache des LLM.
Un papier décortique l'Apple Neural Engine, révélant son architecture interne, ses modèles de programmation et ses caractéristiques de performance.
Le California Science Center dévoile une installation monumentale : la navette spatiale Endeavour dressée à la verticale, en configuration de lancement.
Un utilitaire macOS open-source empêche la mise en veille d'un Mac quand son écran est fermé, uniquement le temps qu'un agent IA tourne.
Face aux restrictions d'exportation frappant Anthropic, plusieurs startups asiatiques accélèrent le lancement de modèles rivaux aux capacités proches de Mythos.
Un essai sur la montée du "AI slop" et ce que la créativité humaine authentique peut opposer à l'uniformisation produite par les LLM.
Un outil open-source qui oriente automatiquement les requêtes vers un LLM local ou un modèle hébergé selon des règles déterministes.
Des systèmes d'IA génèrent des architectures de puces RF si contre-intuitives que des ingénieurs humains n'auraient jamais pu les concevoir.
Selon Anthropic, Alibaba aurait orchestré une opération massive avec 25 000 comptes pour siphonner les réponses de Claude et en reproduire les capacités.
DeepSeek dévoile DSpark, un ensemble de techniques d'optimisation d'inférence qui accélèrent significativement la génération de tokens sur ses modèles.
L'organisation open-source spécialisée en infrastructure réseau pose des règles claires sur le recours aux modèles de langage dans ses projets.
Un nouveau family de modèles open-weights conçus spécifiquement pour les tâches de codage en mode agentique vient d'être annoncée.
METR publie son rapport d'évaluation autonomy & safety sur GPT-5.6 Sol avant son déploiement par OpenAI.
Une bibliothèque de 60 architectures d'agents IA préconfigurées, avec mécanismes de sécurité intégrés, destinée aux équipes en phase de déploiement.
OpenAI confie au gouvernement fédéral la validation des utilisateurs de son dernier modèle, une décision inédite qui soulève des questions sur l'accès à l'IA.
OpenTag propose une intégration d'assistant IA dans Slack en open-source, en réponse à l'offre payante d'Anthropic avec Claude.
Murmur propose une infrastructure légère permettant à plusieurs agents de codage de communiquer via un bus de messages commun.
Un essai explore comment l'usage croissant de l'IA modifie nos pratiques de lecture et menace une culture construite sur l'effort intellectuel.
SedonaDB 0.4 exploite les RT cores des GPU grand public pour accélérer les jointures spatiales, battant un H100 sur certains benchmarks.
Une analyse de l'état réel du fossé entre modèles ouverts et fermés, alors que les benchmarks semblent se rapprocher.
Washington ouvre un accès restreint au modèle Mythos d'Anthropic, réservé à un cercle d'organisations américaines sélectionnées.
Les systèmes d'IA capables de raisonner mathématiquement remettent en question la nature de la preuve, de la découverte et du rôle du mathématicien.
OpenAI lance une nouvelle famille de trois modèles GPT-5.6 en preview limitée, réservée à un cercle restreint de partenaires via Codex et l'API.
Un guide de référence sur la programmation GPU appliquée aux systèmes d'apprentissage automatique, publié par MLC.ai.
Les grands acteurs de l'IA multiplient les dons politiques aux États-Unis, soulevant des questions sur leur influence dans la régulation du secteur.
Pour des raisons de sécurité, l'administration américaine aurait contacté OpenAI afin de reporter la mise en ligne de son prochain modèle.
La startup Liva AI, issue de la promotion Summer 2025 de Y Combinator, ouvre un poste clé de direction des opérations.
KRAFTON intègre NVIDIA ACE dans PUBG: BATTLEGROUNDS pour créer un coéquipier IA conversationnel capable de répondre en temps réel à la voix des joueurs.
Un outil open-source permet de router dynamiquement les requêtes vers différents modèles d'IA depuis les interfaces Claude, Codex et Cursor.
NVIDIA détaille comment le format NVFP4 4-bit de l'architecture Blackwell permet de compresser Nemotron Ultra sans sacrifier les performances.
Anthropic publie un nouveau rapport de son Economic Index, analysant les rythmes d'utilisation de l'IA dans l'économie.
Dwarkesh Patel expose le pari des grands labs : entraîner les IA sur des millions de tâches vérifiables via du RL pour atteindre l'AGI.
OpenAI présente GPT-5.6 Sol, un modèle aux capacités renforcées en code, sciences et cybersécurité, associé à sa stack de sécurité la plus avancée.
NVIDIA propose un blueprint open source pour agents IA long-horizon, prêt pour la production sur l'infrastructure cloud d'Oracle.
Mlibc est une implémentation portable de la bibliothèque standard C, conçue pour être indépendante du noyau et facilement intégrable.
Un framework RLAIF appliqué à la recherche d'emploi révèle les failles du reward shaping avec GRPO et propose un correctif déterministe contre le verbatim-copying.
Des chercheurs combinent autoencoder convolutif et transfer learning pour localiser et dimensionner des défauts structurels avec peu de données expérimentales.
Un nouvel algorithme atteint la complexité d'échantillons optimale pour estimer une gaussienne tronquée à un demi-espace inconnu en haute dimension.
Un framework unifié permet d'entraîner des modèles génératifs sur oscillateurs analogiques avec une consommation 100× inférieure au numérique.
Une analyse de plus de 15 000 avis d'utilisateurs sur 59 applications révèle les défaillances récurrentes des chatbots de santé basés sur l'IA.
Selon le New York Times, OpenAI envisagerait de repousser son IPO à l'année prochaine, renonçant à une cotation en 2026.
Une intervention simple et sans entraînement améliore significativement les pipelines de traduction-raisonnement multilingues en préservant le contexte original.
La Banque centrale allemande expérimente les LLM pour automatiser la vérification de l'éligibilité des titres en garantie, atteignant 91 % de précision.
Des chercheurs proposent une taxonomie complète des expressions linguistiques indirectes pour améliorer la détection du langage codé sur les réseaux sociaux.
Un papier théorique établit l'équivalence algorithmique entre gradient equilibrium et approchabilité de Blackwell, unifiant plusieurs cadres d'apprentissage en ligne.
L'EFF alerte sur l'utilisation croissante des lecteurs automatiques de plaques Flock Safety par les forces de l'ordre pour localiser des personnes sans papiers.
Une expérience de compression par overfitting délibéré : un petit Transformer mémorise un fichier CSV entier et le représente en moins de 10 % de sa taille initiale.
Deux régulariseurs de sparsité améliorent la monosémantique des SAEs Top-k sans dégradation de reconstruction, ouvrant la voie à une meilleure interprétabilité des modèles de vision.
Selon un post viral sur Reddit, Washington étudierait un système d'autorisation individuelle pour accéder aux modèles frontier comme GPT-5 ou GPT-6.
Persona.js propose une interface utilisateur pour agents IA en JavaScript pur, avec intégration native du protocole WebMCP, publiée sous licence MIT.
Une étude identifie trois modes d'hallucination dans les world models génératifs et propose des signaux pour les détecter et les corriger.
Une méthode d'exploration autonome d'environnements GUI permet à un modèle 7B de surpasser Qwen2.5-VL-32B sur la planification de tâches.
Un développeur analyse les résultats d'une expérience publique d'adversarial prompting sur son assistant IA juridique, après 2 000 tentatives de jailbreak.
Un auteur examine les résultats perturbants obtenus en générant des livres illustrés pour enfants avec des outils d'IA.
Des chercheurs proposent un cadre de jumeau numérique exploitant les LLMs pour modéliser le comportement conversationnel des personnes âgées et détecter les troubles cognitifs légers.
Une étude approfondie du framework BEACON pour l'entity matching en contexte low-resource, analysant l'impact des choix algorithmiques et de la disponibilité des données.
Un pipeline open-weight combine NER, résolution d'entités Wikidata et un modèle MoE pour construire des knowledge graphs signés à partir de corpus de presse.
Un article pédagogique sur l'inférence de types pour les types enregistrement (records), publié sur le blog Haskell for All.
Une nouvelle architecture neuronale utilise le résidu EDP comme entrée directe pour corriger itérativement ses propres prédictions, sans recourir aux optimiseurs classiques.
Un outil de gestion de connaissances open source conçu dès le départ pour l'IA, en alternative directe à Obsidian et Notion.
Une étude analyse quand la probabilité d'une séquence prédit réellement la bonne réponse dans les LLM, avec des implications concrètes pour le décodage.
Une approche radicalement différente de la génération d'images, fondée sur la dynamique d'oscillateurs couplés plutôt que sur la diffusion ou les transformers.
RiVER entraîne des LLM par reinforcement learning sur des tâches d'optimisation sans ground-truth, via des retours d'exécution continus.
Des chercheurs proposent ArBG, un framework autorégressif inspiré des LLM pour générer des échantillons moléculaires à l'équilibre thermodynamique, surpassant les approches flow-based.
Z.ai publie GLM-5.2 sous licence MIT : un modèle MoE de 753 milliards de paramètres qui s'impose en tête des classements open-weights.
NVIDIA détaille son support bout-en-bout des descriptor heaps Vulkan pour optimiser la liaison des ressources GPU dans les shaders.
Hugging Face simplifie le déploiement d'inférence à grande échelle : un serveur vLLM opérationnel en une ligne de commande via HF Jobs.
Les données internes d'OpenAI révèlent une explosion de l'usage des tokens Codex entre départements, avec des croissances allant de 13x (Juridique) à 56x (Recherche).
Un framework de distillation unifie génération texte-image, édition locale et globale dans un seul modèle sans dégradation mutuelle des capacités.
Des utilisateurs signalent l'apparition de publicités dans les abonnements payants d'OpenAI, soulevant des questions sur le modèle économique de l'entreprise.
Après avoir contraint des ingénieurs à rejoindre son équipe d'entraînement IA, Meta leur offre désormais une porte de sortie partielle.
À Syracuse, des agents fédéraux ont localisé et intimidé une femme pour qu'elle efface un post Instagram signalant une opération de l'ICE.
Le New Yorker analyse la prolifération d'un style visuel généré par IA reconnaissable entre tous, qui colonise progressivement le web.
Un développeur indépendant a intégré un pipeline de rendu GPU à l'éditeur Emacs, explorant les limites du moteur d'affichage historique.
Apple saute une génération de puces Mac haut de gamme et mise directement sur les M7 Pro, Max et Ultra, conçus avec l'IA en tête.
La multiplication des centres de données liés à l'IA exerce une pression inflationniste croissante sur l'économie américaine, selon le WSJ.
Le constructeur automobile américain a dû faire marche arrière sur l'automatisation du contrôle qualité, rappelant des vétérans aux cheveux gris.
Une analyse cartographie les orientations politiques de plusieurs grands modèles d'IA, mettant en lumière des biais systématiques dans leurs réponses.
Un guide technique détaillé et commenté pour maîtriser la boucle d'entraînement PyTorch, de l'initialisation à l'optimisation.
Chez Macy's et d'autres enseignes, l'IA n'est plus un projet pilote isolé mais une philosophie opérationnelle qui restructure les décisions en temps réel.
La startup Besimple AI, issue du programme P25 de Y Combinator, cherche un profil senior pour piloter ses projets data audio.
Microsoft Research présente GCT, une méthode qui traduit les prédictions cérébrales des LLM en explications verbales vérifiables par expérience.
Allen AI analyse en détail les différences de prédiction entre architectures hybrides et transformers classiques au niveau du token.
NVIDIA introduit le support multi-GPU dans TensorRT pour répondre aux besoins croissants des pipelines de génération de médias en production.
Google officialise la nouvelle version de Finance et l'accompagne d'une application Android dédiée, après une phase de test.
La société Aisle a identifié six vulnérabilités dans la bibliothèque curl, dont un bug dont l'origine remonte à plus de deux décennies.
Un essai plaide pour réconcilier les lecteurs et l'IA générative, en la considérant non comme une menace mais comme un nouvel acteur de l'écrit.
Une analyse critique des pratiques de benchmarking dans l'industrie des bases de données, entre biais méthodologiques et marketing trompeur.
H Company publie une analyse technique sur les fuites et gaspillages cachés de VRAM qui plombent les performances des modèles en production.
Un nouveau rapport de recherche d'OpenAI documente comment les agents IA allongent les tâches complexes et élargissent la productivité à travers les métiers.
Des chercheurs identifient les causes des effondrements catastrophiques lors de l'entraînement RL d'agents LLM utilisant des outils, et proposent des signaux superviseurs pour stabiliser l'apprentissage.
Une analyse empirique du protocole ERC-8004 sur Ethereum, BSC et Base révèle des failles profondes dans ses mécanismes de réputation et d'identité.
Un nouveau benchmark contrôlé révèle que les grands modèles multimodaux échouent massivement dès que la complexité spatiale 3D augmente.
Un développeur analyse comment les choix de style de code influencent la consommation de tokens et donc les coûts d'utilisation des LLM.
Un framework post-hoc unifié protège les LLMs de résumé de texte contre les attaques par empoisonnement du fine-tuning, avec 85-92 % de précision de détection.
Une nouvelle approche data-level corrige les biais de classes minoritaires en federated learning sans connaître la distribution globale.
Une étude compare des traductions humaines et LLM de 15 romans récents : les lecteurs préfèrent les versions humaines, sans toujours savoir les distinguer.
Un nouveau benchmark teste la résistance de 18 modèles vision-langage aux corruptions visuelles sur des tâches de raisonnement OCR.
Un LLM peut apprendre puis oublier une règle grammaticale en plein préentraînement, sans que la loss curve ne le signale. Les auteurs baptisent ce phénomène « natural ungrokking ».
Une étude théorique rigoureuse établit les conditions sous lesquelles l'augmentation de la classe minoritaire améliore réellement les métriques de classification.
Une architecture de contrôle externe aux agents IA, vérifiée formellement en Rust, pour pallier les limites des gardes-fous intégrés au runtime.
Un modèle hybride combinant réseaux de neurones informés par la physique et few-shot learning pour prédire l'état de pénétration en soudage laser avec seulement 200 images étiquetées.
Une étude montre que des corrélations statistiquement significatives en sciences sociales computationnelles peuvent être de purs artefacts de l'outil de mesure.
Un protocole d'investigation propose d'aller au-delà de la détection de comportements suspects pour établir si un modèle d'IA est réellement mal aligné.
Un framework UDA permet de transférer des modèles de classification entre soudage TIG et laser sans réétiquetage, avec plus de 80 % de précision cross-procédés.
Une étude révèle qu'aucun des 18 grands modèles multimodaux testés n'est invariant à l'ordre de présentation des données, avec des taux d'inversion atteignant 50 %.
Des chercheurs montrent que le fine-tuning par RL produit implicitement un signal d'évaluation step-level performant, sans entraîner de reward model dédié.
Un projet expérimental exploite la Bible comme corpus de récupération pour un système RAG, interrogeant les Écritures à la manière d'une base de connaissances vectorielle.
Une étude révèle que les systèmes vocaux IA ignorent les émotions dans la voix, même quand ils les perçoivent correctement.
Des chercheurs montrent que l'auto-distillation avec démonstrations améliore le pass@1 mais détériore significativement la diversité des sorties et les performances en distribution.
Le fabricant de puces annonce le rachat de Modular, startup spécialisée dans l'infrastructure d'IA, dans une opération attendue pour 2026.
Un nouveau benchmark teste la capacité des LLMs à reverse-engineer des politiques de jeu adversariales sous forme de code exécutable, à partir de simples observations comportementales.
OpenAI dévoile sa puce Jalapeño, Databricks mise sur Omnigent et les architectures d'orchestration d'agents prolifèrent dans l'écosystème.
Anthropic affirme qu'Alibaba aurait contourné ses conditions d'utilisation pour extraire des capacités de son modèle Claude à des fins non autorisées.
Un nouveau framework en deux étapes pré-entraîne le module d'action d'un modèle VLA avec des priors de mouvement avant l'alignement cross-modal.
Un fil Hacker News interroge la communauté sur la place de l'apprentissage du code pour les novices face à la montée des outils IA.
Face aux enjeux d'alignement et d'éthique, OpenAI, Anthropic et leurs concurrents se tournent vers la philosophie académique.
La chute des actions technologiques relance le débat sur la soutenabilité des valorisations liées à l'IA et sur le risque d'une bulle spéculative.
Des chercheurs démontrent qu'il est possible d'extraire des informations sur les données d'entraînement de modèles d'IA médicale, soulevant de sérieuses questions de confidentialité.
Nvidia dévoile une architecture de refroidissement liquide à haute température qui permettrait d'éliminer presque totalement l'usage de l'eau dans ses « AI factories ».
Alors que les grands modèles propriétaires restent inaccessibles à beaucoup, l'open source apparaît comme la seule option réaliste pour les pays hors Occident.
Google annonce la fonctionnalité « computer use » pour Gemini 3.5 Flash, permettant au modèle d'interagir directement avec des interfaces graphiques.
peerd propose d'exécuter des agents IA directement dans le navigateur, sans serveur ni infrastructure externe.
RubyLLM unifie l'accès aux principaux modèles d'IA (OpenAI, Anthropic, etc.) dans un framework Ruby élégant et cohérent.
Hugging Face introduit un classement dédié à l'évaluation des systèmes de reconnaissance vocale automatique sur des données audio du monde réel.
OpenAI franchit une étape stratégique majeure en présentant son premier chip maison, développé en partenariat avec Broadcom.
Les cofondateurs de Databricks détaillent Omnigent, Lakebase et leur vision d'un OS données-IA pour l'ère des agents.
Microsoft Research présente Talos, un système automatisé qui réexamine en continu les données génomiques pour débloquer des diagnostics impossibles lors du premier test.
Google DeepMind lance la capacité de contrôle d'ordinateur pour Gemini 2.5 Flash, permettant au modèle d'interagir directement avec des interfaces graphiques.
NVIDIA détaille comment optimiser le BEV pooling sur ses GPU pour les véhicules autonomes et la robotique spatiale.
OpenAI et Broadcom annoncent conjointement Jalapeño, un chip IA personnalisé conçu spécifiquement pour l'inférence de grands modèles de langage.
NVIDIA et Hugging Face présentent NeMo AutoModel, une solution pour optimiser et accélérer le fine-tuning de modèles Transformers à grande échelle.
Mistral AI annonce de nouvelles options de configuration pour les connecteurs, offrant aux développeurs un contrôle plus fin sur l'intégration des sources de données.
Un conflit entre la NSA et Anthropic aurait conduit à la coupure de l'accès de l'agence à un modèle d'IA jugé stratégique.
Un sondage Gallup révèle que très peu d'Américains recourent à l'IA pour consommer l'actualité, malgré l'essor des assistants conversationnels.
Un auteur livre une analyse décalée et critique des discours dominants sur l'IA, revendiquant une perspective singulière sur le sujet.
Le cofondateur de LinkedIn tacle Elon Musk sur ses projets IA et livre son analyse sur OpenAI, Anthropic et la génération Z.
Anthropic lance Claude Tag, une nouvelle interface pour Claude et Claude Code directement dans Slack, marquant une évolution majeure vers les agents asynchrones en entreprise.
Les modèles d'IA butent sur un goulot d'étranglement : accéder à des données web dynamiques, non structurées et en temps réel à grande échelle.
Krea publie son rapport technique sur Krea 2, son modèle de génération d'images et vidéos, avec architecture et résultats détaillés.
Haystack, le framework Python de deepset, propose une infrastructure modulaire pour construire des pipelines RAG et des agents IA prêts pour la production.
La restructuration massive de l'équipe IA de Meta aurait provoqué chaos et démotivation en interne, selon des témoignages recueillis par Inc.
Une méthode basée sur les gradients couche par couche permet de prédire les hallucinations des LLMs dès un seul passage forward-backward.
OrbitForge convertit une vidéo générée par LLM en scène 3D complète via Gaussian Splatting, sans fine-tuning spécifique à la tâche.
Un nouveau benchmark évalue la capacité des Video-LLMs à justifier leurs réponses par des preuves temporelles précises, révélant des lacunes même chez les modèles propriétaires.
Des chercheurs utilisent GPT-5.4-mini pour explorer automatiquement l'espace des codes correcteurs d'erreurs quantiques via une grammaire algébrique.
Un framework sans fine-tuning qui améliore la localisation des bugs dans les dépôts de code et booste les agents de réparation de +5,95 pp sur SWE-Bench.
Un corpus gold-standard de 32 354 phrases annotées manuellement pour le marquage morpho-syntaxique du marathi, langue encore très sous-dotée en ressources NLP.
Une nouvelle méthode, Bi-CFM, permet d'inférer les conditions initiales de systèmes chaotiques depuis leurs états finaux, avec une accélération de plus de deux ordres de grandeur.
Des chercheurs montrent que filtrer les données d'entraînement par qualité surpasse l'échantillonnage aléatoire pour la résumé de longs documents scientifiques.
Une analyse critique déconstruit sept définitions de la causalité réelle proposées par Andreas & Günther, montrant qu'elles convergent malgré leur prétendue opposition.
Une étude sur 49 développeurs montre que les LLM comme GitHub Copilot peinent à évaluer correctement les exigences HIPAA, malgré une satisfaction utilisateur élevée.
Les marchés boursiers technologiques accusent le coup alors que les inquiétudes autour d'une bulle spéculative liée à l'IA s'intensifient.
Une étude sur la fiabilité des graders automatisés pour évaluer des systèmes agentiques d'analyse de données, avec une cascade humain-IA à trois niveaux.
Un outil de visualisation interactive qui cartographie les dépendances entre l'essor de l'IA et les limites énergétiques mondiales.
Des chercheurs de Stanford alertent sur les risques de biais raciaux et d'exclusion systématique liés aux outils algorithmiques de recrutement.
Un nouveau cadre MTO automatise le choix des objectifs d'entraînement pour les LM encodeur-décodeur, avec des gains de +120 % en few-shot.
Un cadre théorique pour certifier localement les capacités d'agents IA généraux, là où les garanties uniformes classiques échouent.
Un framework de Chain-of-Thought visuel latent améliore le suivi des contraintes structurelles (comptage, relations spatiales, attributs) en génération texte-image.
Un développeur publie Y, une app desktop construite avec Electron qui intègre un agent de codage entièrement personnalisable.
Une étude compare le Hartley Neural Operator (HNO) au FNO classique et montre que le meilleur choix de base spectrale dépend du type d'opérateur différentiel.
Une vague de ventes sur les actions liées à l'IA frappe simultanément les bourses américaines et asiatiques, ravivant les inquiétudes sur les valorisations du secteur.
Comment évaluer des systèmes de communication alternative augmentée dopés à l'IA, quand les utilisateurs sont des êtres pluriels aux besoins multidimensionnels ?
Halo propose un outil open-source de débogage en local pour inspecter et analyser les traces d'exécution des agents IA, basé sur RLM.
Un nouveau framework image-vers-3DGS lève deux verrous structurels majeurs grâce à des latents alignés sur la diffusion et un transformer multimodal sparse.
Un pipeline open-source de curation de données pour entraîner des modèles agentiques polyvalents, avec 100 000 exemples et +3,9 pts sur 7 benchmarks.
Un développeur découvre un contournement inattendu pour éliminer le lag du curseur sur MacBook Neo : capturer un pixel de l'écran en boucle.
Un nouveau benchmark open-source vise à standardiser l'évaluation des modèles de diffusion basés sur des Transformers, au-delà des métriques classiques.
Des chercheurs établissent des bornes serrées pour l'erreur d'optimisation du dernier itéré de SsGM, résolvant un problème ouvert depuis 2020.
Un framework permet aux modèles vision-langage-action d'apprendre de nouvelles compétences robotiques sans démonstrations humaines, grâce à un volant de données guidé par VLM.
L'équipe Qwen présente AgentWorld, un cadre de world models en langage naturel destiné à entraîner et évaluer des agents IA généraux.
OpenAI s'implique dans la fondation Appia pour développer des cadres d'évaluation, des pratiques de sécurité et une coopération internationale autour de l'IA.
Matt Garman, CEO d'AWS, défend le recrutement massif de jeunes talents malgré l'essor de l'IA — et s'oppose aux thèses sur la destruction d'emplois.
Un utilisateur signale sur Hacker News avoir été banni de Claude Code sans motif clair, soulevant des questions sur la politique d'accès d'Anthropic.
Une analyse technique des comportements d'IA dans Elden Ring, révélant des systèmes étonnamment simples derrière une apparence de complexité.
Les coûts d'inférence et d'entraînement de l'IA restent hors de portée pour une large partie des utilisateurs potentiels, soulevant des questions sur la viabilité économique du secteur.
Anthropic signale un incident en cours affectant plusieurs de ses modèles Claude avec un taux d'erreurs anormalement élevé.
NVIDIA présente un toolkit d'agents IA spécialisés pour la recherche en sciences du vivant, capable de lire des articles, générer des hypothèses et itérer sur des résultats expérimentaux.
NVIDIA présente DFlash, une technique de décodage spéculatif optimisée pour ses GPU Blackwell, promettant des gains d'inférence LLM allant jusqu'à 15x.
Modal lance Auto Endpoints, une solution d'inférence managée qui promet performances optimales et maîtrise totale du déploiement.
Le laboratoire français met à jour son moteur OCR, promettant une meilleure précision sur documents complexes et multilingues.
Anthropic dévoile Claude Tag, une nouvelle initiative autour de son assistant IA Claude, dont les détails restent à préciser.
Hugging Face explore une API navigateur expérimentale permettant de partager des modèles IA entre origines web, réduisant la duplication de cache.
GPT-5 Pro a permis à l'immunologiste Derya Unutmaz d'élucider un phénomène inexpliqué sur les lymphocytes T, ouvrant des pistes pour la recherche en oncologie et en autoimmunité.
NVIDIA détaille comment l'optimisation conjointe de l'inférence et de l'entraînement permet de réduire le coût énergétique par token dans les AI factories.
Un développeur indépendant présente un moteur de mémoire paramétrique pour agents IA, conçu en dix jours, et cherche des cas d'usage concrets pour en démontrer la valeur.
Un développeur a laissé un agent IA jouer à Civilization — avec des résultats surprenants, dont la construction de l'arme atomique.
Comment adapter le framework Team Topologies à l'ère des agents IA ? Une analyse des responsabilités organisationnelles au sein des plateformes agentiques.
Hugging Face explique comment des modèles tournant en local ont été utilisés pour automatiser le triage des pull requests sur un dépôt open source, sans coût cloud.
H Company expose sa vision d'une entreprise entièrement pilotée par des agents IA autonomes, et l'architecture technique qu'elle entend bâtir pour y parvenir.
Un reportage au cœur d'ASML, le fabricant néerlandais dont les machines de lithographie conditionnent toute la production mondiale de semi-conducteurs.
Hugging Face décrit son pipeline de release automatisé pour la librairie huggingface_hub, mêlant outils open-source et supervision humaine.
Un projet expérimental combine automates cellulaires et réseaux de neurones pour simuler des comportements émergents à base de particules.
La plateforme de voyages Omio s'appuie sur les API OpenAI pour développer des expériences conversationnelles et accélérer sa transformation en entreprise AI-native.
IBM Research publie CUGA, un framework léger pour développer des applications agentiques réelles, accompagné de plus de vingt exemples fonctionnels.
Les agences Five Eyes publient une déclaration commune sur l'évolution des menaces cyber liées à l'IA et appellent les décideurs à prendre des mesures urgentes.
Des chercheurs proposent QoR-compact, un questionnaire réduit à 5 items pour améliorer l'adhérence des patients dans les dispositifs de télésurveillance post-chirurgicale.
Une analyse critique des scores GPTs are GPTs de 2023, devenus une référence centrale dans le débat sur l'avenir du travail, malgré leurs limites méthodologiques.
Des chercheurs montrent que l'optimiseur Muown opère sur une géométrie riemannienne et proposent AngularMuown, une version améliorée avec un multiplicateur angulaire explicite.
Une méthode simple pour transformer une récompense sparse en signal dense, en entraînant un discriminateur à distinguer épisodes réussis et échoués.
Un système qui traduit les traces comportementales en préférences génératives pour produire du contenu multimodal personnalisé sans pool d'items préexistant.
Un cadre général pour approximer séquentiellement des fonctions sur des séquences peu variables, avec des bornes de coût plus fines que l'état de l'art.
Un nouveau benchmark construit sur des sessions de travail réelles mesure les capacités des agents IA en contexte professionnel — avec des scores encore très limités.
Une nouvelle formulation du design expérimental bayésien réduit la complexité des objectifs et s'adapte naturellement aux tâches aval.
Pour la première fois en Angleterre, une IA juridique a aidé à gagner une affaire devant les tribunaux, marquant un tournant pour le droit automatisé.
Une étude théorique formelle démontre l'existence de limites irréductibles aux LLMs pilotés par prompt, indépendamment de la taille des modèles ou des données.
Une nouvelle approche architecturale réduit progressivement la largeur des MLP en profondeur et améliore la perplexité sans coût supplémentaire.
Un benchmark systématique évalue l'optimisation de prompts système dans des architectures multi-agents LLM variées, révélant gains et limites.
Une étude teste la capacité des LLMs à reconnaître qu'ils ont été manipulés par un préfill adversarial — les résultats révèlent des limites profondes.
Une équipe propose une approche sans arithmétique pour entraîner les LLMs à déduire des tables de vérité dans des espaces combinatoires explosifs.
Un cadre de décision clinique qui combine PHQ-9, GAD-7, évaluation cognitive et profilage de la personnalité pour des classifications interprétables.
Unsloth publie un guide pratique pour faire tourner le modèle GLM-5.2 en local, avec optimisations mémoire et vitesse d'inférence.
AWS introduit les MicroVMs dans Lambda pour isoler l'exécution du code généré par les utilisateurs ou par des agents IA, renforçant la sécurité des environnements serverless.
Un programme d'entraînement d'IA de Meta capturant l'activité des employés a été mis en pause après qu'une fuite interne a exposé son existence.
AdamW reste l'optimiseur de référence pour les LLMs, mais sa convergence sous bruit à queue lourde — pourtant omniprésent en pré-entraînement — n'est pas prouvée.
Des chercheurs proposent une méthode d'entraînement par RL pour doter les modèles multimodaux d'un raisonnement adaptatif alternant langage naturel et code.
Canyon dévoile un casque équipé d'un HUD intégré censé améliorer la sécurité des cyclistes sur route en affichant des données en temps réel.
Un pipeline d'apprentissage qui permet à un robot humanoïde de manipuler des objets avec précision sans s'arrêter de marcher.
Une méthode pour explorer des galeries d'images générées selon des axes de variation sémantiques structurés, pilotés par un workflow agentique.
Un modèle de 3 milliards de paramètres rivalise avec des géants via une combinaison inédite de fine-tuning supervisé et d'optimisation GRPO.
Les jailbreaks et injections de prompts indirectes reviennent au centre du débat sécurité IA après les contrôles à l'export américains sur Mythos et Fable.
Une méthode d'entraînement combine YaRN et encodages positionnels aléatoires pour étendre la fenêtre de contexte des LLM bien au-delà de leur données d'entraînement.
NVIDIA détaille la trajectoire des telcos vers l'autonomie réseau, entre niveaux 2-3 actuels et l'ambition des niveaux 4-5 du TM Forum.
Avec un troisième contrat de location de GPU signé avec Reflection AI, SpaceX cumule désormais 2,32 Md$ par mois de revenus cloud, soit 28 Md$ annualisés.
AutoDex automatise entièrement la collecte de données de saisie robotique en conditions réelles, multipliant par 4,8 le débit par rapport à la téléopération humaine.
Simon Willison explique comment il a porté le modèle d'inpainting Moebius 0.2B pour qu'il tourne en WebGPU dans un navigateur, avec l'aide de Claude Code.
Le cabinet de conseil Bain & Company utilise des outils d'IA générative pour répliquer rapidement des logiciels propriétaires avant d'acquérir des entreprises tech.
AMD déploie FidelityFX Super Resolution 4.1 pour les GPU RX 7000 (RDNA 3), élargissant l'accès à son upscaling ML au-delà des seules RX 9000.
Le spécialiste des puces d'inférence IA Groq boucle un nouveau tour de table massif pour accélérer le déploiement de son cloud d'inférence.
Le PDG de Microsoft appelle à encadrer la concentration du pouvoir économique entre les mains des grandes entreprises d'IA.
Une extension open-source qui utilise l'IA pour produire des sélecteurs CSS robustes, résistants aux changements de DOM.
Une analyse remet en question la nature réelle du contenu affiché lors du mode de réflexion étendue de Claude Code : s'agit-il d'une véritable pensée ou d'une reconstruction ?
NVIDIA présente Halos, une architecture de sécurité complète conçue pour les robots autonomes évoluant dans des environnements non structurés aux côtés des humains.
Jason Liu partage ses méthodes pour tirer le meilleur de Codex sur des tâches étendues : préservation du contexte, gestion de projets complexes et continuité au-delà d'un seul prompt.
OpenAI dévoile Daybreak, une suite incluant Codex Security et GPT-5.5-Cyber pour détecter, valider et corriger les vulnérabilités en entreprise.
NVIDIA présente DAQIRI, un framework permettant d'intégrer l'inférence IA directement dans les pipelines d'acquisition de données scientifiques à haute fréquence.
Un projet open-source propose de repenser le contrôle de version en partant du principe que les agents IA sont les principaux utilisateurs.
Un modèle d'IA jugé dangereux pour la cybersécurité mondiale, des contrôles à l'export imposés en urgence : l'affaire Mythos/Fable décryptée.
Z.ai a lancé GLM-5.2 en discret un samedi de juin, mais ce modèle marque selon Nathan Lambert une véritable rupture pour les agents open-weights.
OpenAI dévoile Patch the Planet, un programme Daybreak qui aide les mainteneurs open source à détecter et corriger des vulnérabilités grâce à l'IA.
PaddlePaddle publie PP-OCRv6 sur Hugging Face, une suite OCR multilingue couvrant 50 langues avec des modèles allant de 1,5 à 34,5 millions de paramètres.
NVIDIA introduit un nouveau groupe de fonctionnalités dans ses CUDA Core Compute Libraries pour moderniser le développement C++ sur GPU.
Des employés de Meta s'organisent contre l'utilisation de leurs données personnelles pour entraîner des modèles de machine learning.
Un sondage révèle que l'opposition aux infrastructures physiques de l'IA monte en puissance, faisant des data centers le nouveau visage de la contestation.
Jürgen Schmidhuber retrace les origines du boom de l'IA moderne jusqu'aux travaux fondateurs réalisés à Munich en 1991.
Un défaut de journalisation dans l'outil Codex d'OpenAI risque d'écrire des volumes massifs de données sur les disques locaux.
H Company lance HoloDesktop CLI, un outil permettant de contrôler un desktop virtuel depuis la ligne de commande pour les agents IA.
Un projet indépendant transforme les discussions HN autour de jeux vidéo en courtes vidéos documentaires générées par IA.
La première release candidate de sqlite-utils v4 intègre un système de migrations inspiré du package sqlite-migrate et apporte les transactions imbriquées.
Employés et syndicats émergents contestent de l'intérieur les choix stratégiques des grandes entreprises tech en matière d'IA.
Un développeur remplace son tuteur humain par un outil basé sur LLM pour apprendre le français, et compare les résultats.
Crespo propose de fournir aux LLMs des représentations structurées de l'AST via Tree-sitter plutôt que le code source brut, pour améliorer la compréhension du code.
Un outil open-source qui dote Claude Code d'une mémoire persistante locale, permettant de retrouver le contexte d'un projet sans le ressaisir.
Un développeur obtient de bons résultats en fine-tunant Qwen 3:0.6B en local pour classifier automatiquement des questions.
Un retour d'expérience pratique sur les erreurs courantes dans la conception des compétences d'agents IA et comment les corriger.
Samsung étend ChatGPT Enterprise et Codex à l'ensemble de ses effectifs mondiaux, dans l'un des plus grands déploiements enterprise d'OpenAI.
Apertus se positionne comme un modèle de fondation ouvert, conçu pour répondre aux enjeux de souveraineté numérique des États et organisations.
Sakana AI dévoile Fugu, un LLM optimisé pour le japonais et publié en open-weights, renforçant l'écosystème IA nippon.
Le directeur de la NSA aurait déclaré que l'agent IA Mythos a réussi à pénétrer la quasi-totalité des systèmes classifiés de l'agence en quelques heures.
Face à l'hégémonie américaine sur l'IA sous l'ère Trump, la France dispose-t-elle encore des leviers pour préserver sa souveraineté numérique ?
Le funnel de recrutement se brise aux deux extrémités : les candidatures générées par IA saturent les RH, pendant que les talents fuient des processus jugés déshumanisants.
Un appel à l'honnêteté intellectuelle face à la montée de l'usage de l'IA en production écrite : quand déléguer à un LLM devient une forme de tromperie.
La startup Wildcard, issue de la promotion hiver 2025 de Y Combinator, ouvre un poste fondateur d'ingénieur en machine learning appliqué.
Latent Space propose une remise réservée à ses abonnés payants pour la conférence AI Engineer, valable jusqu'au lundi suivant l'annonce.
Un développeur publie Pulse, un dashboard permettant d'approuver les appels d'outils de Claude Code directement depuis son smartphone.
Anthropic déploie un système de vérification d'identité sur Claude, une étape notable vers plus de contrôle des accès sur la plateforme.
L'usage passif des LLM dans la rédaction professionnelle devient une habitude préoccupante qui érode la responsabilité éditoriale.
Domphy propose une approche minimaliste pour construire des interfaces d'outils, dont les sorties peuvent être corrigées directement par un agent IA.
Une analyse chiffrée des coûts réels de l'inférence LLM à l'échelle, réalisée avec des calculs d'ordre de grandeur simples.
ClickHouse publie un outil de benchmark standardisé pour comparer les performances des services PostgreSQL managés.
Une analyse comparative entre GLM-4 et Claude Opus montre que les modèles open-source atteignent désormais le niveau des meilleurs modèles propriétaires.
Le trading firm Jane Street, réputé pour sa discrétion, sort de l'ombre grâce à ses investissements massifs dans l'intelligence artificielle.
Un outil open-source en Go orchestre des agents de codage via Git worktrees, avec traçabilité des tâches et gestion des preuves d'exécution.
Une étude britannique révèle que les mises en garde sur la dangerosité des SUV pour les piétons n'influencent pas les intentions d'achat.
Face aux dérives de l'Online Safety Act britannique, un utilisateur envisage de faire transiter son trafic réseau par des nœuds étrangers.
Des puces obsolètes mais irremplaçables : comment l'industrie de défense survit grâce à des composants semi-conducteurs hors d'âge.
Une analyse de la tendance des modèles d'IA à enchaîner les explications en cascade, et de ce que cela révèle sur leur fonctionnement.
Martin Fowler publie un retour d'expérience de Bayer sur l'architecture de systèmes LLM agentiques robustes en production.
Un développeur expose les critères qui le poussent à refuser du code IA correct techniquement, mais inacceptable en pratique.
Une analyse déconstruit la récupération abusive d'une étude Stanford sur l'impact de l'IA sur l'embauche, instrumentalisée par des coachs pour vendre leurs services.
L'ouvrage « The Dictionary of Obscure Sorrows » de John Koenig aurait été plagié intégralement par une agence, qui l'aurait retraité via IA pour le republier à son nom.
Cloudflare introduit des comptes éphémères permettant aux agents IA d'agir de manière autonome sur le web sans identité persistante.
Claude Guillemot, l'un des fondateurs du géant du jeu vidéo Ubisoft, a perdu la vie dans un accident d'avion.
Un partenariat entre Anthropic et SK Telecom soulève des questions sur les contrôles à l'exportation de technologies d'IA sensibles.
La multiplication des modèles, modes d'inférence et compromis techniques rend le choix et l'usage des LLM bien plus difficile qu'avant.
Un bulletin léger : GLM 5.2 continue de dominer les discussions, et des offres de billets pour l'AIEWF 2026 sont annoncées.
Le patron de l'ICO, l'autorité britannique de régulation des données et de l'IA, quitte ses fonctions après une controverse liée à des propos jugés inappropriés.
La facture de l'IA pèse sur les budgets : des entreprises revoient à la baisse leurs déploiements pour maîtriser leurs dépenses.
Un développeur publie NanoEuler, un LLM de taille GPT-2 écrit intégralement en C et CUDA, sans dépendances externes.
Un développeur détaille comment isoler les secrets sensibles des agents IA et des installations npm grâce à une approche air gap.
Le projet de film biographique sur le PDG d'OpenAI, en développement chez Amazon, aurait été stoppé peu après l'annonce d'un accord commercial entre les deux entreprises.
Une comparaison directe entre GPT-5.5 et GLM-5.2 révèle un taux d'hallucination significativement plus élevé pour le modèle d'OpenAI.
La plateforme d'analyse Hex détaille la création d'un environnement de test dédié à l'évaluation rigoureuse des agents IA opérant sur des données.
Aikido lance une fonctionnalité d'audit de code par IA capable de repérer des failles de sécurité cachées que les scanners traditionnels manquent.
Un benchmark met en compétition deux modèles chinois sur des tâches de codage autonome, révélant leurs forces et faiblesses respectives.
Oslo restreint drastiquement l'usage de l'IA en primaire, invoquant des risques pour le développement cognitif et l'apprentissage des enfants.
Une application web propose de visualiser une centaine de datasets publics sur un globe 3D interactif et animé en temps réel.
Anthropic met en pause son modèle de facturation par token pour le SDK Claude Agent, après des retours négatifs des développeurs.
Longtemps sceptique, le responsable du noyau Linux admet que les rapports de bugs générés par IA ont gagné en qualité et signalent désormais de vraies régressions.
Le co-créateur d'AlphaFold et prix Nobel de chimie 2024 rejoint Anthropic, signal fort pour la stratégie scientifique de la startup.
Une étude publiée dans Nature s'intéresse aux effets cognitifs de l'usage intensif de l'IA sur les capacités humaines.
Un chercheur non professionnel affirme avoir percé le mystère du linéaire A, l'une des écritures antiques les plus résistantes au déchiffrement.
Kyutai met en évidence une part de randomness non documentée dans le calcul du FID, métrique de référence pour évaluer les modèles génératifs d'images.
L'EFF soutient une nouvelle proposition législative américaine destinée à protéger la liberté d'expression en ligne contre les ingérences gouvernementales.