Toutes les news taguées avec ce sujet.
Le projet Debian soumet au vote trois résolutions encadrant l'utilisation et l'intégration des modèles de langage au sein de la distribution.
Dan Luu passe au crible les pratiques de test des agents de codage IA et interroge la fiabilité des benchmarks LLM actuels.
Les étapes clés pour intégrer les équipes techniques d'OpenAI ou Anthropic selon un chercheur.
Une école de droit américaine publie une stratégie pour intégrer l'IA dans la formation juridique face aux bouleversements du secteur.
Un projet démontre la faisabilité de faire tourner un petit modèle LLM sur ESP32, un microcontrôleur à très bas coût.
Une méthode de prompting vise à corriger les tendances anthropomorphiques des modèles de langage.
Une discussion technique explore ce que recouvre réellement le paramètre 'effort' proposé par certains fournisseurs de LLM.
Opus 5 et Fable 5 nécessitent 80 % moins d'instructions système.
Un partenariat pour une inférence ultra-rapide à haut débit.
Un nouveau modèle vision-langage de 3 milliards de paramètres, optimisé pour l'instruction et disponible en open-weights.
Anthropic détaille les évolutions majeures de son modèle phare.
Le nouveau modèle instructif Kimi-K2-Instruct-0905 est désormais disponible sur Hugging Face.
Le nouveau modèle phare d'Anthropic promet des performances supérieures en raisonnement et en codage.
Le laboratoire chinois Moonshot AI publie Kimi K2.6 sur Hugging Face, une mise à jour de sa famille de modèles open-weights.
Comment intégrer concrètement les grands modèles de langage sans s'égarer dans l'hype.
L'hébergeur allemand Hetzner, connu pour ses serveurs bon marché, préparerait un service d'inférence de modèles de langage.
Un framework transforme des cas cliniques en jeux interactifs structurés via une architecture à double moteur.
Le cofondateur de Poolside détaille sa Model Factory, capable de sortir un modèle du pré-entraînement au lancement en huit semaines.
Trois nouveaux modèles viennent étoffer la gamme Gemini, avec des variantes optimisées vitesse, coût et cybersécurité.
Une fenêtre glissante appliquée uniquement au module de prédiction multi-token accélère le décodage spéculatif sans perte de qualité sur des contextes massifs.
Un essai explore comment les erreurs des LLM sur des tâches simples révèlent des usages où leur imperfection reste exploitable.
Un modèle 48B en open-weights optimisé pour l'efficience.
Moonshot AI publie un modèle d'instruction de 48 milliards de paramètres sur Hugging Face.
Le laboratoire chinois Moonshot AI met en ligne la version de base de son modèle Kimi K2, disponible en téléchargement.
Le laboratoire chinois Moonshot AI publie une nouvelle version de son modèle Kimi orientée raisonnement long, disponible en poids ouverts.
Nouveau modèle open-weights de 104B paramètres optimisé pour l'instruction.
Une analyse déconstruit les critiques visant l'open source dans le secteur de l'intelligence artificielle.
Un nouveau modèle open-weights performant adapté aux tâches complexes et à l'analyse longue.
Un billet philosophique plaide pour l'exclusion des textes générés par IA des publications académiques, questionnant la valeur épistémique du contenu produit par les LLM.
Framework ajoute une option haut de gamme à son mini-PC Desktop, pensée pour l'inférence de modèles locaux volumineux.