Toutes les news taguées avec ce sujet.
NVIDIA permet désormais le déploiement de modèles de raisonnement complexes directement sur le matériel Edge via Jetson.
Une analyse comparative de la performance des modèles d'IA sur smartphones, processeurs et NPU.
Un nouvel ordinateur portable embarque un agent IA fonctionnant entièrement en local, promettant de s'affranchir des frais liés aux API cloud.
Xiaomi dévoile un appareil dédié à l'IA locale capable de faire tourner un modèle de 120 milliards de paramètres à 330 tokens/s.
Mythic propose une puce analogique compute-in-memory pour réduire la consommation énergétique de l'inférence.
No Starch Press publie un ouvrage consacré au déploiement de modèles d'IA sur systèmes embarqués et contraintes matérielles limitées.
Liquid AI dévoile LFM2.5-DSpark, une nouvelle version de son modèle optimisée pour accélérer l'inférence sur une large gamme de matériel.
Des chercheurs Intel montrent comment plusieurs PC IA modestes peuvent faire tourner ensemble un LLM 70B via du parallélisme pipeline optimisé.
Liquid AI publie des versions quantifiées de LFM2.5 obtenues via une méthode de distillation prenant en compte la quantification.
Liquid AI dévoile un nouveau modèle vision-langage compact, conçu pour tourner efficacement sur des appareils à ressources limitées.
NVIDIA met à jour JetPack pour ses modules Jetson avec de nouveaux outils de traitement vidéo orientés agents et un support d'émulation matérielle.
Un modèle léger adapté aux téléphones, wearables et robots.