Show HN : faire tourner un Qwen 80B dans 4,3 Go de RAM sur Mac, et un 35B sur iPhone
Un projet open source promet d'exécuter des LLM massifs sur du matériel Apple grâce à une gestion mémoire optimisée, sans exploser la RAM disponible.
Hacker News (filtré IA)·@leonickson·3 août 2026

Image · Source originale
Swiftlet est un projet publié sur GitHub qui permet de faire tourner un modèle Qwen de 80 milliards de paramètres avec seulement 4,3 Go de RAM sur Mac, et une version 35B sur iPhone. L'approche repose vraisemblablement sur des techniques d'offloading ou de quantification agressive pour réduire l'empreinte mémoire.