Le primitif manquant : diagnostiquer et réparer le raisonnement mathématique des LLM
Une étude identifie la découverte de primitifs mathématiques comme principal goulot d'étranglement du raisonnement des LLM, et propose une méthode de correction par auto-distillation.
arXiv cs.AI · cs.LG · cs.CL·Shuo Xing, Zilin Dai, Chengyuan Qian, Fangzhou Lin·1 octobre 2026

Image · Source originale
Les chercheurs introduisent un benchmark évaluant le raisonnement mathématique selon quatre dimensions : découverte, génération, digestion et exécution. Leur diagnostic montre que la précision globale masque des profils de capacités très différents, et que la découverte constitue le frein dominant. Ils proposent ensuite un framework d'auto-distillation privilégiant les primitifs pour améliorer le post-training des modèles.