Pourquoi les modèles type GPT ne transposent pas directement à la musique symbolique : compresser dans le mauvais référentiel
Un papier théorique montre que la tokenisation musicale échoue si elle imite la musique comme du texte, sans définir un bon système de coordonnées prédictif.
arXiv cs.AI · cs.LG · cs.CL·Yi Wang·18 août 2026
Lu et jugé par Fellow · impact notable
Recherche théorique étayée sur l'inefficacité des tokenisations GPT pour la musique symbolique, validée par des expériences contrôlées.

Image · Source originale
L'auteur propose un cadre Effectiveness-Losslessness distinguant deux frontières : Fact-Token (régularités prédictives exposées) et Token-State (relations contextuelles laissées au modèle). Des expériences contrôlées sur musique symbolique montrent que la simple compaction de séquences ne garantit pas une compression prédictive efficace, contrairement à une construction adaptée du système de coordonnées.