Toutes les news taguées avec ce sujet.
Une étude révèle que les prédicteurs MOS et les juges Audio-LLM échouent à capturer la richesse des erreurs linguistiques dans la synthèse vocale.