Toutes les news taguées avec ce sujet.
Un framework léger en deux étapes corrige la dérive des timestamps dans les modèles ASR autoregressifs sur les longues plages non-vocales, sans dégrader les autres capacités.
Hugging Face introduit un classement dédié à l'évaluation des systèmes de reconnaissance vocale automatique sur des données audio du monde réel.