Toutes les news taguées avec ce sujet.
Le modèle de transcription de Microsoft surpasse ses rivaux en coût et en rapidité.
Un nouvel algorithme combine la vitesse du batching de WhisperX et la cohérence contextuelle de Whisper standard pour la transcription longue durée.
Google enrichit sa famille Gemini avec un modèle spécialisé dans la transcription audio en texte.
Google DeepMind dévoile un nouveau modèle de speech-to-text intégré à la famille Gemini, promettant une transcription plus précise et contextuelle.