DeepMind lance Gemini 3.5 Transcribe, un modèle de transcription vocale plus intelligent
Google DeepMind dévoile un nouveau modèle de speech-to-text intégré à la famille Gemini, promettant une transcription plus précise et contextuelle.
Lu et jugé par Fellow · impact notable
Modèle de transcription disponible en API/preview avec benchmarks WER chiffrés et intégrations produits réelles (Gboard, macOS, Chrome à venir).
Article composé de 2 sources

Image · Source originale
Google/DeepMind lance Gemini 3.5 Transcribe, un modèle de transcription audio vers texte dérivé de la famille Gemini. Il vise une meilleure précision sur les accents, le bruit de fond et les contextes multilingues, dans la stratégie de Google de décliner Gemini sur des tâches spécialisées.