Publier
Retour aux actualités
InternationalGénération NT

Meta lance Muse Voice Transcribe, un modèle d'écoute en temps réel

Meta a lancé Muse Voice Transcribe, un modèle d'écoute en temps réal pour transcrire des conversations en plusieurs langues et locuteurs.

02 sept. 2026 Jérôme G.

Muse Voice Transcribe est le premier modèle de perception audio en temps réel de Meta, capable de traiter des conversations complexes en direct. Il est disponible via l'API de Meta, l'application Meta AI pour Mac et Muse Code. Le modèle autorégressif fonctionne en segments de 80 ms et utilise un système de délai adaptatif pour optimiser la précision. Mark Zuckerberg a mentionné que le modèle ajuste sa vitesse en fonction des mots difficiles et faciles. Le modèle supporte le code-switching et a été entraîné sur plus de 70 langues, avec 25 validées. Il présente un taux d'erreur de 3,1 % pour la transcription en anglais, devant des concurrents comme Cartesia Ink-2 et Gemini 3.5 Transcribe Live. Meta affirme être en tête des benchmarks de diarisation des locuteurs et propose un tarif de 3 $ pour 1 000 minutes audio.

Source originale

Génération NT

NewsAPI fournit un résumé de cette publication. Consultez le média d'origine pour lire l'article complet.

Lire l'article complet