G v2 est là : une voix IA plus rapide et plus expressive grâce aux balises audio

Nous faisons passer G v1 à G v2 — et c'est notre plus grand bond en avant en matière de qualité vocale IA à ce jour. G v2 est propulsé par le tout nouveau modèle Gemini 3.1 Flash TTS de Google, qui remplace les moteurs Gemini 2.5 Flash et Pro de la version d'origine. Le résultat : une voix plus naturelle et plus expressive, une couverture linguistique nettement plus large, et une nouvelle façon de diriger le rendu mot par mot.
Et surtout, rien ne change dans votre façon de travailler. Passez à G v2 dans le sélecteur de fournisseur, choisissez une voix et générez — vos crédits existants fonctionnent exactement comme avant.
Les nouveautés de G v2
Un modèle unique, et meilleur
G v1 reposait sur deux niveaux — un modèle Flash plus rapide et un modèle Pro de meilleure qualité. G v2 réunit tout sur Gemini 3.1 Flash TTS, un moteur vocal conçu sur mesure qui offre une qualité de niveau Pro à la vitesse du Flash. Sur le classement indépendant Artificial Analysis dédié au TTS — qui recense les préférences d'écoute de milliers d'auditeurs humains en aveugle — il figure parmi les modèles au rendu le plus naturel disponibles. Un seul modèle, une faible latence, une qualité de premier ordre.
Des balises audio pour un contrôle au mot près
C'est la fonctionnalité phare. En complément des instructions de diction en langage courant que vous connaissez déjà, G v2 comprend les balises audio en ligne — des indications entre crochets que vous insérez directement dans votre texte pour piloter le rendu en plein milieu d'une phrase :
Welcome back! [excited] You won't believe what happened next. [whispers] It was completely silent... [laughs]
Les balises couvrent l'émotion ([excited], [curious], [frustrated]), le rythme ([slow], [fast], [long pause]) et les sons non verbaux ([laughs], [sighs], [whispers]). Il n'existe pas de liste figée — le modèle fait de son mieux pour interpréter tout ce que vous placez entre crochets, vous pouvez donc être aussi créatif que votre script l'exige.
Plus de 70 langues
G v2 prend en charge plus de 70 langues et variantes régionales — soit presque le triple de ce que couvrait G v1. Il gère même l'alternance de langues au sein d'un même passage ainsi que les guides phonétiques pour les termes techniques délicats, afin que les contenus multilingues et mixtes sonnent juste sans assemblage manuel.
Des dialogues multi-locuteurs améliorés
Le mode multi-locuteurs est toujours là, et meilleur que jamais. Attribuez une voix distincte à chaque locuteur et générez une conversation naturelle à deux en une seule passe — parfait pour les podcasts, les interviews et les récits. G v2 maintient la cohérence de la voix de chaque personnage et gère les tours de parole de façon plus naturelle qu'auparavant.
Comment utiliser G v2
- Passez à G v2 — Cliquez sur le bouton G v2 dans le sélecteur de fournisseur (à côté d'AZ v1) dans le panneau de droite.
- Choisissez votre mode — Mono-locuteur pour la narration, Multi-locuteurs pour le dialogue.
- Sélectionnez une voix — Parcourez, recherchez par nom ou par style, puis sélectionnez. En mode multi-locuteurs, attribuez une voix à chaque locuteur.
- Ajoutez des indications (facultatif) — Rédigez une instruction de diction en langage courant, insérez des balises audio en ligne, ou les deux.
- Générez — Votre audio est prêt en quelques secondes.
Les tarifs ne changent pas
G v2 puise dans votre solde de crédits existant au tarif de 2 crédits par caractère — aucun changement par rapport à G v1. Les comptes gratuits incluent 10 000 crédits par mois, et vos crédits fonctionnent à la fois avec G v2 et AZ v1, ce qui vous permet de combiner les moteurs selon vos projets.
G v2 ou AZ v1 : lequel choisir
Les deux moteurs restent pleinement disponibles :
- Choisissez G v2 pour une narration naturelle et expressive, des dialogues multi-locuteurs, un contrôle au mot près grâce aux balises audio, ou une large couverture multilingue.
- Choisissez AZ v1 lorsque vous avez besoin de plus de 500 voix ou d'un contrôle au niveau SSML.
Pour commencer
G v2 est disponible dès maintenant pour tous les utilisateurs inscrits. Rendez-vous sur le Studio simpleTTS.ai, passez à G v2 et essayez vous-même les nouvelles balises audio. Vos crédits existants fonctionnent immédiatement.
Nous avons hâte de découvrir vos créations.


