Découvrez G v1 : Synthèse vocale naturelle par IA avec dialogue multilocuteur

Nous sommes ravis de présenter G v1 dans simpleTTS.ai Studio — un tout nouveau moteur de synthèse vocale, notre nouveau moteur vocal alimenté par l'IA. G v1 apporte une approche fondamentalement différente de la synthèse vocale : au lieu de simplement lire du texte à voix haute, il comprend le contexte, l'émotion et l'intention pour produire une parole qui sonne véritablement humaine.
Celui-ci s'ajoute à notre moteur AZ v1 existant, vous donnant la liberté de choisir le bon outil pour chaque projet. Basculez entre les fournisseurs en un seul clic.
Pourquoi G v1 ?
Les moteurs TTS traditionnels convertissent le texte en audio à l'aide de modèles de parole prédéfinis. G v1 est différent — il est construit sur un grand modèle de langage qui ne sait pas seulement quoi dire, mais comment le dire. Le résultat est une parole au rythme naturel, avec une accentuation appropriée et des nuances émotionnelles qui s'adaptent à votre contenu.
G v1 prend en charge 30 voix prédéfinies dans 24 langues, avec une expressivité améliorée, un rythme adapté au contexte et un dialogue multilocuteur natif — le tout contrôlable par des instructions en langage naturel plutôt que par une configuration complexe.
Fonctionnalités clés
30 voix expressives
Choisissez parmi 30 voix distinctes, chacune avec une personnalité et un style uniques. De la diction ferme de Kore à l'énergie enjouée de Puck, du ton doux d'Achernar à la chaleur de Sulafat — il y a une voix pour chaque usage. Parcourez les voix par genre et style, recherchez par nom et enregistrez vos favorites pour un accès rapide.
Mode locuteur unique
Parfait pour la narration, les annonces et le contenu simple. Sélectionnez une voix, collez votre texte et générez. Le modèle gère automatiquement le rythme et l'intonation en fonction du contenu — accélérant pour l'excitation, ralentissant pour l'emphase.
Dialogue multilocuteur
C'est là que G v1 brille vraiment. Attribuez différentes voix à différents locuteurs et générez une conversation au son naturel en une seule passe — sans assembler des clips audio séparés. Le modèle maintient des voix de personnages cohérentes et gère les tours de parole naturellement.
Formatez simplement votre texte avec des étiquettes de locuteur :
- Speaker 1: Bienvenue dans l'épisode d'aujourd'hui !
- Speaker 2: Merci de m'avoir invité. Allons-y.
- Speaker 1: Alors, parlez-nous de votre dernier projet...
Chaque locuteur est interprété par la voix que vous attribuez, et le modèle produit un seul fichier audio cohésif avec un flux de dialogue naturel.
Instructions vocales
Contrôlez le rendu de la voix en langage naturel. Au lieu de régler des curseurs et des paramètres, décrivez simplement ce que vous voulez :
- « Lis sur un ton chaleureux et conversationnel »
- « Parle avec enthousiasme et énergie »
- « Présente ceci comme un présentateur de journal télévisé »
Vous ne savez pas quoi écrire ? Appuyez sur le bouton de génération IA et laissez le système suggérer une instruction vocale basée sur votre contenu.
Comment l'utiliser
- Passez à G v1 — Cliquez sur le bouton G v1 dans le sélecteur de fournisseur (à côté de AZ v1) dans le panneau de droite.
- Choisissez votre mode — Sélectionnez locuteur unique pour la narration ou multilocuteur pour le dialogue.
- Choisissez une voix — Parcourez le panneau des voix, recherchez par nom ou style, et sélectionnez la voix qui correspond à votre contenu. En mode multilocuteur, choisissez une voix pour chaque locuteur.
- Ajoutez une instruction vocale (optionnel) — Décrivez le ton, le rythme ou le style que vous souhaitez.
- Générez — Appuyez sur le bouton de génération et votre audio sera prêt en quelques secondes.
Ce que vous pouvez créer
- Podcasts et émissions — Utilisez le mode multilocuteur pour générer des conversations animateur-invité avec des voix distinctes et cohérentes.
- Livres audio et histoires — Narrez du contenu long avec un rythme naturel et une livraison émotionnelle qui s'adapte au matériau.
- E-learning et tutoriels — Créez un audio pédagogique engageant avec une diction claire et bien rythmée.
- Marketing et publicités — Générez des voix off professionnelles avec le ton et l'énergie exacts dont vous avez besoin.
- Contenu d'accessibilité — Convertissez du contenu écrit en audio au son naturel pour les utilisateurs malvoyants.
Tarification
G v1 utilise votre solde de crédits existant au tarif de 2 crédits par caractère. Les comptes gratuits incluent 10 000 crédits mensuels pour commencer. Vos crédits fonctionnent sur les deux moteurs, vous pouvez donc combiner les fournisseurs selon les besoins de chaque projet.
G v1 vs. AZ v1 : Lequel utiliser et quand
Les deux moteurs restent entièrement disponibles. Voici un guide rapide :
- Choisissez G v1 lorsque vous avez besoin d'un dialogue au son naturel, d'une narration expressive ou d'un contrôle précis du ton par des instructions en langage naturel.
- Choisissez AZ v1 lorsque vous avez besoin d'accéder à plus de 500 voix, d'un contrôle au niveau SSML ou d'une couverture dans plus de 70 langues.
Commencer
G v1 est disponible dès maintenant pour tous les utilisateurs inscrits. Rendez-vous sur simpleTTS.ai Studio, passez à G v1 et constatez la différence par vous-même. Vos crédits existants fonctionnent immédiatement — aucune configuration supplémentaire nécessaire.
Nous avons hâte d'entendre ce que vous allez créer.


