Presentamos G v1: Voz natural con IA y diálogo multilocutor

Estamos encantados de presentar G v1 en simpleTTS.ai Studio — un motor de texto a voz completamente nuevo, nuestro nuevo motor de voz con IA. G v1 aporta un enfoque fundamentalmente diferente a la síntesis de voz: en lugar de simplemente leer texto en voz alta, comprende el contexto, la emoción y la intención para producir un habla que suena genuinamente humana.
Este se suma a nuestro motor AZ v1 existente, dándote la libertad de elegir la herramienta adecuada para cada proyecto. Cambia entre proveedores con un solo clic.
¿Por qué G v1?
Los motores TTS tradicionales convierten texto en audio usando patrones de habla predefinidos. G v1 es diferente — está construido sobre un modelo de lenguaje grande que no solo sabe qué decir, sino cómo decirlo. El resultado es un habla con ritmo natural, énfasis apropiado y matices emocionales que se adaptan a tu contenido.
G v1 admite 30 voces prediseñadas en 24 idiomas, con expresividad mejorada, ritmo adaptado al contexto y diálogo multilocutor nativo — todo controlable mediante indicaciones en lenguaje natural en lugar de configuraciones complejas.
Características principales
30 voces expresivas
Elige entre 30 voces distintas, cada una con personalidad y estilo únicos. Desde la entrega firme de Kore hasta la energía animada de Puck, el tono suave de Achernar hasta la calidez de Sulafat — hay una voz para cada caso de uso. Explora voces por género y estilo, busca por nombre y guarda tus favoritas para acceso rápido.
Modo de un solo locutor
Perfecto para narración, anuncios y contenido directo. Selecciona una voz, pega tu texto y genera. El modelo maneja automáticamente el ritmo y la entonación según el contenido — acelerando para la emoción, ralentizando para el énfasis.
Diálogo multilocutor
Aquí es donde G v1 realmente brilla. Asigna diferentes voces a diferentes locutores y genera una conversación con sonido natural en una sola pasada — sin unir clips de audio separados. El modelo mantiene voces de personaje consistentes y maneja los turnos de habla de forma natural.
Simplemente formatea tu texto con etiquetas de locutor:
- Speaker 1: ¡Bienvenidos al episodio de hoy!
- Speaker 2: Gracias por invitarme. Vamos a ello.
- Speaker 1: Entonces, cuéntanos sobre tu último proyecto...
Cada locutor es interpretado por la voz que asignes, y el modelo produce un único archivo de audio cohesivo con un flujo de diálogo natural.
Instrucciones de habla
Controla cómo suena la voz usando lenguaje natural. En lugar de ajustar controles deslizantes y parámetros, simplemente describe lo que quieres:
- "Lee en un tono cálido y conversacional"
- "Habla con entusiasmo y energía"
- "Presenta esto como un presentador de noticias"
¿No sabes qué escribir? Pulsa el botón de generación con IA y deja que el sistema sugiera una instrucción de habla basada en tu contenido.
Cómo usarlo
- Cambia a G v1 — Haz clic en el botón G v1 en el selector de proveedor (junto a AZ v1) en el panel derecho.
- Elige tu modo — Selecciona un solo locutor para narración o multilocutor para diálogo.
- Elige una voz — Explora el panel de voces, busca por nombre o estilo, y selecciona la voz que se ajuste a tu contenido. En modo multilocutor, elige una voz para cada locutor.
- Añade una instrucción de habla (opcional) — Describe el tono, ritmo o estilo que deseas.
- Genera — Pulsa el botón de generar y tu audio estará listo en segundos.
Lo que puedes crear
- Podcasts y programas de entrevistas — Usa el modo multilocutor para generar conversaciones entre anfitrión e invitado con voces distintas y consistentes.
- Audiolibros e historias — Narra contenido extenso con ritmo natural y entrega emocional que se adapta al material.
- E-learning y tutoriales — Crea audio instructivo atractivo con una entrega clara y bien ritmada.
- Marketing y anuncios — Genera locuciones profesionales con el tono y la energía exactos que necesitas.
- Contenido de accesibilidad — Convierte contenido escrito en audio con sonido natural para usuarios con discapacidad visual.
Precios
G v1 usa tu saldo de créditos existente a una tarifa de 2 créditos por carácter. Las cuentas gratuitas incluyen 10.000 créditos mensuales para empezar. Tus créditos funcionan en ambos motores, así que puedes combinar proveedores según lo que necesite cada proyecto.
G v1 vs. AZ v1: Cuándo usar cada uno
Ambos motores permanecen completamente disponibles. Aquí tienes una guía rápida:
- Elige G v1 cuando necesites diálogo con sonido natural, narración expresiva o control detallado del tono mediante instrucciones en lenguaje natural.
- Elige AZ v1 cuando necesites acceso a más de 500 voces, control a nivel SSML o cobertura en más de 70 idiomas.
Empieza ahora
G v1 está disponible ahora para todos los usuarios registrados. Ve a simpleTTS.ai Studio, cambia a G v1 y escucha la diferencia por ti mismo. Tus créditos existentes funcionan de inmediato — no se necesita configuración adicional.
Estamos deseando escuchar lo que crees.


