AI & Voice

G v2 è qui: voce AI più veloce ed espressiva con gli audio tag

June 11, 2026 ·5 min di lettura
G v2 è qui: voce AI più veloce ed espressiva con gli audio tag

Stiamo aggiornando G v1 a G v2, ed è il nostro salto più grande di sempre nella qualità della voce AI. G v2 si basa sul nuovissimo modello Gemini 3.1 Flash TTS di Google, che sostituisce i motori Gemini 2.5 Flash e Pro alla base della versione originale. Il risultato: una voce più naturale ed espressiva, una copertura linguistica enormemente più ampia e un nuovo modo di guidare la pronuncia parola per parola.

E la cosa migliore è che il tuo modo di lavorare non cambia. Passa a G v2 dal selettore del provider, scegli una voce e genera: i crediti che hai già funzionano esattamente come prima.

Le novità di G v2

Un unico modello, migliore

G v1 funzionava su due livelli: un modello Flash più veloce e un modello Pro di qualità superiore. G v2 unifica tutto in Gemini 3.1 Flash TTS, un motore vocale creato su misura che offre qualità da Pro alla velocità di un Flash. Nella classifica indipendente Artificial Analysis dedicata al TTS, che raccoglie migliaia di preferenze d'ascolto espresse alla cieca da persone reali, si colloca tra i modelli dal suono più naturale disponibili. Un solo modello, bassa latenza, risultati di altissimo livello.

Audio tag per il controllo parola per parola

Questa è la novità di punta. Oltre alle istruzioni vocali in linguaggio naturale che già conosci, G v2 comprende gli audio tag inline: indicazioni tra parentesi quadre che inserisci direttamente nel testo per guidare la pronuncia anche a metà frase:

Bentornato! [excited] Non crederai a cosa è successo dopo. [whispers] C'era un silenzio totale... [laughs]

I tag coprono le emozioni ([excited], [curious], [frustrated]), il ritmo ([slow], [fast], [long pause]) e i suoni non verbali ([laughs], [sighs], [whispers]). Non esiste un elenco fisso: il modello fa del suo meglio per interpretare qualsiasi cosa inserisci tra le parentesi, così puoi essere creativo quanto richiede il tuo copione.

Oltre 70 lingue

G v2 supporta oltre 70 lingue e varianti regionali, quasi il triplo della copertura di G v1. Gestisce persino il code-switching all'interno di uno stesso brano e le guide fonetiche per i termini tecnici più ostici, così i contenuti multilingue e misti suonano corretti senza bisogno di assemblaggi manuali.

Dialoghi multi-speaker migliorati

La modalità multi-speaker è ancora disponibile, e migliore che mai. Assegna voci distinte a ciascun interlocutore e genera in un'unica passata una conversazione naturale a due voci: perfetta per podcast, interviste e racconti. G v2 mantiene coerente la voce di ogni personaggio e gestisce gli scambi di battute in modo più naturale rispetto a prima.

Come usare G v2

  1. Passa a G v2 — Fai clic sul pulsante G v2 nel selettore del provider (accanto ad AZ v1) nel pannello di destra.
  2. Scegli la modalità — Single Speaker per la narrazione, Multi Speaker per i dialoghi.
  3. Scegli una voce — Sfoglia, cerca per nome o stile e seleziona. In modalità multi-speaker, assegna una voce a ciascun interlocutore.
  4. Aggiungi indicazioni (facoltativo) — Scrivi un'istruzione vocale in linguaggio naturale, inserisci gli audio tag inline, oppure entrambi.
  5. Genera — Il tuo audio è pronto in pochi secondi.

Il prezzo resta invariato

G v2 utilizza il tuo saldo crediti attuale, a 2 crediti per carattere: nessun cambiamento rispetto a G v1. Gli account gratuiti includono 10.000 crediti mensili e i tuoi crediti funzionano sia con G v2 sia con AZ v1, così puoi combinare i motori a seconda del progetto.

G v2 e AZ v1: quale scegliere

Entrambi i motori restano pienamente disponibili:

  • Scegli G v2 per una narrazione naturale ed espressiva, dialoghi multi-speaker, controllo parola per parola con gli audio tag o un'ampia copertura multilingue.
  • Scegli AZ v1 quando ti servono oltre 500 voci o il controllo a livello SSML.

Inizia subito

G v2 è già attivo per tutti gli utenti registrati. Vai allo Studio di simpleTTS.ai, passa a G v2 e prova di persona i nuovi audio tag. I crediti che hai già funzionano immediatamente.

Non vediamo l'ora di ascoltare quello che creerai.

Articoli correlati