21 set 2026

https://aistudio.google.com/generate-speech


https://aistudio.google.com/generate-speech

L'indirizzo [https://aistudio.google.com/generate-speech](https://aistudio.google.com/generate-speech) (o le sezioni dedicate all'interno di Google AI Studio) rimanda agli strumenti di generazione vocale e Text-to-Speech (TTS) basati sui modelli Gemini (come i modelli Gemini Flash TTS e la libreria delle voci).

Ecco cosa puoi fare in questa sezione e come funziona:

1. Funzionalità Principali della generazione vocale su AI Studio

  • Sintesi Vocale Avanzata (TTS): Ti permette di convertire qualsiasi testo in tracce audio con voci dal timbro estremamente naturale, espressivo e umano.

  • Controllo tramite Tag e Linguaggio Naturale: Puoi guidare l'espressività della voce usando istruzioni testuali o tag audio dedicati (ad esempio impostando il tono per farlo suonare eccitato, annoiato, sussurrato, molto veloce o lento).

  • Supporto Multi-Speaker: È possibile generare dialoghi tra più voci (assegnando speaker differenti a parti diverse del testo) per creare sceneggiati, podcast o conversazioni simulate.

  • Libreria Voci (Voice Library): Una sezione interattiva in cui puoi testare in tempo reale i diversi profili vocali predefiniti disponibili (come Kore, Puck, ecc.) e le diverse sfumature linguistiche.

2. Come si usa

  1. Accedi alla piattaforma: Entra con il tuo account su Google AI Studio.

  2. Imposta la modalità Audio: Configura il modello selezionando l'output audio e scegliendo la voce predefinita che preferisci.

  3. Scrivi il prompt o lo script: Inserisci il testo e, se lo desideri, aggiungi indicazioni di regia sullo stile di lettura o sulle emozioni (es. "Dillo con voce entusiasta...").

  4. Ascolta e Scarica: Genera il file audio, testane l'anteprima direttamente nell'interfaccia ed esportalo (ad esempio in formato WAV o MP3) per utilizzarlo nei tuoi progetti creativi, video o applicazioni.

Nessun commento:

Posta un commento