GOOGLE CLOUD TEXT TO SPEECH
Ogni voce Google, in una pagina.
Ascolta un campione di ogni voce del catalogo Google Cloud. Filtra per famiglia di modelli, lingua e genere. Niente account, niente configurazione, solo le voci.
10 famiglie di modelli
Google continua a pubblicare nuove architetture vocali e ogni generazione resta in servizio. Il catalogo va dalle voci parametriche compatte ai modelli che si dirigono con una frase.
93 lingue
Ogni lingua ha la sua pagina con l'elenco completo delle voci, così puoi mandare qualcuno dritto a uno scaffale del catalogo.
Su questo catalogo
Google Cloud gestisce uno dei più grandi cataloghi text to speech tra i cloud provider. Copre 10 famiglie di modelli, dalle voci WaveNet che resero mainstream la sintesi neurale alle voci Gemini che cambiano resa quando descrivi il tono che vuoi. Gemini in realtà è 4 modelli in uno: ogni voce Gemini può essere resa da ciascuno dei suoi sottomodelli, e ogni resa ha qui il suo campione. Anche ogni altra voce del catalogo ha un campione.
Speakshelf è indipendente e non affiliato a Google, Amazon o al progetto Kokoro. I dati delle voci e l'audio vengono dall<link>AI TTS Microservice</link>, un servizio che unifica Google, Amazon, Azure e altri provider vocali dietro un solo endpoint. I campioni arrivano in streaming su richiesta, ascoltare è gratis.