Speakshelf

CATALOGO TEXT TO SPEECH

4753 voci. Un solo scaffale.

Speakshelf cataloga le voci text to speech di Google Cloud, Amazon Polly, Kokoro e altri. Ognuna con un campione da ascoltare nel browser. Niente account, niente configurazione, solo le voci.

4753
VOCI
3
PROVIDER
105
LINGUE
12.647
CAMPIONI RIPRODUCIBILI

Perché un solo scaffale

I cataloghi differiscono in più della dimensione. Vederli fianco a fianco mostra i vuoti, le sovrapposizioni e il carattere di ciascuno.

La copertura si somma

Amazon Polly porta gallese, che Google Cloud non ha affatto, più varianti regionali come English (Wales) e arabo (Emirati Arabi Uniti). Un solo scaffale mostra ciò che ogni provider ha e agli altri manca.

Un solo modo di ascoltare

Stessi filtri, stesso player, stesso schema di id delle voci su ogni scaffale. Confrontare voci tra provider sono due clic, non due console.

Si aggiorna da solo

Ogni scaffale si rinnova ogni giorno dall'AI TTS Microservice. Nuove voci, lingue e sottomodelli compaiono qui senza che nessuno tocchi il sito.

Su questo catalogo

Speakshelf è un catalogo di riferimento per le voci text to speech. Oggi contiene 4753 voci di 3 provider in 105 lingue, ognuna con un campione riproducibile. Le voci sono raggruppate come le raggruppano i loro provider, in famiglie di modelli ed engine, così ciò che ascolti corrisponde a ciò che useresti.

Speakshelf è indipendente e non affiliato a Google, Amazon o al progetto Kokoro. I dati delle voci e l'audio vengono dall<link>AI TTS Microservice</link>, un servizio che unifica Google, Amazon, Azure e altri provider vocali dietro un solo endpoint. I campioni arrivano in streaming su richiesta, ascoltare è gratis.