Speakshelf

CATALOGO TEXT TO SPEECH

21.388 voci. Un solo scaffale.

Speakshelf cataloga le voci text to speech di Google Cloud, Amazon Polly, Kokoro e altri. Ognuna con un campione da ascoltare nel browser. Niente account, niente configurazione, solo le voci.

21.388
VOCI
4
PROVIDER
179
LINGUE
29.282
CAMPIONI RIPRODUCIBILI

Perché un solo scaffale

I cataloghi differiscono in più della dimensione. Vederli fianco a fianco mostra i vuoti, le sovrapposizioni e il carattere di ciascuno.

La copertura si somma

Amazon Polly porta gallese, che Google Cloud non ha affatto, più varianti regionali come arabo (Emirati Arabi Uniti) e arabo (standard). Un solo scaffale mostra ciò che ogni provider ha e agli altri manca.

Un solo modo di ascoltare

Stessi filtri, stesso player, stesso schema di id delle voci su ogni scaffale. Confrontare voci tra provider richiede due clic, non due console.

Si aggiorna da solo

Ogni scaffale si rinnova ogni giorno dall'AI TTS Microservice. Nuove voci, lingue e sottomodelli compaiono qui senza che nessuno tocchi il sito.

Su questo catalogo

Speakshelf è un catalogo di riferimento per le voci text to speech. Oggi contiene 21.388 voci di 4 provider in 179 lingue, ognuna con un campione riproducibile. Le voci sono raggruppate come le raggruppano i loro provider, in famiglie di modelli ed engine, così ciò che ascolti corrisponde a ciò che useresti.

Speakshelf è indipendente e non è affiliato a nessuno dei provider che cataloga. I dati delle voci e l'audio vengono dall'AI TTS Microservice, un servizio che unifica Google, Amazon, Azure e altri provider vocali dietro un solo endpoint. I campioni arrivano in streaming su richiesta, ascoltare è gratis.
AI TTS Microservice è un prodotto di The Productive Pixel.