Speakshelf

Catalogus voor tekst-naar-spraak

21.388 stemmen. Eén plek.

Speakshelf verzamelt de tekst-naar-spraakstemmen van Google Cloud, Amazon Polly, Kokoro en meer. Elke stem heeft een fragment dat je in je browser kunt beluisteren. Geen account of instellingen nodig, gewoon luisteren.

21.388
Stemmen
4
Aanbieders
179
Talen
29.282
Beluisterbare fragmenten

Waarom alles op één plek

Catalogi verschillen in meer dan omvang. Door ze naast elkaar te zetten, zie je wat ontbreekt, wat overlapt en wat elke catalogus kenmerkt.

Samen meer talen en varianten

Amazon Polly biedt Welsh, dat helemaal niet in Google Cloud zit, en regionale varianten zoals Arabisch (Verenigde Arabische Emiraten) en Arabisch (standaard). Eén overzicht laat zien wat elke aanbieder heeft dat de anderen missen.

Eén manier van luisteren

Dezelfde filters, dezelfde speler en dezelfde opbouw van stem-ID’s bij elke aanbieder. Stemmen van verschillende aanbieders vergelijken kan met twee klikken, zonder twee beheeromgevingen te openen.

Vanzelf bijgewerkt

Elk overzicht wordt dagelijks bijgewerkt vanuit AI TTS Microservice. Nieuwe stemmen, talen en submodellen verschijnen hier zonder dat iemand de site hoeft aan te passen.

Over deze catalogus

Speakshelf is een naslagwerk voor tekst-naar-spraakstemmen. De catalogus bevat nu 21.388 stemmen van 4 aanbieders in 179 talen, elk met een beluisterbaar fragment. De stemmen zijn ingedeeld zoals bij de aanbieders zelf, in modelfamilies en engines. Zo hoor je wat je ook daadwerkelijk kunt gebruiken.

Speakshelf is onafhankelijk en niet verbonden aan de aanbieders in de catalogus. Stemgegevens en audio komen van AI TTS Microservice, een dienst die Google, Amazon, Azure en andere spraakaanbieders via één eindpunt toegankelijk maakt. Fragmenten worden op verzoek gestreamd, dus luisteren is gratis.
AI TTS Microservice is een product van The Productive Pixel.