Speakshelf

TEXT-TO-SPEECH-KATALOG

4.753 Stimmen. Ein Regal.

Speakshelf katalogisiert die Text-to-Speech-Stimmen von Google Cloud, Amazon Polly, Kokoro und mehr. Jede mit einer Hörprobe direkt im Browser. Kein Konto, keine Einrichtung, nur die Stimmen.

4.753
STIMMEN
3
ANBIETER
105
SPRACHEN
12.647
ABSPIELBARE HÖRPROBEN

Warum ein Regal

Kataloge unterscheiden sich nicht nur in der Größe. Nebeneinander zeigen sie die Lücken, die Überschneidungen und den Charakter jedes einzelnen.

Abdeckung summiert sich

Amazon Polly bringt Walisisch mit, das Google Cloud gar nicht führt, dazu regionale Varianten wie Arabisch (Standard) und Arabisch (Vereinigte Arabische Emirate). Ein Regal zeigt, was jeder Anbieter hat und den anderen fehlt.

Ein Weg zum Anhören

Gleiche Filter, gleicher Player, gleiches Stimmen-ID-Schema auf jedem Regal. Stimmen über Anbieter hinweg zu vergleichen sind zwei Klicks, nicht zwei Konsolen.

Aktualisiert sich selbst

Jedes Regal erneuert sich täglich aus dem AI TTS Microservice. Neue Stimmen, Sprachen und Untermodelle erscheinen hier, ohne dass jemand die Seite bearbeitet.

Über diesen Katalog

Speakshelf ist ein Referenzkatalog für Text-to-Speech-Stimmen. Heute führt er 4.753 Stimmen von 3 Anbietern in 105 Sprachen, jede mit einer abspielbaren Hörprobe. Stimmen sind so gruppiert, wie ihre Anbieter sie gruppieren, in Modellfamilien und Engines, damit das Gehörte dem entspricht, was man einsetzen würde.

Speakshelf ist unabhängig und nicht mit Google, Amazon oder dem Kokoro-Projekt verbunden. Stimmdaten und Audio kommen vom AI TTS Microservice, einem Dienst, der Google, Amazon, Azure und weitere Sprachanbieter hinter einem Endpunkt vereint. Hörproben streamen auf Abruf, das Anhören ist kostenlos.