TEXT-TO-SPEECH-KATALOG
4.753 Stimmen. Ein Regal.
Speakshelf katalogisiert die Text-to-Speech-Stimmen von Google Cloud, Amazon Polly, Kokoro und mehr. Jede mit einer Hörprobe direkt im Browser. Kein Konto, keine Einrichtung, nur die Stimmen.
3 Anbieter
Jeder Anbieter hat ein vollständiges Regal: die komplette Stimmenliste mit Filtern und Wiedergabe, Notizen zu jeder Modellfamilie und eine Seite pro Sprache. Das Regal wächst: der AI TTS Microservice vereint weitere Anbieter, und neue Regale öffnen hier nach der Prüfung.
Warum ein Regal
Kataloge unterscheiden sich nicht nur in der Größe. Nebeneinander zeigen sie die Lücken, die Überschneidungen und den Charakter jedes einzelnen.
Abdeckung summiert sich
Amazon Polly bringt Walisisch mit, das Google Cloud gar nicht führt, dazu regionale Varianten wie Arabisch (Standard) und Arabisch (Vereinigte Arabische Emirate). Ein Regal zeigt, was jeder Anbieter hat und den anderen fehlt.
Ein Weg zum Anhören
Gleiche Filter, gleicher Player, gleiches Stimmen-ID-Schema auf jedem Regal. Stimmen über Anbieter hinweg zu vergleichen sind zwei Klicks, nicht zwei Konsolen.
Aktualisiert sich selbst
Jedes Regal erneuert sich täglich aus dem AI TTS Microservice. Neue Stimmen, Sprachen und Untermodelle erscheinen hier, ohne dass jemand die Seite bearbeitet.
Über diesen Katalog
Speakshelf ist ein Referenzkatalog für Text-to-Speech-Stimmen. Heute führt er 4.753 Stimmen von 3 Anbietern in 105 Sprachen, jede mit einer abspielbaren Hörprobe. Stimmen sind so gruppiert, wie ihre Anbieter sie gruppieren, in Modellfamilien und Engines, damit das Gehörte dem entspricht, was man einsetzen würde.
Speakshelf ist unabhängig und nicht mit Google, Amazon oder dem Kokoro-Projekt verbunden. Stimmdaten und Audio kommen vom AI TTS Microservice, einem Dienst, der Google, Amazon, Azure und weitere Sprachanbieter hinter einem Endpunkt vereint. Hörproben streamen auf Abruf, das Anhören ist kostenlos.