GOOGLE CLOUD TEXT TO SPEECH
Jede Google-Stimme auf einer Seite.
Hören Sie eine Probe jeder Stimme im Google-Cloud-Katalog. Filtern nach Modellfamilie, Sprache und Geschlecht. Kein Konto, keine Einrichtung, nur die Stimmen.
10 Modellfamilien
Google liefert laufend neue Spracharchitekturen aus und jede Generation ist weiter im Dienst. Der Katalog reicht von kompakten parametrischen Stimmen bis zu Modellen, die sich mit einem Satz dirigieren lassen.
93 Sprachen
Jede Sprache hat ihre eigene Seite mit der vollständigen Stimmenliste, sodass sich jemand direkt auf ein Regal des Katalogs verlinken lässt.
Über diesen Katalog
Google Cloud betreibt einen der größten Text-to-Speech-Kataloge aller Cloud-Anbieter. Er umfasst 10 Modellfamilien, von den WaveNet-Stimmen, die neuronale Sprache zum Standard machten, bis zu Gemini-Stimmen, die ihren Vortrag ändern, wenn man den gewünschten Ton beschreibt. Gemini ist eigentlich 4 Modelle in einem: jede Gemini-Stimme kann von jedem ihrer Untermodelle gerendert werden, und jedes Rendering hat hier seine eigene Hörprobe. Auch jede andere Stimme im Katalog hat eine.
Speakshelf ist unabhängig und nicht mit Google, Amazon oder dem Kokoro-Projekt verbunden. Stimmdaten und Audio kommen vom AI TTS Microservice, einem Dienst, der Google, Amazon, Azure und weitere Sprachanbieter hinter einem Endpunkt vereint. Hörproben streamen auf Abruf, das Anhören ist kostenlos.