Синтез мовлення Google Cloud
Усі голоси Google на одній сторінці.
Прослухайте зразок кожного голосу з каталогу Google Cloud. Фільтруйте за родиною моделей, мовою та статтю. Без облікового запису й налаштувань, лише голоси.
10 родин моделей
Google постійно випускає нові архітектури синтезу мовлення, і всі їхні покоління досі працюють. У каталозі є як компактні параметричні голоси, так і моделі, якими можна керувати текстовою вказівкою.
93 мови
Кожна мова має окрему сторінку з повним списком голосів, тож ви можете поділитися посиланням саме на потрібну полицю каталогу.
Про цей каталог
Google Cloud пропонує родини моделей, зокрема Standard, WaveNet, Chirp 3 і Gemini. Загалом їх 10. Gemini об’єднує кілька моделей (4): кожен голос Gemini може озвучувати будь-яка з підмоделей, і для кожного варіанта тут є окремий зразок. Решта голосів у каталозі теж мають зразки.
Speakshelf є незалежним проєктом і не пов’язаний із Google Cloud. Дані про голоси й аудіо надходять з AI TTS Microservice, сервісу, що об’єднує Google, Amazon, Azure та інших постачальників синтезу мовлення через єдину точку доступу. Зразки передаються потоком за запитом, тож прослуховування безплатне.
AI TTS Microservice є продуктом The Productive Pixel.