КАТАЛОГ СИНТЕЗА РЕЧИ
21 388 голосов. Одна полка.
Speakshelf каталогизирует голоса синтеза речи от Google Cloud, Amazon Polly, Kokoro и других. У каждого есть образец, который можно прослушать в браузере. Без аккаунта, без настройки, только голоса.
4 провайдера
У каждого провайдера своя полная полка: весь список голосов с фильтрами и прослушиванием, заметки о каждом семействе моделей и страница для каждого языка. Полка растёт: AI TTS Microservice объединяет новых провайдеров, и после проверки здесь открываются новые полки.
Зачем одна полка
Каталоги различаются не только размером. Рядом друг с другом видно пробелы, пересечения и характер каждого.
Покрытие складывается
Amazon Polly приносит валлийский, которого у Google Cloud нет вовсе, плюс региональные варианты вроде английский (Ирландия) и английский (Новая Зеландия). Одна полка показывает, что есть у каждого провайдера и чего не хватает остальным.
Один способ слушать
Те же фильтры, тот же плеер, та же схема идентификаторов на каждой полке. Сравнить голоса разных провайдеров — два клика, а не две консоли.
Обновляется сам
Каждая полка ежедневно обновляется из AI TTS Microservice. Новые голоса, языки и подмодели появляются здесь без чьего-либо участия.
Об этом каталоге
Speakshelf — справочный каталог голосов синтеза речи. Сегодня он содержит 21 388 голосов от 4 провайдеров на 179 языках, у каждого есть образец для прослушивания. Голоса сгруппированы так, как их группируют сами провайдеры, по семействам моделей и движкам, чтобы услышанное соответствовало тому, что вы развернёте.
Speakshelf независим и не аффилирован ни с одним из провайдеров в каталоге. Данные о голосах и аудио поступают из AI TTS Microservice, сервиса, который объединяет Google, Amazon, Azure и других провайдеров речи за единой точкой доступа. Образцы передаются по запросу, так что прослушивание бесплатно.
AI TTS Microservice — продукт The Productive Pixel.