Speakshelf

Синтез мовлення Google Cloud

Усі голоси Google на одній сторінці.

Прослухайте зразок кожного голосу з каталогу Google Cloud. Фільтруйте за родиною моделей, мовою та статтю. Без облікового запису й налаштувань, лише голоси.

4 586
Голоси
93
Мови
10
родин моделей
12 416
Зразки для прослуховування

10 родин моделей

Google постійно випускає нові архітектури синтезу мовлення, і всі їхні покоління досі працюють. У каталозі є як компактні параметричні голоси, так і моделі, якими можна керувати текстовою вказівкою.

УльтраGeminiМовлення, яке створює сама Gemini. Кожен голос доступний у всіх підмоделях, а манера мовлення визначається письмовою вказівкою щодо стилю.2 610 голосів · 87 мов · Підмоделей: 4ПреміумChirp 3: HDПоточне покоління HD, налаштоване на природну розмову.1 508 голосів · 51 моваПреміумStandardПараметричні голоси для синтезу мовлення.180 голосів · 60 мовПреміумWaveNetНейронні голоси з родини моделей WaveNet.161 голос · 47 мовПреміумNeural2Нейронні голоси другого покоління, які використовуються за замовчуванням у багатьох продуктах.62 голоси · 18 мовПреміумChirp HDПерше покоління Chirp, яке досі широко використовують.30 голосів · 10 мовПреміумNewsГолоси в дикторському стилі, налаштовані на читання новин.17 голосів · 4 мовиПреміумStudioГолоси для озвучення довгих текстів.11 голосів · 6 мовПреміумPolyglotОдин і той самий голос, що говорить кількома мовами.6 голосів · 6 мовПреміумCasualРозмовний голос для невимушених відповідей.1 голос · 1 мова

93 мови

Кожна мова має окрему сторінку з повним списком голосів, тож ви можете поділитися посиланням саме на потрібну полицю каталогу.

азербайджанська (Азербайджан)30албанська (Албанія)30амхарська (Ефіопія)34англійська (Австралія)79англійська (Велика Британія)93англійська (Індія)79англійська (Сполучені Штати)99арабська (Єгипет)30арабська (сучасна літературна)ar-00130арабська (сучасна літературна)ar-XA38африкаанс (Південно-Африканська Республіка)31баскська (Іспанія)31бенгальська (Бангладеш)30бенгальська (Індія)38білоруська (Білорусь)30бірманська (Мʼянма [Бірма])30болгарська (Болгарія)61вірменська (Вірменія)30вʼєтнамська (Вʼєтнам)70гаїтянська креольська (Гаїті)30галісійська (Іспанія)31гінді (Індія)76грецька (Греція)62грузинська (Грузія)30гуджараті (Індія)68данська (Данія)65естонська (Естонія)61іврит (Ізраїль)68індонезійська (Індонезія)68ісландська (Ісландія)31іспанська (Іспанія)79іспанська (Латинська Америка)30іспанська (Мексика)30іспанська (Сполучені Штати)48італійська (Італія)70каннада (Індія)68кантонська (Гонконг, ОАР Китаю)34каталонська (Іспанія)31конкані (Індія)30корейська (Південна Корея)71лаоська (Лаос)30латинська (Ватикан)30латиська (Латвія)61литовська (Литва)61люксембурзька (Люксембург)30майтхілі (Індія)30македонська (Північна Македонія)30малагасійська (Мадагаскар)30малайська (Малайзія)38малаялам (Індія)68мандаринська китайська (Китай)68мандаринська китайська (Тайвань)36маратхі (Індія)66монгольська (Монголія)30непальська (Непал)30нідерландська (Бельгія)34нідерландська (Нідерланди)64німецька (Німеччина)72норвезька (букмол) (Норвегія)64норвезька (нюношк) (Норвегія)30одія (Індія)30панджабі (Індія)68перська (Іран)30польська (Польща)64португальська (Бразилія)73португальська (Португалія)34пушту (Афганістан)30російська (Росія)48румунська (Румунія)62себуанська (Філіппіни)30сербська (Сербія)61сингальська (Шрі-Ланка)30синдхі (Індія)30словацька (Словаччина)62словенська (Словенія)30суахілі (Кенія)60тайська (Таїланд)62тамільська (Індія)68телугу (Індія)64турецька (Туреччина)70угорська (Угорщина)62українська (Україна)62урду (Індія)34урду (Пакистан)30філіппінська (Філіппіни)40фінська (Фінляндія)62французька (Канада)75французька (Франція)72хорватська (Хорватія)30чеська (Чехія)62шведська (Швеція)74яванська (Ява)30японська (Японія)71

Про цей каталог

Google Cloud пропонує родини моделей, зокрема Standard, WaveNet, Chirp 3 і Gemini. Загалом їх 10. Gemini об’єднує кілька моделей (4): кожен голос Gemini може озвучувати будь-яка з підмоделей, і для кожного варіанта тут є окремий зразок. Решта голосів у каталозі теж мають зразки.

Speakshelf є незалежним проєктом і не пов’язаний із Google Cloud. Дані про голоси й аудіо надходять з AI TTS Microservice, сервісу, що об’єднує Google, Amazon, Azure та інших постачальників синтезу мовлення через єдину точку доступу. Зразки передаються потоком за запитом, тож прослуховування безплатне.
AI TTS Microservice є продуктом The Productive Pixel.

Усі голоси

Завантаження каталогу