文字转语音目录
21,388 个语音,一个书架。
Speakshelf 收录 Google Cloud、Amazon Polly、Kokoro 等提供商的文字转语音音色。每个音色都有可在浏览器中播放的示例。无需账号,无需配置,只有语音。
21,388
语音
4
提供商
179
语言
29,282
可播放示例
4 家提供商
每家提供商都有完整的书架:带筛选和播放的全部语音列表、每个模型家族的说明,以及每种语言的独立页面。书架还在扩充:AI TTS Microservice 正在整合更多提供商,经核验后新的书架会在这里开放。
/GOOGLEGoogle Cloud4,586个语音从 Standard 和 WaveNet 到 Chirp 3,再到遵循书面风格指令的 Gemini 语音。浏览 →/POLLYAmazon Polly113个语音AWS 的文字转语音服务:standard、neural、generative 与 long-form 引擎。浏览 →/KOKOROKokoro54个语音开放权重模型,8200 万参数,Apache 2.0 许可。浏览 →/AZUREAzure Speech16,635个语音涵盖 Neural、Dragon、OpenAI 和 MAI 模型系列的 Azure Speech 语音。浏览 →
为什么用一个书架
目录之间的差异不只是规模。并排摆放才能看清空缺、重叠和各自的特点。
覆盖互补
Amazon Polly 带来了 Google Cloud 完全没有的威尔士语,还有 德语(奥地利) 和 德语(瑞士) 等地区变体。一个书架就能看清每家提供商拥有而其他家缺少的部分。
同一种聆听方式
每个书架都是同样的筛选、同样的播放器、同样的语音标识方案。跨提供商比较语音只需两次点击,而不是两个控制台。
自动保持最新
每个书架每天从 AI TTS Microservice 自动刷新。新语音、新语言和新子模型都会自行出现,无需任何人编辑网站。
关于本目录
Speakshelf 是文字转语音音色的参考目录。目前收录来自 4 家提供商的 21,388 个语音,覆盖 179 种语言,每个语音都有可播放的示例。语音按提供商自己的方式分组,即模型家族与引擎,让你听到的与将要部署的一一对应。
Speakshelf 是独立网站,与所收录的任何提供商均无关联。 语音数据与音频来自 AI TTS Microservice,该服务将 Google、Amazon、Azure 及其他语音提供商统一到同一个接入点。示例按需流式传输,因此试听免费。
AI TTS Microservice 是 The Productive Pixel 的产品。