产品介绍
Kokoro TTS 是什么?
Kokoro TTS 是使用 8200 万参数 Kokoro 文本转语音模型生成语音的网页界面。网站称模型基于 StyleTTS 2 架构,重点是在较小参数量下提供高效、自然的输出。用户可使用多种语言和声音选项,将短文本或较长书面材料转换为音频。
服务列出美式英语、英式英语、法语、韩语、日语和普通话,并提供可定制 voicepack、自动章节与段落检测、GPU 加速生成,以及兼容常见语音 API 的端点。发布生成音频前,用户应确认声音许可、同意、署名和商业使用条款。
如何使用 Kokoro TTS
- 打开在线生成器,选择所需语言和 voicepack。
- 粘贴文本或上传支持的书面内容。
- 对长材料检查自动识别的段落或章节边界。
- 先生成短样本,检查发音、语速和语气。
- 调整声音或拆分难处理段落,再生成完整音频。
- 导出结果,并确认使用方式符合内容和声音权利要求。
核心功能
- 8200 万参数模型: 以相对较小模型实现高效语音生成。
- 多语言合成: 支持多种英语变体及亚洲和欧洲语言。
- Voicepack: 为不同语气和项目提供多个声音选项。
- 内容分段: 识别长文本中的章节和段落。
- 实时生成: 使用加速处理快速输出语音。
- 兼容语音端点: 支持采用常见语音 API 形式的集成。
使用场景
- 有声书: 将书籍和长文章转换为按章节组织的音频。
- 播客: 将准备好的脚本转换为语音节目。
- 培训材料: 为内部课程和教程添加旁白。
- 无障碍: 为书面数字内容创建音频替代版本。
- 应用语音: 将生成语音集成到原型和工具。
价格
本次审核网站提供在线试用流程,但没有公布标准付费套餐或详细用量额度。处理大型项目之前应确认当前限制。
常见问题
Kokoro 模型有多大?
当前网站将其描述为 8200 万参数模型。
列出了哪些语言?
网站列出美式和英式英语、法语、韩语、日语和普通话。
可以处理长文档吗?
网站称支持对长内容自动识别章节和段落。

