首页/Kokoro TTS
Kokoro TTS 轻量级语音模型图标

Kokoro TTS

Kokoro TTS 是轻量级 8200 万参数文本转语音模型的在线界面,提供多语言语音生成、可选 voicepack、自动内容分段、实时合成和兼容语音端点。

访问网站

产品介绍

Kokoro TTS 是什么?

Kokoro TTS 是使用 8200 万参数 Kokoro 文本转语音模型生成语音的网页界面。网站称模型基于 StyleTTS 2 架构,重点是在较小参数量下提供高效、自然的输出。用户可使用多种语言和声音选项,将短文本或较长书面材料转换为音频。

服务列出美式英语、英式英语、法语、韩语、日语和普通话,并提供可定制 voicepack、自动章节与段落检测、GPU 加速生成,以及兼容常见语音 API 的端点。发布生成音频前,用户应确认声音许可、同意、署名和商业使用条款。

如何使用 Kokoro TTS

  1. 打开在线生成器,选择所需语言和 voicepack。
  2. 粘贴文本或上传支持的书面内容。
  3. 对长材料检查自动识别的段落或章节边界。
  4. 先生成短样本,检查发音、语速和语气。
  5. 调整声音或拆分难处理段落,再生成完整音频。
  6. 导出结果,并确认使用方式符合内容和声音权利要求。

核心功能

  • 8200 万参数模型: 以相对较小模型实现高效语音生成。
  • 多语言合成: 支持多种英语变体及亚洲和欧洲语言。
  • Voicepack: 为不同语气和项目提供多个声音选项。
  • 内容分段: 识别长文本中的章节和段落。
  • 实时生成: 使用加速处理快速输出语音。
  • 兼容语音端点: 支持采用常见语音 API 形式的集成。

使用场景

  • 有声书: 将书籍和长文章转换为按章节组织的音频。
  • 播客: 将准备好的脚本转换为语音节目。
  • 培训材料: 为内部课程和教程添加旁白。
  • 无障碍: 为书面数字内容创建音频替代版本。
  • 应用语音: 将生成语音集成到原型和工具。

价格

本次审核网站提供在线试用流程,但没有公布标准付费套餐或详细用量额度。处理大型项目之前应确认当前限制。

常见问题

Kokoro 模型有多大?

当前网站将其描述为 8200 万参数模型。

列出了哪些语言?

网站列出美式和英式英语、法语、韩语、日语和普通话。

可以处理长文档吗?

网站称支持对长内容自动识别章节和段落。

返回产品导航

相关产品

Anijam 将文本、脚本、图片或音频转成动画视频,由 AI 管理场景、角色一致性、口型、配音和时间线编辑。

AnyModel 将同一提示词发送给多个文本或图像模型,并通过一个托管账户并排展示结果。

Artisk 使用 AI 帮助创建专业品牌套件和标志。

邮件订阅

持续发现实用 AI 产品

定期接收精选产品、真实使用场景和开发者动态。