跳到主要内容

Kokoro-82M

GitHub ⭐ 12000许可:Apache 2.0模型类型:轻量级多语言 TTS

仅 82M 参数的高性能多语言 TTS 模型,Apache 2.0 可商用,4GB VRAM 即可运行。

中文英语日语韩语法语
轻量多语言Apache 2.0边缘部署

Kokoro-82M 以仅 82M 参数实现了令人印象深刻的高质量语音合成效果,而其训练数据不足 100 小时。这一特性使得 Kokoro 成为轻量级 TTS 领域的标杆模型,极低的参数量意味着它可以在资源受限的设备上高效运行,同时保持令人满意的合成质量。

在性能方面,Kokoro-82M 在 NVIDIA T4 GPU 上可实现 32 倍实时率的合成速度,即使在 CPU 上也能达到 2 到 3 倍实时率。内存占用仅需约 400MB,配合 4GB VRAM 即可流畅运行,这使得它成为边缘部署和高并发服务的理想选择。模型支持中文、英语、日语、韩语和法语等多种语言。

Kokoro-82M 采用 Apache 2.0 协议发布,可免费用于商业用途。无论是部署在物联网设备上,还是作为大规模语音合成服务的后端引擎,Kokoro 都能以极低的成本提供稳定的语音输出能力。访问 Kokoro GitHub 仓库

标签:轻量多语言Apache 2.0边缘部署
分享:X