Hojo-TTS-Light 是由 HojoAI 团队开发的一款开源轻量级文本转语音模型。超级小的tts,cpu就能跑,不需要显卡,也不需要很大的库。
Hojo-TTS-Light-40M 支持15个内置语音,其中2个用于中文,13个用于英语。Hojo-TTS-Light-80M 还支持带有几秒音频的语音克隆。
特点:超轻量级核心模型---核心语言模型仅有80M和40M参数,参数大小极小,且在相同音质下极小,部署门槛极低。原生双语集成 ---单一模型支持中文和英语的流畅合成,无需分支切换。低计算成本和设备友好性 --- 低内存使用和低推理开销,可在CPU、普通GPU和嵌入式边缘设备上流畅运行。即用 --- 提供简单的推理脚本和快速调用接口,实现一行代码的综合和克隆,便于二级开发和业务集成。支持快速纠正 ---针对中英多音字符及专有名词容易发音错误的问题,用户可以直接使用拼音纠正发音错误,提高语音合成的可靠性。
项目地址:github.com/HojoAI/Hojo-TTS-Light/tree/main