技术标签共 3 个项目合计 ★ 111,541平均 ★ 37,180
text-to-speech 开源项目合集
这里聚合了 3 个与 text-to-speech 相关的开源项目,适合快速判断哪些工具值得继续深入。
语言构成Python · 3
高星代表
这个分组里最值得先看的 3 个
★ 76,424No.1
unslothai/unsloth
Unsloth 是一个本地 AI 模型训练与推理一体化平台,提供 Web 界面 (Studio) 和 Python 库 (Core),支持文本、音频、视觉等多模态模型,通过优化内核实现 2 倍训练加速与 70% VRAM 节省。
Python★ 33,049No.2
debpalash/VoiceStudio
VoiceStudio 是开源的本地优先语音工作室,定位为 ElevenLabs 的开源替代方案,支持声音克隆、视频配音、语音听写、转录、有声书制作等能力,覆盖 646 种语言,无需账号、API 密钥或订阅即可本地使用。
Python★ 2,068No.3
fikrikarim/parlor
Parlor 是一个完全本地运行的多模态 AI 应用,支持实时语音和视觉对话,使用 Gemma 4 E2B 理解语音图像,Kokoro TTS 生成回复,无需云端服务,保护隐私并降低延迟。
Python