S
SpeechT5
microsoft/speech-t5
微软的统一语音-文本模型,支持语音合成、识别、声音转换和语音翻译。
★6.0kstars
Python
MIT
更新:
📋 项目速览
点击展开
这是什么?用Python构建、打造开源模型项目,专注speech和tts方向
作者是谁?由 microsoft 团队维护,GitHub 6K⭐,在 模型 分类 3201 个项目中排名第 250
为什么诞生?speech在模型中的需求持续增长,microsoft发现现有方案不够直观,于是创造了SpeechT5来降低tts使用门槛。
能干什么?核心场景:统一模型、语音合成、语音识别
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/microsoft/speech-t5
🔗 github.com/microsoft/speech-t5
标签
speechttsasrvoice-conversion
适用场景
统一模型语音合成语音识别