正文 · AI 翻译
Miso One 已上线:这是一个开源权重的语音模型,旨在听起来像真人朗读,在大多数 TTS 仍然平淡无奇的地方,它拥有真正的温暖感和节奏感。
80亿参数,在 GitHub 上免费提供,支持从短样本进行一次性语音克隆,延迟为110毫秒。
自行托管,你的音频数据永远不会离开你的机器。无需 API,无锁定。
在演示页面中输入任意一行文字,在克隆仓库之前就能听到效果。
Today, we’re excited to introduce Miso One, the most emotive voice model in the world. Miso One is an 8-billion-parameter text-to-speech model for highly expres...