公众号:火山引擎
精选
71AI 编辑部评分,满分 100

豆包音频生成模型1.0发布,重新定义AI音频创作

2026-06-23 13:41· 45天前· 火山引擎
AI 导读

火山引擎正式发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0),支持文本与音频参考生成,端到端输出目标音频。单条Prompt可编排多角色对白、情绪语气、背景音乐及环境氛围,长时生成中保持多角色音色一致性,无需后期多轨混音。模型支持0样本多模态输入,无需额外训练即可生成;实现音色与风格解耦控制及“一声多角”能力。一次支持2分钟音频创作,多次延长保持音色统一。已开启火山方舟API邀测,个人用户享30分钟创作额度,即将上线剪映、即梦、番茄等产品。

推荐理由

豆包音频生成模型把多角色配音、音效、配乐压缩进一条 Prompt,长时一致性解决了一直以来‘串戏’的痛点,音频创作者的生产流程可能会被改写。

公众号正文需在微信内阅读,站内仅提供摘要。

来源:公众号:火山引擎 · mp.weixin.qq.com

豆包音频生成模型1.0发布,重新定义AI音频创作

公众号:火山引擎·2026-06-23 13:41·45天前·火山引擎
AI 导读

火山引擎正式发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0),支持文本与音频参考生成,端到端输出目标音频。单条Prompt可编排多角色对白、情绪语气、背景音乐及环境氛围,长时生成中保持多角色音色一致性,无需后期多轨混音。模型支持0样本多模态输入,无需额外训练即可生成;实现音色与风格解耦控制及“一声多角”能力。一次支持2分钟音频创作,多次延长保持音色统一。已开启火山方舟API邀测,个人用户享30分钟创作额度,即将上线剪映、即梦、番茄等产品。

公众号正文需在微信内阅读,站内仅提供摘要。

来源:公众号:火山引擎· mp.weixin.qq.com