# 字节跳动发布 Seed Audio 1.0 音频创作模型，统一建模人声与音效实现端到端影视级音频生成

- 来源：字节 Seed：Research Feed（网页内嵌数据）
- 发布时间：2026-07-20 00:00
- AIHOT 分数：79
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmrsopm9r0b7ubiwmtfvpwkxu
- 原文链接：https://seed.bytedance.com/zh/blog/%E4%BB%8E-%E4%BC%9A%E8%AF%B4-%E8%B5%B0%E5%90%91-%E4%BC%9A%E5%88%9B%E4%BD%9C-seed-audio-1-0-%E9%9F%B3%E9%A2%91%E5%88%9B%E4%BD%9C%E6%A8%A1%E5%9E%8B%E5%8F%91%E5%B8%83

## 精选理由

字节这次发布的 Seed Audio 1.0 不是又一个 TTS 模型，它把台词、音效、氛围统一编排，并支持百毫秒级时间线控制，对做视频和出海内容的团队是个立刻能用的创作升级。

## AI 摘要

字节跳动 Seed 团队发布音频创作模型 Seed Audio 1.0，在统一框架下联合建模人声、音效和环境声，支持 100ms 间隔精度的时间控制、单次约 2 分钟音频的延展生成及 20+ 语种自然生成。该模型已在火山方舟体验中心上线，多数场景音频可用率达 90% 以上，多语言音频自然度 MOS 超 4 分。

## 正文

该来源未收录可展示正文，站内仅提供摘要。
