该来源未收录可展示正文,站内仅提供摘要。
字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互
AI 导读
字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现“边看、边听、边说”的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。
该来源未收录可展示正文,站内仅提供摘要。
来源:字节 Seed:Research Feed(网页内嵌数据)· seed.bytedance.com