字节 Seed:Research Feed(网页内嵌数据)
精选
78AI 编辑部评分,满分 100

字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互

2026-08-05 00:00· 12小时前
AI 导读

字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现“边看、边听、边说”的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。

推荐理由

SeedRealtime 将音视频感知与表达统一到同一端到端模型中,级联系统常见的说话节奏问题减少了一半,实时场景中能主动提醒并自然停顿,为全模态智能助手交互提供了新的技术路线。

该来源未收录可展示正文,站内仅提供摘要。

来源:字节 Seed:Research Feed(网页内嵌数据) · seed.bytedance.com

字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互

字节 Seed:Research Feed(网页内嵌数据)·2026-08-05 00:00·12小时前
AI 导读

字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现“边看、边听、边说”的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。

该来源未收录可展示正文,站内仅提供摘要。

来源:字节 Seed:Research Feed(网页内嵌数据)· seed.bytedance.com