返回
精选AI 评分 69/100

通义实验室发布 Wan-Streamer v0.2,端到端响应延迟仅 550ms

公众号:通义实验室(千问)·2026-07-17 15:14·46天前·通义实验室
AI 导读

通义实验室发布 Wan-Streamer v0.2,这是一款将“听、看、说、演”统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms,输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS,并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。

公众号:通义实验室(千问)
精选
69AI 编辑部评分,满分 100

通义实验室发布 Wan-Streamer v0.2,端到端响应延迟仅 550ms

2026-07-17 15:14· 46天前· 通义实验室
AI 导读

通义实验室发布 Wan-Streamer v0.2,这是一款将“听、看、说、演”统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms,输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS,并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。

推荐理由

通义实验室把实时视频交互延迟压到550ms,同时提升了分辨率,不是刷榜而是解决实际问题,对做数字人和实时助手的团队是个值得跟进的信号。

公众号正文需在微信内阅读,站内仅提供摘要。

在微信中打开原文(在新标签页打开)

来源:公众号:通义实验室(千问)· mp.weixin.qq.com