AI风向标
通义实验室发布 Wan-Streamer v0.2,端到端响应延迟仅 550ms
通义实验室发布 Wan-Streamer v0.2,这是一款将"听、看、说、演"统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms,输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS,并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。
详细介绍
通义实验室发布 Wan-Streamer v0.2,这是一款将"听、看、说、演"统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms,输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS,并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。
AI HOT 详情:https://aihot.virxact.com/items/cmrolz26304oqbito42v7oeaz
原文链接:https://mp.weixin.qq.com/s/_eaO0wmsiQFGsrE2_zW_Dg
内容信息
- 分类
- 模型发布/更新
- 时间
- 2026-07-17T07:14:00.000Z
