ByteDance Seed · 音频与多模态交互·· 2026-08-05精选AI 评分83
字节 Seed 发布 SeedRealtime 音视频全双工大模型,已在豆包 App 全量上线
SeedRealtime 音视频全双工大模型发布:走向全模态自然交互
AI 导读
字节 Seed 正式推出原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持在连续多模态流上实时交互。官方称端到端人工评测中,相比级联模型音视频对话节奏问题减少一半,单次对话顺畅完整交流的概率明显提升。该模型已在豆包 App 全量上线,更新后在对话框选择打电话进入视频通话即可体验。
推荐理由
官方披露了统一架构、端到端评测口径与豆包全量上线入口,可据此判断全双工音视频交互的落地形态。
来源:ByteDance Seed · 音频与多模态交互 · seed.bytedance.com