ByteDance Seed · 音频与多模态交互·· 2025-01-20精选AI 评分73
豆包实时语音大模型上线并全量开放,端到端语音对话支持随时打断
豆包实时语音大模型上线即开放!情商智商双高
AI 导读
豆包实时语音大模型正式推出,并在豆包 APP 全量开放,升级至 7.2.0 版本即可体验。该模型是语音理解与生成一体化的端到端语音系统,相比传统 ASR+LLM+TTS 级联模式,具备低时延、对话中可随时打断、情绪承接和语音指令控制等特性,主要面向中文语境,可进行英语对话但暂不支持多语种。
推荐理由
官方给出端到端语音架构、众测维度与满意度对比,可用于判断实时语音交互的落地程度与能力边界。
来源:ByteDance Seed · 音频与多模态交互 · seed.bytedance.com