跳到正文
原文
ByteDance Seed · 音频与多模态交互·· 2026-07-20精选AI 评分77

字节 Seed 发布音频创作模型 Seed Audio 1.0

从“会说”走向“会创作”| Seed Audio 1.0 音频创作模型发布

AI 导读

字节 Seed 发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,端到端生成完整声音场景,并已在火山方舟体验中心上线。模型支持一条 prompt 编排对白、音效与环境声,时间控制精度达 100ms,支持零样本音色生成与参考音频延展,单次可生成约 2 分钟音频并继续延长以保持角色一致性。

推荐理由

官方披露了统一建模多要素音频、100ms 时间控制与 20+ 语种等能力,可据此判断其在配音与多语种内容生产中的可用边界。

来源:ByteDance Seed · 音频与多模态交互 · seed.bytedance.com