22

07

星期三

14:53

字节Seed Audio1.0上线:一条Prompt生成对白、音效和环境声

据动察 Beating 监测,字节跳动 Seed 发布音频创作模型 Seed Audio 1.0。它能用一条 prompt 同时生成对白、音效和环境声,并按时间线控制声音进场。 模型支持文本和参考音频输入,时间控制精度为 100ms。单次可生成约 2 分钟音频,还能继续延长,并保持角色音色一致。 Seed Audio 1.0 支持 20 多种语言。同一音色可以跨语言迁移,也能切换语气和情绪。 官方评测显示,多数场景的音频可用率超过 90%。大部分语言的自然度 MOS 超过 4 分。模型已上线火山方舟体验中心,并开放 API 接入。

「查看原文」

本内容旨在传递行业动态,不构成投资建议或承诺。