什么是 Seed Audio 1.0?
Seed Audio 1.0 是字节跳动 Seed 的一体化音频生成模型,用于创建完整的音景。它利用文本、图像或音频上下文来引导多说话人对话、情感表达、母语口音、环境音、背景音乐和拟音风格效果。它超越了单纯的文本转语音,能够在一体化创作中实现分层感知输出,包含对话、背景音乐、环境音和音效。
如何使用 Seed Audio 1.0?
- 要在线使用 Seed Audio 1.0,请编写一个音景提示,描述角色、语言、情感、地点、对话、环境音、音乐方向和声音事件。可选添加最多三个音频参考或一个图像参考。选择输出设置,如语音行为、格式、采样率、速度、音量、音调和积分上限。然后在 SeedAudio.co 工作区中生成并审阅音频,从简短草稿开始,根据需要优化。
Seed Audio 1.0 的核心功能
- 一体化音频生成:对话、情感、环境音、背景音乐和拟音一次完成
- 多模态提示:文本、图像和音频上下文
- 多说话人语音连续性,适用于较长场景
- 情感和口音控制,实现自然表达
- 场景环境音和背景音乐生成
- 每次生成最长 2 分钟的音频场景
- 分层感知输出,对话、背景音乐和环境音分离音轨
用户评价
5.0
/ 50 条评价
5 星
0
4 星
0
3 星
0
2 星
0
1 星
0
暂无评价,来写第一条吧
相似产品
Seed Audio 1.0 推广组件
使用网站徽章展示您的产品已收录于 Hootool,帮助更多人按问题找到合适的 AI 工具。推广组件可轻松添加到主页或页脚。







