什麼是 Seed Audio 1.0?
Seed Audio 1.0 是 ByteDance Seed 的全方位音訊生成模型,用於建立完整的音景。它利用文字、圖像或音訊上下文來引導多說話者對話、情感表達、母語口音、環境音、背景音樂和擬音風格效果。它超越了單純的文字轉語音,能夠在一次創作中實現分層感知輸出,包含對話、背景音樂、環境音和音效。
如何使用 Seed Audio 1.0?
- 若要線上使用 Seed Audio 1.0,請編寫一個音景提示,描述角色、語言、情感、地點、對話、環境音、音樂方向和聲音事件。可選擇新增最多三個音訊參考或一個圖像參考。選擇輸出設定,如語音行為、格式、取樣率、速度、音量、音調和點數上限。然後在 SeedAudio.co 工作區中生成並審閱音訊,從簡短草稿開始,並根據需要進行調整。
Seed Audio 1.0 的核心功能
- 全方位音訊生成:對話、情感、環境音、背景音樂和擬音一次完成
- 多模態提示:文字、圖像和音訊上下文
- 多說話者語音連續性,適用於較長場景
- 情感和口音控制,實現自然表達
- 場景環境音和背景音樂生成
- 每次生成最長 2 分鐘的音訊場景
- 分層感知輸出,對話、背景音樂和環境音分離音軌
用戶評價
5.0
/ 50 則評價
5 星
0
4 星
0
3 星
0
2 星
0
1 星
0
暫無評價,來寫第一條吧
相似產品
Seed Audio 1.0 推廣元件
使用網站徽章展示您的產品已收錄於 Hootool,推動社群對工具發現與傳播的支持。推廣元件可輕鬆新增到首頁或頁尾。







