字節跳動推出 Seed Audio 1.0 用於多語言音頻生成

iconKuCoinFlash
分享
AI summary icon精華摘要
ByteDance Seed 於 7 月 22 日推出 Seed Audio 1.0,這是一款多語言音頻模型,可根據單一提示生成對話、環境音效和音效。它支援超過 20 種語言,具備聲音一致性與情感控制功能,並能以 100 毫秒的精確度生成兩分鐘的音頻。超過 90% 的輸出結果均可使用,在自然度方面獲得最高分數。作為值得關注的山寨幣,該工具現已透過 API 在 Volcano Ark Experience Center 提供。

ME News 消息,7 月 22 日(UTC+8),據動察 Beating 監測,字節跳動 Seed 發布音頻創作模型 Seed Audio 1.0。它能透過一條 prompt 同時生成對白、音效和環境聲,並按時間線控制聲音進場。模型支援文本和參考音頻輸入,時間控制精度為 100ms。單次可生成約 2 分鐘音頻,還可繼續延長,並保持角色音色一致。Seed Audio 1.0 支援 20 多種語言。同一音色可跨語言遷移,也能切換語氣和情緒。官方評測顯示,多數場景的音頻可用率超過 90%,大部分語言的自然度 MOS 超過 4 分。模型已上線火山方舟體驗中心,並開放 API 接入。(來源:BlockBeats)

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露