ByteDance、多言語音声生成用「Seed Audio 1.0」をリリース

iconKuCoinFlash
共有
AI summary icon概要
ByteDance Seedは7月22日、単一のプロンプトから会話、環境音、効果音を生成する多言語オーディオモデル「Seed Audio 1.0」をリリースしました。このモデルは20以上の言語をサポートし、ボイスの一貫性と感情制御が可能で、100msの精度で2分間のオーディオを生成できます。出力の90%以上が実用可能で、自然性において最高得点を記録しています。注目のアルトコインの上昇を待つ中、このツールは現在、Volcano Ark Experience CenterでAPIを通じて利用可能です。

MEニュース:7月22日(UTC+8)、動察Beatingの監視によると、字節跳動Seedは音声創作モデル「Seed Audio 1.0」をリリースしました。このモデルは、1つのプロンプトでセリフ、効果音、環境音を同時に生成し、タイムラインに沿って音声の登場を制御できます。モデルはテキストと参照音声の入力をサポートし、時間制御の精度は100msです。1回の生成で約2分の音声を生成でき、さらに延長可能で、キャラクターの音色を一貫して維持します。Seed Audio 1.0は20以上の言語をサポートしており、同じ音色を言語間で移行でき、トーンや感情を切り替えることも可能です。公式評価では、ほとんどのシナリオで音声の利用可能性が90%以上であり、ほとんどの言語で自然度MOSが4点を超えています。モデルは火山方舟体験センターに公開され、APIアクセスも開放されています。(出典:BlockBeats)

免責事項: 本ページの情報はサードパーティからのものであり、必ずしもKuCoinの見解や意見を反映しているわけではありません。この内容は一般的な情報提供のみを目的として提供されており、いかなる種類の表明や保証もなく、金融または投資助言として解釈されるものでもありません。KuCoinは誤記や脱落、またはこの情報の使用に起因するいかなる結果に対しても責任を負いません。 デジタル資産への投資にはリスクが伴います。商品のリスクとリスク許容度をご自身の財務状況に基づいて慎重に評価してください。詳しくは利用規約およびリスク開示を参照してください。