仕組み
クリーンなサンプルを録音
静かな部屋、単一の話者、音楽なし、自然な話し方により、モデルは音声の正確な特性を捉えることができます。サンプルの長さより品質が重要です。短いクリーンなクリップでも使用可能なクローンを作成できます。
クローンを作成
サンプルをオーディオスタジオにアップロードすると、モデルが音声の独自の特性を抽出します。クレジットコストは実行前に表示されます。
テキストを入力して音声で聞く
クローンはパーソナルテキスト音声変換ツールのように機能します。スクリプトを書いてその音声でナレーションを生成したり、失敗した部分を再録音なしで修正したり、オーディオをリップシンク対応のアバタービデオに入力できます。
今すぐ使えるモデル
以下の各モデルは、スタジオで使用されているのと同じ価格エンジンから現在のクレジットコストを取得して、Artezaでライブ配信されています。
よくある質問
音声をクローン化するのに必要なオーディオの長さはどのくらい?
最新のモデルは1分未満のクリーンで単一話者のオーディオからでも実用的なクローンを作成できます。より長く多様なサンプルを使用すると精度が向上し、特に表現力豊かなアクセント付きの音声に効果的です。
音声クローン化は合法ですか?
自分の音声、または所有者の明示的な許可を得た音声をクローン化することが認められた使用方法です。同意なしに他人の音声をクローン化することは、多くの地域で肖像権、詐欺、なりすまし法に違反する可能性があります。
クローン化するための音声サンプルがない場合はどうすればいい?
同じページに2つの代替案があります。MiniMax Voice Designはテキスト説明から完全にカスタムな新しい音声を作成し、ElevenLabs TTSは大規模な既製の自然な音声ライブラリを提供します。クローン化が必要なのは特定の実在する音声が必要な場合だけです。
クローン化された音声で何ができますか?
すべてのテイクを録音せずにビデオをナレーションしたり、コンテンツ全体で一貫した音声を保つ、スクリプトをローカライズしながら話者の特性を保持する、リップシンク対応のアバタービデオを駆動できます。ElevenLabs Voice Convertは既存の録音を別の音声に変換することもできます。