Seedance 2.5 + その他への 1 日間の無制限アクセスを取得最大 25% オフ

割引は -- で終了します

このアプリで作成

0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00

Seed Audio 1.0は、テキストの説明を表現力豊かなスピーチ、複数キャラクターのダイアログ、レイヤード音声シーンに変換するプロンプト駆動型オーディオ生成アプリです。1回の処理で完成します。ByteDance Seed Audio 1.0を基盤としており、英語と中国語をサポートし、画像または最大3つのリファレンスオーディオクリップを受け付けて音声キャラクターをコントロールできます。すでにクローンした音声を再利用することもできます。ポッドキャスター、ゲームライター、アニメーター、言語制作者、そして録音スタジオなしでプロダクションレベルのオーディオが必要な誰もが使用できます。

このアプリの使い方

  1. 1

    作成したいものを説明するか、ソースファイルをアップロードしてください。

  2. 2

    オプションを選択して、「生成」を押してください。

  3. 3

    数秒でギャラリーに結果が表示されます。

  4. 4

    ダウンロード、シェア、または新しいアイデアで再度生成できます。

作成できるもの

複数キャラクターダイアログ制作

2人以上のスピーカーが登場するシーンを書き、Seed Audio 1.0に各音声を異なるキャラクターと感情で描画させます。各役にリファレンスクリップを組み合わせれば、エピソード全体で一貫した音声トーンをロックでき、シリーズ化されたポッドキャスト、オーディオブック、インタラクティブフィクションに実用的です。

バイリンガルナレーション・ボイスオーバー

1つのプロンプト内で英語と中国語が自然に切り替わるナレーションを生成します。バイリンガルなe-ラーニングモジュール、国境を越えた視聴者を対象とした製品デモ、両言語の話者に対応する纪录风のコンテンツに有用で、再録音セッションの手間がかかりません。

アンビエント音声シーン設計

雨降る市場の夕暮れや、故障中のハードウェアのうなりが響くサーバールームなど、音声環境を描写して、最大2分間のレイヤード音声シーンを受け取ります。ゲーム開発者と映画音響デザイナーは、これらを参考ベッドや制作初期段階のプレースホルダートラックとして使用できます。

画像操舵音声キャスティング

キャラクターイラストやポートレートを供給すると、モデルがビジュアルから音声品質を推測します。このショートカットにより、コンセプトアーティストとワールドビルダーは、任意の録音決定の前に、音声を未キャストのキャラクターに素早くマッチさせることができます。

クローン音声アセット再利用

Artezaの他の場所ですでにクローンした音声がある場合、ここで直接参照して、ブランドナレーター、フィクション主人公、または個人の音声シグネチャーを複数のプロジェクト全体で一貫性を保つことができ、ソースオーディオを毎回再アップロードする手間が省けます。

試すプロンプトのアイデア

クリエイターがこのアプリを使う理由

  • プロンプト駆動型シーン
  • 画像またはオーディオ操作
  • 英語と中国語
  • クローン音声の再利用
  • 速度、音量、ピッチ制御
  • 最大2分

より良い結果のためのヒント

リファレンスクリップで音声をアンカーする

キャラクターの音声テクスチャ、アクセント、年齢を指定するために、最大3つの短いリファレンスオーディオクリップをアップロードします。クリップの録音品質とトーンが一貫しているほど、Seed Audio 1.0は複数の生成全体で目標音声をより確実にマッチさせることができます。

未キャストキャラクターに画像操舵を使用する

キャラクターアートがあるが、リファレンス音声がない場合、画像を操舵入力として添付します。モデルは見かけの年齢、姿勢、表現などのビジュアル手がかりを読み取り、音声品質に反映させるため、ゼロからリファレンスクリップをソースまたは録音する手間が省けます。

音声環境について明確に説明する

音声シーンの場合、プロンプトで前景と背景の両レイヤーを記述します。空間、音声源の距離、大聖堂のリバーブやアナイコイックルームの平坦さなど、必要なアンビエントテクスチャを名付けることで、モデルが2分間の制限内でより明確なパラメータを持つことができます。

2分間の上限内で長さを計画する

Seed Audio 1.0は1回の生成につき最大2分間のオーディオをサポートします。ダイアログの場合、プロンプトする前にスクリプトの単語数を大まかに計画してください。英語の音声は1分あたり約130語ですので、200語の交換は余裕を持って収まり、一時停止とアンビエント詳細の余地が残ります。

このアプリを選ぶべき場面

このアプリは、プロジェクトが1回の生成で音声と環境を組み合わせる場合、操舵可能な音声アイデンティティを持つ複数キャラクターダイアログが必要な場合、またはバイリンガルの英語と中国語の出力が必要な場合に選択してください。現在のところArtezaでこのカテゴリに対応するシスターアプリがリストされていないため、Seed Audio 1.0の最も明確な使用ケースは、プロンプト駆動のシーン構築、画像またはオーディオ操舵、クローン音声再利用の組み合わせです。これは、スピーチ、キャラクター、アンビエンスを1つのワークフロー内で扱うオーディオクリエーター向けに特別に設計されたツールセットです。

よくある質問

同じオーディオ生成内で英語と中国語の両方を使用できますか?

はい。Seed Audio 1.0は英語と中国語をサポートしており、バイリンガルプロンプトを書いて、1つのオーディオファイル内で両言語の間を自然に移動する出力を生成できます。これは両言語の話者に対応するように設計されたナレーションまたはダイアログシーンに特に有用です。

音声をコントロールするために、何個のリファレンスオーディオクリップをアップロードできますか?

1つの音声につき最大3つのリファレンスオーディオクリップを提供できます。一貫した録音品質と音声トーンを共有する複数のクリップを使用すると、モデルに強い信号が与えられ、通常は1つの短いサンプルに依存するよりも正確で反復可能な結果が生成されます。

1回の処理で生成できるオーディオの最大長は?

1回の生成につき最大2分間のオーディオを生成できます。スクリプトまたはシーンコンセプトがより長い場合は、その制限内に収まるセグメントに分割し、クローンされたリファレンス音声を使用してセグメント全体で一貫性を保つことを計画して、編集ワークフロー内で結合してください。

記録の代わりにキャラクターイラストで音声をコントロールできますか?

はい。画像操舵機能はポートレートまたはキャラクターイラストを受け付け、ビジュアル情報を使用して音声キャラクターに反映させます。これは、キャラクターアートワークが存在するが、音声俳優またはリファレンス録音がまだ選択または録音されていない制作初期段階で有用です。

複数のプロジェクト全体で同じ音声を一貫性を保つにはどうしたらいいですか?

Artezaでクローンした音声がある場合、Seed Audio 1.0は新しい生成で直接その音声を参照できます。これは、ブランドナレーター、登場人物、または自分の音声シグネチャーを、新しいプロジェクトを開始するたびに新鮮なリファレンスマテリアルをアップロードせずに再利用できるということです。

このアプリはスピーチ以外のアンビエント環境などのオーディオ生成に適していますか?

はい。Seed Audio 1.0はスピーチだけでなく、サウンドシーン生成用に設計されています。純粋に環境的な説明、場所、テクスチャ、レイヤード音声源を指定するプロンプトを書いて、ダイアログやナレーションなしのアンビエントベッド、大気背景、または空間オーディオスケッチを生成できます。

費用はいくらですか?

各生成には 1 クレジットかかります。新規アカウントは試用用の無料クレジットを獲得します。

このアプリはどのAIモデルで動作していますか?

このアプリはSeed Audio 1.0で動作し、Artezaを通じて利用でき、別のアカウントやセットアップは不要です。

生成した結果を商用利用できますか?

はい。生成したコンテンツはご自身でご利用いただけます。当社のコンテンツライセンスに従ってください。

生成にはどのくらい時間がかかりますか?

ほとんどの生成は1分以内に完了し、ギャラリーでリアルタイムで進捗を確認できます。

他のアプリを探索