このアプリで作成
Your order of three items ships Tuesday, March 4th and arrives within five to seven business days. Total charged $42.80. Reference number A-729B. Questions? Reply to this message anytime.
The studio is quiet now. Outside, the last train of the evening pulls away from the platform, and for a moment the whole building seems to listen. She sets down the script, closes her eyes, and begins again from the top, slower this time, letting each line finish before the next one starts.
今年的春茶刚到你先闻闻香再慢慢喝难怪外面下这么大的雨这里还坐得满满的
You came. I thought the rain would keep you at home. The rain is why I came. Nobody cues in this.
El estudio está tranquilo ahora. Afuera, el último tren de la noche se aleja del andén, y por un momento, todo el edificio parece escuchar. Ella deja el guión, cierra los ojos y comienza de nuevo desde el principio, más despacio esta vez, dejando que cada línea termine antes de que comience la siguiente.
Turn left and 200 meters, then continue straight for one and a half kilometers. Traffic ahead is lighter than usual, so you are running about four minutes early.
الاستوديو هادئ الآن. في الخارج يغادر آخر قطار في المساء من الرصيف. وللحظة يبدو أن المبنى بأكمله يستمع. تضع النص، تغلق عينيها، وتبدأ من جديد من البداية ببطء هذه المرة. تترك كل سطر ينتهي قبل أن يبدأ السطر التالي.
귀하의 3가지 품목 주문은 3월 4일 화요일에 발송되며 영업일 기준 5일에서 7일 이내에 도착합니다. 총 청구 금액 42달러 80센트. 참조번호 A729B. 질문이 있으신가요? 언제든지 이 메시지에 회신하세요.
Whisper Transcription は、正確で読みやすいテキストに音声を変換し、同期したタイムスタンプとすぐに使用できる SRT 字幕ファイルを提供します。 Whisper 音声認識モデルを基盤とするこのアプリは、コンテンツクリエイター、ジャーナリスト、研究者、教育者、そして録音された音声から信頼性の高い字幕または検索可能なトランスクリプトが必要なすべての人に向けられています。 99 の言語を認識し、話されている言語を自動的に検出し、手動での字幕作業なしに、多言語プロジェクト、国際的なインタビュー、グローバルメディア制作に適しています。
このアプリの使い方
- 1
作成したいものを説明するか、ソースファイルをアップロードしてください。
- 2
オプションを選択して、「生成」を押してください。
- 3
数秒でギャラリーに結果が表示されます。
- 4
ダウンロード、シェア、または新しいアイデアで再度生成できます。
作成できるもの
動画コンテンツの字幕作成
録画された動画の音声トラックをアップロードすると、編集ソフトウェアにそのままドロップできる書式設定済みの SRT ファイルが提供されます。 タイムスタンプは音声と正確に一致し、YouTube 動画、コース記録、ソーシャルメディアクリップの字幕を手動で入力する時間を節約します。
インタビューやポッドキャストの文字起こし
ジャーナリストやポッドキャスターは、長時間の録音を検索可能なテキストに変換できます。 SRT の各行には開始時間と終了時間が記載されているため、記事、ショウノート、またはエピソード概要を作成する際に、トランスクリプトで見つけた引用を元の録音で数秒以内に特定できます。
多言語研究の文字起こし
99 の言語に対応しているため、研究者は国際的なフィールド記録、口述歴史、または多言語グループインタビューにおいて、各言語に特化した人間のトランスクライバーを調達することなくトランスクリプトを作成できます。
アクセシビリティ字幕の作成
トレーニングビデオ、ウェビナー、またはパブリック向けのメディアを制作する組織は、SRT 出力を利用して法的要件を満たすクローズドキャプションを追加し、聴覚障害者や難聴者のためのアクセシビリティを向上させることができます。字幕作成業務を外部委託する必要はありません。
会議および講義の議事録
チームミーティング、大学の講義、または顧客との通話を録音し、音声ファイルをアップロードしてタイムスタンプ付きのトランスクリプトを生成します。 テキスト出力により、長時間の録音からアクションアイテム、重要な決定事項、または学習ノートを簡単に抽出できます。
クリエイターがこのアプリを使う理由
- タイムスタンプ
- SRT出力
- 99言語
より良い結果のためのヒント
クリアでノイズの少ない音声を使用する
Whisper Transcription は、バックグラウンドノイズが最小限の場合に最適です。 ソース録音に大きな環境音や音楽が含まれている場合は、最初にノイズリダクションツールを使用して処理してください。 音声がクリアであるほど、転写エラーは少なくなり、タイムスタンプの配置も正確になります。
音声ファイルのみをアップロードする
このアプリは音声ファイルを対象としているため、動画からオーディオトラックをエクスポートまたは抽出してからアップロードしてください。 同じ録音のプレーンな MP3 または WAV ファイルは、フル動画と同じように正確に転写され、より高速にアップロードされます。
1 つのファイルを 1 つの言語にする
話されている言語は自動的に検出されるため、設定する必要はありません。 音声がノイズが多くてすでに話されている言語がわかっている場合は、ピン留めできる言語ピッカーを用意していますが、自動設定のままにしておくのがほとんどの場合に最適な選択肢です。 また、リストされていない言語にも対応しています。
SRT 出力を編集に活用する
SRT ファイルは、動画エディターや字幕プラットフォームへの直接インポートに適した書式です。 平文トランスクリプトとともに保存されているため、音声ファイルを 2 回処理することなく、人間が読めるバージョンと制作対応の字幕ファイルの両方を作成できます。
このアプリを選ぶべき場面
Whisper Transcription は、特に複数の言語にわたって、音声から正確なテキストまたはタイムスタンプ付きの字幕を主要な成果物とする場合に最適な選択肢です。 一般的な目的のツールが文字起こしを二次機能として扱うのとは異なり、このアプリは字幕とトランスクリプトのワークフロー専用に設計されており、SRT 出力とタイムスタンプを出力として最初から提供します。
よくある質問
Whisper Transcription はどの音声形式を受け付けますか?
アップロードフィールドには、MP3、WAV、OGG、WebM などの音声ファイルが受け入れられます。 動画ファイルは対象外であるため、ソースが動画の場合は、まずオーディオトラックをエクスポートまたは抽出してからアップロードしてください。
SRT 出力におけるタイムスタンプの精度はどのくらいですか?
タイムスタンプは文またはフレーズレベルで生成され、音声と同期されます。 精度はオーディオの明瞭さと話し方のペースによって異なります。 明確で一定のペースでの話し方は最も正確なタイムスタンプのアライメントをもたらし、非常に速い話し方や強いアクセントではわずかなオフセットが生じる可能性があります。
話されている言語をアプリに伝える必要がありますか?
いいえ。 検出がデフォルトであり、Whisper が認識するすべての 99 の言語が含まれています。 音声がノイズが多くてすでに話されている言語がわかっている場合は、ピン留めできる言語ピッカーを用意していますが、自動設定のままにしておくのがほとんどの場合に最適な選択肢です。 また、リストされていない言語にも対応しています。
トランスクリプトには誰が話しているかが記載されていますか?
いいえ。 出力は連続したトランスクリプトとセグメントタイムスタンプ付きの SRT ファイルであり、発言者のラベルはありません。 インタビューやパネルディスカッションでは、タイムスタンプを使用して録音をステップスルーして属性を割り当てながら編集できますが、アプリは個々の声の名前を区別したり名前を付けたりしません。
SRT ファイルを動画編集ソフトウェアに直接使用できますか?
はい。 SRT ファイルは、Premiere Pro、DaVinci Resolve、Final Cut Pro、およびほとんどのオンラインビデオプラットフォームを含むツールでサポートされている普遍的な字幕標準です。 SRT ファイルをダウンロードして変換やリフォーマットなしで字幕トラックとしてインポートしてください。
アプリが処理できる音声ファイルの最大長はありますか?
このアプリは、インタビュー、講義、会議などの実用的な文字起こしタスク向けに設計されています。 非常に長い録音(マルチイベントなど)は、処理の信頼性を維持し、結果として得られるトランスクリプトをレビューおよび編集しやすくするために、より短いセグメントに分割することをお勧めします。
費用はいくらですか?
各生成には 1 クレジットかかります。新規アカウントは試用用の無料クレジットを獲得します。
このアプリはどのAIモデルで動作していますか?
このアプリはWhisper Transcriptionで動作し、Artezaを通じて利用でき、別のアカウントやセットアップは不要です。
生成した結果を商用利用できますか?
はい。生成したコンテンツはご自身でご利用いただけます。当社のコンテンツライセンスに従ってください。
生成にはどのくらい時間がかかりますか?
ほとんどの生成は1分以内に完了し、ギャラリーでリアルタイムで進捗を確認できます。