文字起こしの方法

動画用のAIボイスオーバーの作り方(ステップ・バイ・ステップ)

映像と原稿はある。でも、信頼できるマイクも - カメラの前で使いたい声も - ない。AIボイスオーバーがそれを解決します。原稿を貼り付け、ボイスを選び、MP3をダウンロードして、カットに合わせるだけ。ここでは、最初から最後までの一連の流れを、約5分で紹介します。

必要なもの

  • あなたの原稿(またはナレーションを入れたいセリフ)。
  • 無料のSpeechoアカウント - 音声生成はアカウント専用で、クリップとクレジットがあなたのものとして保存されます。
  • いつもの動画編集ソフト(Premiere、DaVinci Resolve、Final Cut、CapCut - MP3を読み込めるものなら何でも)。

ステップ1 - ボイスタブを開いて原稿を貼り付ける

アプリでテキスト読み上げタブに切り替え、ナレーションをテキストボックスに貼り付けます。一度に最大20,000文字 - 約20分の音声 - まで処理できるので、たいていの動画は1本まるごと収まります。もっと長い場合は、シーン単位のまとまりに分割してください。どのみちタイムラインには別々に配置することになります。

ステップ2 - 品質ティアを選ぶ

3つのティアが表示されます。動画に合わせて選びましょう。

  • Standard(OpenAI) - クリアで自然、最も安く、50以上の言語に対応。チュートリアルや下書きに最適。
  • Enhanced(ElevenLabs Flash) - よりリアルで表現豊か。公開する動画のほとんどにちょうどいい標準の選択肢。
  • Premium(ElevenLabs Multilingual v2) - 最も自然。看板となる動画に。

ドイツ語、スペイン語、フランス語、日本語など22言語のテキストなら、EnhancedとPremiumにはネイティブ話者の声があります - ドイツ語スペイン語フランス語日本語の音声ページ(英語)をご覧ください。

迷ったら? Enhancedから始めましょう。(詳しい解説はElevenLabs対OpenAI:あなたに必要なボイスはどっち?をご覧ください。)

ステップ3 - ボイスを選んで無料で試聴する

チャンネルのトーンに合うボイスを選んで、試聴ボタンを押します。これは無料です - 1クレジットも使わずに、すべてのボイスをあなたの言語で試聴できるので、いくつか試して自分の耳を信じましょう。

ステップ4 - MP3を生成してダウンロードする

試聴に満足したら、クリップを生成します。数秒で、結果を確認し、再生速度を調整し、標準的なMP3をダウンロードできるプレーヤーが表示されます。そのファイルはあなたのもので、いつでも再ダウンロードできます。

ステップ5 - タイムラインに配置する

MP3を編集ソフトに読み込み、映像の下に配置します。自動同期に頼らず自分で配置するからこそ、完全なコントロールが手に入ります。セリフを少しずらしてカットに合わせたり、見せ場の前に一拍の無音を入れたり、音楽の下で音量を絞ったり。この手動でのコントロールこそ、原稿に合わせて編集するときに求めるものです。

クリアでテンポの良いナレーションを作るには

いくつかのコツを押さえるだけで、AIナレーションは急いだ印象ではなく、意図の伝わる仕上がりになります。

  • 息継ぎのために句読点を。 読点や句点は間になります。長い文より短い文のほうが声に出したときに聞き取りやすい - 耳のために書きましょう。
  • 読み方が難しい単語は発音どおりに表記。 名前や略語が正しく読まれないときは、発音に合わせて書きます(「Speecho」なら「スピーチョ」、「SQL」なら「シークェル」と表記する)。
  • 長い段落は分割して、シーンごとに別々のクリップにしましょう。配置しやすく、全体を再生成せずに1行だけ作り直すのも簡単です。
  • 内容にエネルギーを合わせる。 個性のあるものにはEnhancedかPremium、淡々とした事実ベースのナレーションにはStandardで十分です。

ボーナス:同じボイスオーバーを別の言語で

動画の第2言語版が欲しいですか?翻訳した原稿を貼り付けて、それに合ったボイスでボイスオーバーを生成すれば - その言語のきれいなMP3が手に入り、複製したタイムラインに配置できます。動画が録画から始まったものなら、まず文字起こしをして、Speecho内で文字起こしを翻訳してから、その翻訳を音声化することもできます。

正直な注意点を1つ:これで得られるのは別の言語のナレーションであって、自動吹き替えではありません - リップシンクも、元の話者へのタイミングの自動同期もありません。ボイスオーバー型の動画(解説動画、顔出しなしのチャンネル、製品デモ)にはまさにこれが必要なものですが、話者が映るトーキングヘッド型の動画では、セリフのタイミングを手動で合わせることになります。

費用について

文字単位の料金なので、ボイスオーバーは安く済みます。3分の解説動画で約3,000文字 - Standardなら約30セントEnhancedなら約60セントです。$5からチャージでき、クレジットは無期限なので、少し多めに買っても無駄になることはありません。料金の詳細をご覧ください。

次の動画に声を吹き込む準備はできましたか?ボイスタブを開いて、原稿を貼り付け、ボイスを無料で試聴してみましょう。

音声トラックが必要ですか? 原稿を音声に変換する → 15分無料 · クレジットは無期限 · サブスクなし

次に読む

文字起こしの方法

手書きをテキストに変換する方法 - AIが読み取れるページの撮り方

正しく撮れば、スマホの写真で十分です。手書きページの撮り方、スキャナーを使うべき場面、AIがまだ読み間違えるもの、そして結果を信用する前の確認方法を紹介します。

2026年9月11日 · 5 分で読了
文字起こしの方法

引用から何を削ってよいか。APの規則、タイムズの規則、そしてAI文字起こしの立ち位置

報道機関のスタイルブックは「えー」を落としてよい点では一致し、それ以外のほとんどで食い違います。AP、ニューヨーク・タイムズ、ワシントン・ポストが直接引用の改変について実際に何と言っているか。そして、未確認のAI文字起こしが引用可能な資料ではない理由。

2026年9月3日 · 6 分で読了
文字起こしの方法

YouTube動画の文字起こしを取得する方法

YouTubeはほぼどんな動画の文字起こしも無料で表示してくれますし、自分の動画なら字幕ファイルも渡してくれます。ボタンが今どこにあるのか、自動字幕が間違えるところ、そして元ファイルを文字起こししたほうがいい場面を解説します。

2026年8月19日 · 6 分で読了

次の録音をテキストに

音声または動画をアップロードすれば、数分できれいな文字起こし・字幕・要約・翻訳が手に入ります。

最初のファイルを無料で文字起こし → 15分無料 · クレジットは無期限 · サブスクなし