この記事で分かること
ElevenLabsで日本語ナレーションを作る基本は、アカウントを用意し、Voiceを選び、日本語の文章を入力して音声を生成する流れです。Web版では「日本語」を選ぶ専用設定があるわけではなく、入力文から言語が判定されます。
この記事では、ElevenLabs公式のText to Speechガイドと、2026年8月14日にHumanが確認したElevenCreativeのWeb画面に沿って、登録からMP3のダウンロードまでを7ステップで整理します。画面名や位置は今後変わる可能性があるため、表示が異なる場合は公式ガイドと現在の画面を優先してください。
広告・PRこのセクションにはアフィリエイト広告が含まれます。掲載内容と判断基準は、報酬の有無によって変更しません。
始める前に準備するもの
- ElevenLabsへ登録するメールアドレスまたは利用できるログイン方法
- 公開しても問題のない短い日本語原稿
- イヤホンまたは音声を確認できる環境
- 商用利用する場合は有料プランの確認
最初の原稿は100〜200文字程度で十分です。顧客情報、個人情報、社内の未公開情報、権利を持たない文章、他者の声は使わないでください。
商品紹介や仕事の動画に使う予定なら、登録・生成の前にElevenLabsの無料プランと商用利用の違い、プランの選び方を確認してください。操作だけを非商用で試す段階と、仕事へ使う音声を作る段階を分けておくと、生成後の作り直しを避けやすくなります。
日本語ナレーションを作る7ステップ
1. アカウントを作成する
ElevenLabsの登録画面を開き、案内に沿ってアカウントを作成します。公式Billingドキュメントでは、登録するとFreeプランが割り当てられると説明されています。
2026年8月14日の日本語表示では、アカウントメニューの「サブスクリプション」で現在のプランを確認できました。Humanの画面ではFreeプラン、月額0ドル、月10,000クレジットと表示されていました。個人アカウント固有の使用量は、料金判断に不要なため掲載していません。
2. 「テキスト読み上げ」を開く
ElevenCreativeの左側メニューから「テキスト読み上げ」を開きます。これは公式ガイドでText to Speechと表記される機能です。
2026年8月14日の画面では、入力欄とVoice、モデル、設定、生成ボタンを同じ作業画面で確認できました。配置は変わる可能性があるため、ボタンの位置より表示名を目印にしてください。
3. Voiceを選ぶ
「ボイス」またはVoice名が表示された箇所を開き、用途に近い声を1つ選びます。最初から多数のVoiceを比較すると判断しにくいため、まず1つで最後まで生成し、そのあと同じ原稿でもう1つだけ比較します。
今回のHuman Testでは、Roger - Laid-Back, Casual, ResonantとAnika - Clear, Warm and Professionalを確認しました。Voiceを変えるとテンポや聞きやすさが変わりましたが、これは今回の2つのVoiceと原稿での結果です。
4. 日本語の文章を入力する
入力欄へ日本語の文章を貼り付けます。Web版は文章の文脈から言語を自動判定するため、日本語の専用スイッチを探す必要はありません。
ElevenLabs公式ガイド(外部サイトを新しいタブで開く)は、1つの入力欄へ複数言語を混ぜると判定が難しくなる場合があると説明しています。最初は日本語だけの文章を使い、固有名詞や英単語は別のテストで確認すると原因を切り分けやすくなります。
5. モデルと設定を記録する
2026年8月14日の画面では、「モデル」からEleven Multilingual v2を選べました。「その他のオプション」では、速度、安定性、類似性、スタイルの誇張などの項目が表示されました。
初回は表示された設定を記録して生成し、変更する場合も一度に1項目だけにします。公式ガイドでは、Voice、モデル、設定の組み合わせが結果へ影響し、同じ設定値でも毎回まったく同じ結果は保証されないと説明されています。
6. 「音声を生成」で作る
入力文、Voice、モデル、設定を確認し、「音声を生成」を押します。再生できる状態になったら、次の順で確認します。
- 文章が途中で欠けていないか
- 固有名詞、数字、助詞の読み方
- 不自然なイントネーションや間がないか
- 修正するなら、文章と設定のどちらを変えるか
今回のHuman Testでは、SCRIPT-A、Roger、Eleven Multilingual v2の1回の生成で、再生できるまで約18秒でした。これは2026年8月14日の1回の計測値であり、ElevenLabs全体の生成速度を示すものではありません。
7. 音声をダウンロードする
生成結果のダウンロードアイコンから音声を保存します。今回のHuman Testでは、MacへMP3ファイルを保存し、再生できることを確認しました。
公式ガイドでは、生成直後のダウンロードに加え、過去の生成履歴からMP3やWAVなどを選ぶ方法も案内されています。表示される形式はプランや現在の画面によって異なる可能性があるため、保存時の選択肢を確認してください。
保存後はファイルを一度再生し、最後まで音が入っているか確認します。今回のMP3は検証用の非公開資料として扱い、記事や公開アセットには追加していません。
日本語設定で迷ったときの考え方
Web版では、入力文から言語が自動判定されます。日本語の生成で迷った場合は、次の順に条件を減らします。
- 日本語だけの短い文章にする
- Voiceを1つに固定する
- 設定を記録する
- 固有名詞・数字・英単語を別々に試す
- 変更した項目を一度に1つだけ記録する
今回のテストでは、英単語よりも日本語の助詞、イントネーション、文の間に違和感が出るケースがありました。チェック対象を英単語だけに限定しないことが大切です。詳しい結果はElevenLabsの日本語音声を実測レビューで確認できます。
生成した音声を使う前に確認する
無料プランか有料プランか
Freeで生成した音声には商用ライセンスがありません。仕事や収益化するコンテンツへ使う場合は、ElevenLabsの料金・無料プラン・商用利用で条件を確認し、有料購読中に商用利用する音声を生成してください。
原稿と声の権利
自分が利用する権利を持つ原稿だけを入力します。Voice Cloningを使う場合は、声の本人から必要な同意を得て、ElevenLabsの規約と禁止用途を確認してください。
Humanによる最終確認
AI音声をそのまま公開せず、読み間違い、名前、数字、助詞、意味の変化、イントネーション、前後の欠けを人が確認します。重要な案内や契約に関わる内容は、AI音声だけへ判断を任せないでください。
まとめ:1つのVoiceと短い日本語原稿から始める
2026年8月14日に確認したElevenCreativeでは、「テキスト読み上げ」を開き、Voiceとモデルを選び、日本語を入力して「音声を生成」を押し、MP3を保存できました。
最初から多くのVoiceや設定を試さず、短い文章を1本作り、読み方とダウンロードを確認してください。商用利用する場合は、生成前に有料プランとライセンスを確認します。
よくある質問
ElevenLabsで日本語を選ぶ設定はありますか?
公式ドキュメントによると、Web版は入力した文章から言語を自動判定し、現時点では言語を直接指定できません。最初は日本語だけの短い文章で試してください。
どのVoiceを選べばよいですか?
用途と原稿によって変わるため、最初は1つで最後まで生成し、次に同じ原稿でもう1つだけ比較します。今回確認した2つのVoiceでも、テンポと日本語の聞こえ方に差がありました。
生成した音声はどこからダウンロードできますか?
2026年8月14日のHuman Testでは、生成結果のダウンロードからMP3をMacへ保存し、再生できました。公式ガイドでは生成直後と履歴からのダウンロードが案内されています。
同じ設定なら毎回同じ音声になりますか?
公式ガイドは生成が非決定的で、同じスライダー値でも毎回同じ結果が保証されないと説明しています。重要な読み方は生成ごとにHumanが確認してください。
無料プランで作った音声を仕事に使えますか?
使えません。無料プランには商用ライセンスがないため、仕事へ使う音声は有料プランの条件を確認し、有料購読中に生成してください。
現在地から、次の一歩へ
この記事はGrowth MapのSTEP 2:つくるに位置します。このSTEPの詳細を見る
このSTEPで学べること
- Mission・Vision・コピーとターゲット
- ブランドマスター
- Web・SNS構成
- 写真管理とAI指示書
実践する道具も確認したい方へ。用途と確認方法からツールを探す
