Shortsクリエイター向け

YouTube Shorts向け無料テキスト音声読み上げ

聞き飽きた定番の自動音声を卒業しませんか。Kokoroのボイスを選び、速度を1.1倍に調整すれば、自然なショート動画用ナレーションがあっという間に仕上がります。

Go ad free
Go ad free

尺調整と字幕

Working tool

YouTube Shorts音声スタジオ

15秒、30秒、60秒、90秒の尺に合わせた音声トラックを作成し、編集ですぐ使える字幕と一緒に出力できます。

0 characters

Source files are parsed locally. In Cloud mode, only the selected text sections are sent for speech generation. In-browser mode keeps both the source and generated speech on this device.

Go ad free

このツールページは未翻訳です。以下は英語版で動作します。 英語版を使う

ショート動画クリエイター

定番のありきたりな自動音声から脱却

TikTokやCapCutのおなじみの自動音声は、耳にした瞬間に視聴者が離脱してしまう原因にもなりがちです。FreeTextoSpeechの54種類のKokoroボイスなら、新鮮で自然な響きで最後まで引きつけ、チャンネル独自の印象的なトーンを作れます。

The quick answer

フック、本文、オチで構成した60秒以内の原稿を貼り付け、好みのボイス(Sky、Liam、River、Echoなど)を選びます。速度を1.1倍に設定して音声を生成したら、ダウンロードしたWAVファイルをCapCutに配置するだけです。収益化しているShortsでも商用利用が可能ですが、ニュースや健康といったジャンルでは必要に応じてAI音声の開示設定を行ってください。

かんたんな4つの手順

Shorts動画の作成フロー

  1. 01

    フック(3秒)+本編(40秒)+結論(15秒)で台本を書く

    全体の長さを60秒以内に収めます。冒頭で問いかけや印象的な主張をして興味を引き、本編で内容を伝えたら、最後に行動を促します。

  2. 02

    定番以外の声を選ぶ

    アメリカ英語ならSky、Liam、River、Echoなどが使えます。TikTokやCapCutでよくある初期設定の声は聞き飽きられやすいため、避けるのが賢明です。

  3. 03

    1.1倍速で音声を生成する

    ショート動画にぴったりのテンポ感に仕上がります。音声を生成して試聴し、WAVファイルをダウンロードしてください。登録も透かしも不要です。

  4. 04

    CapCutやDaVinciで編集する

    保存したWAVファイルをタイムラインに入れ、映像のタイミングに合わせます。あとは9:16(1080×1920)で書き出し、YouTube Shortsに投稿するだけです。

主な活用シーン

チャンネル独自の音声イメージを作る

04 scenarios
01 / 04

顔出しなしのYouTube Shorts

自分の声を一切録音せずに、特化型チャンネルの動画を毎日投稿できます。今のショート動画運営の定番スタイルです。

02 / 04

雑学・フック系動画のまとめ

豆知識や歴史のトリビア、科学のミニ解説にはAdamやOnyxが適しています。落ち着いた説得力のある声が視聴者の興味を引きつけます。

03 / 04

長尺動画の切り抜き・再編集

YouTubeの長尺動画から要点を抜き出し、聞き取りやすいナレーションをあてて60秒のShortsに再構成できます。

04 / 04

チャンネルの音声ブランディング - AI音声ジェネレーター

決まった2〜3種類のボイスを全動画で統一して使いましょう。番組の司会者を覚えるように、視聴者が声だけでチャンネルを認識してくれます。

ボイス選びのヒント

ショート動画で映える6つのボイス

ショート動画では、冒頭の勢いと耳新しさが欠かせません。聞き飽きた定番の機械音ではなく、Kokoroの6つのボイスを使えば、他チャンネルと被らない説得力のある冒頭フックや表現豊かなナレーションが作れます。

01 アメリカ英語

Sky

快活なプレゼンター風

Best for

冒頭の引きつけ、ランキング動画、テンポの速い解説に最適です。「思わずスクロールを止めてしまう」動画を作りたいときの定番です。

02 アメリカ英語

Nova

明るく親しみやすい会話調

Best for

ライフスタイル紹介、意見を述べるショート動画、「これ聞いて」といったフックに向いています。友達が話題のネタを話しかけてくるような自然さがあります。

03 アメリカ英語

Puck

コミカルで感情豊か

Best for

コントのナレーション、皮肉混じりのアフレコ、リアクション動画にぴったりです。単調なデフォルト音声とは異なり、短いセリフでもしっかり感情が伝わります。

04 アメリカ英語

Adam

説得力・惹きつける声

Best for

雑学、歴史解説、科学の豆知識に最適です。冒頭2秒で視聴者の手を止めさせる説得力があります。

05 アメリカ英語

Echo

落ち着いた知的な響き

Best for

テクノロジー、金融、生産性向上などのショート動画に向いています。講義調にならず、自然な知性を演出できます。

06 アメリカ英語

Onyx

重厚でドラマチック

Best for

怪談、ミステリー、事件解説などの動画に最適です。芯のある低音が、動画全体に本物の重みを与えます。

Want to hear them? Browse all 54 voices →

実践のヒント

60秒未満のショート動画で成果を出す実践テクニック

ショート動画の作り方は、通常の長尺動画とは根本的に異なります。完璧な声を選ぶこと以上に、冒頭のフックの速さ、全体のテンポ、無音部分の徹底的なカットが重要です。ここでお伝えする実践的な工夫を取り入れるだけで、平均視聴維持率を30%から70%へと引き上げる大きな差が生まれます。

  • 01

    冒頭2秒で視聴者を惹きつける

    ショート動画が最後まで見られるかどうかは、開始3秒以内に決まります。動画の結論や鋭い問いかけ、あるいは一番意外な事実から始めてください。「今日はこれについて話します」という前置きは完全に逆効果です。「実はこれ、ほとんどの人が勘違いしています」といった切り出し方を採用し、本題に入る前の不要な挨拶は編集で全て削りましょう。

  • 02

    再生速度を1.1倍から1.2倍に設定してテンポを作る

    標準の音声速度のままテンポの速い映像に合わせると、どうしても間延びして聞こえます。解説系なら1.1倍、勢いを重視するフックなら1.2倍を目安に調整してください。1.25倍を超えると不自然な高音になり、離脱の原因になります。まずは通常速度で音声を生成し、動画編集アプリ側で速度を微調整すると再生成の手間が省けます。

  • 03

    無音部分の徹底的なカット - AI音声ジェネレーター

    生成したWAVファイルを編集ソフトに読み込み、約250ミリ秒を超える無音部分をすべてリップル削除してください。高品質なKokoroの音声にも自然なブレス(息継ぎ)が含まれますが、長尺動画には心地よいこの間も、45秒のショート動画では離脱の引き金になります。不要な間を極限まで詰めることが、最後まで視聴維持率を高く保つ秘訣です。

  • 04

    まず紙の上で60秒の構成を組み立てる

    フック3秒+本編40秒+結び・CTA15秒=合計58秒です。1分あたり150語のペースなら約145語、文字数でおよそ830文字となり、1回の生成上限である5,000文字にも十分収まります。音声を生成する前に、この時間枠に合わせて原稿を書きましょう。

  • 05

    使われすぎている標準ボイスを避ける

    CapCutの標準音声やTikTokの内蔵音声は、普段からショート動画を見ている人なら0.5秒で気づきます。耳にした瞬間に「また量産型の動画か」と判断され、すぐにスワイプされてしまいます。Sky、Puck、EchoなどKokoroのボイスを使えば、冒頭のフックをしっかり聴いてもらえます。

  • 06

    字幕は原稿ではなく音声に合わせて同期する

    原稿テキストをそのまま貼り付けるのではなく、書き出したWAV音声をCapCutやPremiereに取り込んで自動字幕起こしを使いましょう。音声合成の間は文字の入力ペースと異なります。字幕のズレは動画のクオリティを一気に損ねる原因になります。

さらに詳しく

FreeTextoSpeechとアプリ内蔵TTSの比較

CapCutやYouTube Shortsの内蔵ボイスは手軽ですが、聞き飽きられているのが難点です。新鮮な音声と自由度の高いファイルが手に入る一方、ブラウザを開く手間が1つ増えるという違いがあります。

ボイスの新鮮さ

FreeTextoSpeech

ショート動画でまだ出回っていない、Kokoroの54種類のボイスを利用できます。

YouTube Shorts標準TTS / CapCut内蔵音声

数種類の音声が何百万本もの動画で使われており、視聴者が即座に離脱します。

表現力

FreeTextoSpeech

Kokoroのニューラルモデルが、感情の機微や皮肉、タメの利いた間まで再現します。

YouTube Shorts標準TTS / CapCut内蔵音声

機械的な一本調子で、長めの文になると抑揚が失われます。

商用利用の明確さ

FreeTextoSpeech

商用利用が明確に許可されており、クレジット表記も不要です。

YouTube Shorts標準TTS / CapCut内蔵音声

アプリの規約上プラットフォーム内に用途が縛られやすく、他SNSへ転載する際の扱いは不透明です。

透かし(ウォーターマーク)

FreeTextoSpeech

透かしなし。クレジット表記も不要です。

YouTube Shorts標準TTS / CapCut内蔵音声

CapCutは無料書き出し時に手動で消さないと透かしが入ります。

ファイルの権利と自由度

FreeTextoSpeech

生成したWAVファイルは自由に利用できます。YouTube、Instagram、TikTok、ポッドキャスト、広告など用途を問いません。

YouTube Shorts標準TTS / CapCut内蔵音声

アプリ内で音声が生成されるため、別ソフトへきれいに持ち出すのは手間がかかります。

作業の手軽さ

FreeTextoSpeech

ブラウザで開いて貼り付け、ダウンロードするだけです。編集アプリ内完結と比べると1ステップ増えます。

YouTube Shorts標準TTS / CapCut内蔵音声

動画エディタ内で直接作成できるため、画面を行き来する必要がありません。

アプリ内音声機能の仕様は変わることがあります。内蔵音声の商用利用については、各プラットフォームの最新規約をご確認ください。

FAQ

Text To Speech For Shorts FAQs

01

FreeTextoSpeechの音声を使ったYouTubeショートは収益化できますか?

はい、収益化できます。商用利用が認められた音声のため、収益化済みのショート動画でも問題ありません。なお、ニュースや健康情報などのセンシティブな分野ではYouTube側からAI音声の明示を求められる場合があります。該当する場合は申告が必要ですが、一般的な解説や朗読であれば特別なタグ付けは不要です。
02

ショート動画にはどのボイスが向いていますか?

ショート動画ではテンポの良さが重視されます。英語(US)ならSky、Nova、Liam、Riverがおすすめです。ショートに適した明るいトーンが出せます。男性ボイスならAdamやEricが自然に響きます。速度を1.1倍に少し上げると、ショート動画で好まれる歯切れのよいテンポになります。
03

ショート動画用のナレーションはどのくらいの長さまで作れますか?

YouTubeショートの上限は60秒で、単語数にするとおよそ130〜160語ほどです。FreeTextoSpeechは1回で5,000文字まで対応しているため、複数テイクの作成や後からの編集にも十分な余裕があります。
04

「いかにもAI」という声だと視聴者に気づかれないようにするには?

定番として使われすぎていないボイスを選んでみてください。TikTokやCapCutの標準音声は、いまや一瞬でAIだと分かります。FreeTextoSpeechの54種類のKokoroボイスはまだ出回りが少なく、動画に新鮮な印象を与えられます。動画ごとに声や話速を少し変えたり、チャンネルの雰囲気に合った声を選ぶのも効果的です。
05

ショート動画の視聴者にAI音声だと気づかれますか?

ほとんど気づかれません。Kokoroボイスは非常に自然で、普通の視聴者が合成音声だと意識することはまずありません。不自然さが出る原因は、長い一文での平坦な抑揚や、毎回同じリズムになる点にあります。動画ごとに速度を変えたりボイスを使い分けることで、自然な仕上がりになります。
06

AI音声を使うとショート動画のアルゴリズムやおすすめ表示で不利になりますか?

AIナレーションを使っていること自体で評価が下がるわけではありません。ペナルティの対象になるのは、ありがちな使い回し動画です。聞き飽きた定番ボイスに素材動画を合わせ、煽り文句をつけただけの投稿は伸びにくくなります。独自の台本を用意し、オリジナルの映像を組み合わせて最後まで見てもらえれば、アルゴリズム上は肉声と変わらず評価されます。安全に運用する一番確実な方法は、誰もが使っている初期設定のボイスを避けることです。
07

1本の動画の途中でボイスを切り替えても、不自然になりませんか?

場面転換のタイミングに合わせれば違和感なく切り替えられます。音声を前半と後半に分けて生成し、文の途中ではなくカットの切り替わりに配置してください。その際、間を80〜120ミリ秒ほど空けるのがコツです。「実はここからが本題」「オチのツッコミ」といった場面で別のボイスを差し込むと、意図的な演出として視聴者に伝わります。
08

AI音声とテロップのタイミングをぴったり合わせるにはどうすればいいですか?

CapCutやPremiereの自動キャプション機能を使えば、書き出したWAVファイルからきれいにタイミングを合わせられます。FreeTextoSpeechの音声をタイムラインに読み込み、テキスト台本ではなく音声トラックから字幕を自動生成してください。台本の文字をそのままコピペすると、読み上げのリズムとズレが生じる原因になります。

Still wondering? Get in touch →

Try it now

Shorts向けのナレーションを、無料で。

聞き飽きた定番の音声から抜け出しましょう。