OTOHA無料で始める

ショート動画・リールの台本の作り方|話した内容から自動生成する手順とテンプレ

🎧 この記事の内容も、OTOHAなら音声1本から5媒体の下書きに。無料で試す →

「バズる動画の作り方」を調べる前に、詰まるのはたいてい台本です。何を最初の2秒で言うか、どう本編を組むか、最後にどう締めるか——これが決まれば撮影も編集も一気にラクになります。この記事では、ショート動画・リール・Shortsで使える台本の基本構造と型(テンプレ)、そして白紙で書くより速い「話した内容から台本を起こす」方法まで解説します。

話した内容/収録音声スマホ収録・雑談メモ
X(3投稿)短文・スレッド
note見出し構成+本文
Instagramキャプション+構成
縦動画台本Reels/TikTok/Shorts
メルマガ件名+本文

ショート動画の台本は「3ブロック」でできている

リールもTikTokもShortsも、伸びる縦動画の台本は次の3ブロックで組まれています。媒体が違っても構造は共通です。

  1. フック(0〜2秒):スクロールを止めさせる最初のひと言
  2. 本編(2秒〜終盤):フックで約束した中身を、テンポよく1〜3ポイントで
  3. CTA(終盤〜ラスト):次の行動(フォロー・保存・コメント・プロフ誘導)を1つだけ

この順番が崩れると、どれだけ中身が良くても最初の2秒で離脱されます。冒頭に一番強い一言を置くのが縦動画台本の鉄則です。

秒数配分と文字数の目安

15〜30秒の縦動画を想定すると、目安はこのくらいです。ナレーション・字幕を書くときの基準にしてください。

ブロック 秒数の目安 文字数の目安(話し言葉)
フック 0〜2秒 10〜20字(ひと言で言い切る)
本編 2〜25秒 120〜250字(1秒=約6〜8字が目安)
CTA ラスト3〜5秒 15〜30字(行動を1つだけ)

30秒動画なら台本全体でおおむね180〜300字。長くなると早口になり離脱を招くので、書いたら一度声に出して秒数を測るのがおすすめです。字幕を全画面に載せる作りなら、1画面あたり15〜20字で改行するとテンポが出ます。

フックの作り方(最初の2秒で決まる)

フックは「続きを見ないと損」と思わせるのが役割です。よく効く型を挙げます。

避けたいのは「今日は〇〇について話します」という前置き。説明から入らず、いきなり結論・断言・意外性から入るとフックになります。

リール・TikTok・Shorts共通で使える台本の型(テンプレ)

コピペして中身を差し替えれば台本になる、汎用の型です。3ブロック構造に沿っています。

【フック 0-2秒】___(逆張り or 結論先出しのひと言)
【本編 2-25秒】
 ・ポイント1:___
 ・ポイント2:___
 ・(あれば)ポイント3:___
【CTA ラスト3-5秒】___(フォロー/保存/コメントのどれか1つ)

ポイントは本編を欲張らないこと。15〜30秒に詰め込めるのは1〜3ポイントまで。それ以上は別の動画に分けたほうが、1本ごとのメッセージが立ちます。1つのテーマから複数本の台本を切り出す発想が、投稿の継続にも効きます。

「白紙で書く」より「話した内容から起こす」ほうが速い

台本を白紙から書こうとすると、言葉選びに時間を吸われて手が止まります。おすすめは逆の順番——まず伝えたいことを2〜3分しゃべって録音し、その話し言葉を台本に起こすやり方です。

理由はシンプルで、人は書くより話すほうが速く、そして話し言葉のほうがそもそも縦動画向きだからです。縦動画の台本は書き言葉ではなく口語。だから「きれいに書いた文章」より「実際に話した言葉」のほうが、テンポも人間味も乗ります。既存のライブ配信・ポッドキャスト・打ち合わせの雑談も、そのまま台本の素材にできます。

やることは3ステップです。

  1. 2〜3分しゃべって録音する(お題と要点だけ決めておく/既存の音声・動画でもOK)
  2. 文字起こしする(話し言葉をテキスト化)
  3. 3ブロックに整える(フックを立て、本編を1〜3点に絞り、CTAを1つ)

ChatGPTのプロンプトで台本を作る方法

汎用AIでも台本化はできます。文字起こししたテキストを貼り、次のようなプロンプトを渡します。

以下の話した内容を、リール/TikTok/Shorts用の縦動画台本にしてください。
・構成は「フック(0-2秒)→本編→CTA」の3ブロック
・秒数を各行の頭に明記(例:0-2秒/2-15秒)
・全体30秒・話し言葉・合計250字以内
・私の口調(一人称・語尾)はそのまま残す
<話した内容>
(文字起こしを貼る)

十分使えますが、毎回「文字起こし→プロンプト調整→口調が均されるのを直す」を繰り返す手間が残ります。単発なら汎用AI、量産・継続なら専用ツールで自動化、という使い分けが現実的です。

1つの音声・動画から、縦動画台本を含む5媒体を同時に作る

ここがOTOHAの差別化です。多くのツールは「文字起こし」か「要約」止まりで、縦動画台本まで型にして出してはくれません。OTOHAは、1本の音声・動画を入れるだけで、縦動画台本(Reels/TikTok/Shorts共通)に加えてX(3投稿)・note・Instagram・メルマガの下書きを同時に生成します。1回しゃべれば、動画もSNSも一気に埋まります。

口調保持:台本も「その人の話し方」で出る

もう1つの差別化が口調保持です。台本をAIに作らせると、たいてい「よそ行きのナレーション」に均されます。OTOHAは一人称・語尾・口ぐせを保ったまま台本化するので、台本を読み上げても“いつもの自分”の話し方になります。動画とSNSで人格がブレません。

実例:2分しゃべった内容が、縦動画台本を含む5媒体に

朝の準備について雑談した音声を、そのまま5媒体に展開した例です。話し言葉の口ぐせと語尾が、台本になっても残ります。

朝の準備の話.m4a
スマホ収録 · 2:18

「朝バタバタする人さ、たぶん夜の準備をサボってるっしょオレも前はそうで、毎朝服を選ぶだけで10分溶かしてた。でも前の夜に明日着る服を1セット出しとくだけで、朝がマジで別物になったんよ…」

AIが変換(話し方はそのまま)
縦動画台本(Reels/TikTok/Shorts)

0–2秒 「朝バタバタする人、夜サボってるっしょ」 2–10秒 オレも毎朝、服選びだけで10分溶かしてた 10–22秒 前の夜に明日の服を1セット出すだけ。朝が別物になったんよ 22–27秒 CTA「だまされたと思って今夜1セット、出してみて。フォローで朝ラク習慣もう1個いくよ」

X(3本のうち1本)

朝バタバタする人、たぶん夜の準備サボってるっしょオレも服選びで毎朝10分溶かしてた。前夜に1セット出すだけで朝が別物になったんよ。 #朝活 #時短

note(見出し)

朝バタバタするのは"夜の準備不足"だった|前夜に服1セット出すだけで朝が変わった話

Instagram(構成)

①朝バタバタの原因は夜にある ②服選びで溶かす10分 ③前夜に1セット出すだけ ④朝が別物になる +キャプション本文

メルマガ

件名:朝が別物になった、たった1つの夜習慣/本文:朝がバタつく原因、実は夜にあったんです——今日はその話をひとつ。

💡 台本でもX・noteでも、一人称の「オレ」も語尾の「〜っしょ/〜んよ」もそのまま。台本を読み上げても"声のまま"なので、動画とSNSの人格がブレません。しかも縦動画台本には秒数配分(0-2秒フック→本編→CTA)まで入って出てきます。

手動 vs 自動化(OTOHA)

観点 手動 / 汎用AIチャット OTOHA
台本づくり 白紙 or 文字起こし→プロンプトで指示 音声・動画を入れるだけ
出力 台本1本(都度依頼) 縦動画台本+4媒体を同時
秒数・構成 毎回プロンプトで指定 フック→本編→CTAを秒数付きで
話し方 均されやすく都度修正 一人称・語尾を自動で保持

白紙で悩む時間も、媒体ごとに指示し直す手間も無くなり、1回しゃべる→動画台本+SNSが一度に揃うのがOTOHAの使い方です。

よくある質問

Q. ショート動画の台本の基本構造は? A. 「フック(0〜2秒)→本編(〜終盤)→CTA(ラスト3〜5秒)」の3ブロックが基本です。冒頭2秒に一番強い一言を置き、本編は1〜3ポイントに絞り、最後に行動を1つだけ促す構成が、リール・TikTok・Shorts共通で効きます。

Q. ショート動画の台本は何文字くらいが目安ですか? A. 話し言葉で1秒あたり約6〜8字が目安です。30秒の動画ならフック10〜20字+本編120〜250字+CTA15〜30字で、全体180〜300字程度に収まります。書いたら声に出して秒数を測ると過不足を調整できます。

Q. ChatGPTでショート動画の台本は作れますか? A. 作れます。文字起こしを貼り「フック→本編→CTAの3ブロック・秒数明記・口調はそのまま」と指示すれば台本になります。ただし毎回のプロンプト調整と、口調が均される点の修正が手間です。量産・継続なら専用ツールでの自動化が向いています。

Q. 話した内容や既存の動画から台本を作れますか? A. はい。白紙で書くより、2〜3分しゃべった音声や既存のライブ・ポッドキャスト・動画から起こすほうが速く、話し言葉なので縦動画にも合います。OTOHAなら音声・動画を入れるだけで、縦動画台本を含む5媒体の下書きを同時に作れます。

Q. AIで作ると台本が“それっぽいナレーション”になりませんか? A. 口調を保持して生成する設計なら、一人称・語尾・口ぐせを残したまま台本化できます。読み上げても自分の話し方のままなので、動画とSNSで人格がブレません。生成後に細部だけ整えるのがおすすめです。


関連音声からSNS発信を作る完全ガイドYouTube動画をSNS発信に変える音声→SNSツールの選び方

話す・書くだけで、5つのSNS発信が揃う。
音声・動画・メモを1本入れれば、X・note・Instagram・縦動画台本・メルマガの下書きが30秒で。
OTOHAを無料で試す →