0–2秒 「朝バタバタする人、夜サボってるっしょ」 2–10秒 オレも毎朝、服選びだけで10分溶かしてた 10–22秒 前の夜に明日の服を1セット出すだけ。朝が別物になったんよ 22–27秒 CTA「だまされたと思って今夜1セット、出してみて。フォローで朝ラク習慣もう1個いくよ」
ショート動画・リールの台本の作り方|話した内容から自動生成する手順とテンプレ
🎧 この記事の内容も、OTOHAなら音声1本から5媒体の下書きに。無料で試す →
「バズる動画の作り方」を調べる前に、詰まるのはたいてい台本です。何を最初の2秒で言うか、どう本編を組むか、最後にどう締めるか——これが決まれば撮影も編集も一気にラクになります。この記事では、ショート動画・リール・Shortsで使える台本の基本構造と型(テンプレ)、そして白紙で書くより速い「話した内容から台本を起こす」方法まで解説します。
ショート動画の台本は「3ブロック」でできている
リールもTikTokもShortsも、伸びる縦動画の台本は次の3ブロックで組まれています。媒体が違っても構造は共通です。
- フック(0〜2秒):スクロールを止めさせる最初のひと言
- 本編(2秒〜終盤):フックで約束した中身を、テンポよく1〜3ポイントで
- CTA(終盤〜ラスト):次の行動(フォロー・保存・コメント・プロフ誘導)を1つだけ
この順番が崩れると、どれだけ中身が良くても最初の2秒で離脱されます。冒頭に一番強い一言を置くのが縦動画台本の鉄則です。
秒数配分と文字数の目安
15〜30秒の縦動画を想定すると、目安はこのくらいです。ナレーション・字幕を書くときの基準にしてください。
| ブロック | 秒数の目安 | 文字数の目安(話し言葉) |
|---|---|---|
| フック | 0〜2秒 | 10〜20字(ひと言で言い切る) |
| 本編 | 2〜25秒 | 120〜250字(1秒=約6〜8字が目安) |
| CTA | ラスト3〜5秒 | 15〜30字(行動を1つだけ) |
30秒動画なら台本全体でおおむね180〜300字。長くなると早口になり離脱を招くので、書いたら一度声に出して秒数を測るのがおすすめです。字幕を全画面に載せる作りなら、1画面あたり15〜20字で改行するとテンポが出ます。
フックの作り方(最初の2秒で決まる)
フックは「続きを見ないと損」と思わせるのが役割です。よく効く型を挙げます。
- 否定・逆張り型:「〇〇、実はやらなくていいです」
- 数字・結論先出し型:「登録者を3倍にした方法、1つだけ言います」
- 失敗・自己開示型:「これ、9割の人がやってます(私も昔やってた)」
- 問いかけ型:「なんで頑張ってるのに伸びないと思います?」
- ビフォーアフター予告型:「これ知る前と後で、撮り方が変わります」
避けたいのは「今日は〇〇について話します」という前置き。説明から入らず、いきなり結論・断言・意外性から入るとフックになります。
リール・TikTok・Shorts共通で使える台本の型(テンプレ)
コピペして中身を差し替えれば台本になる、汎用の型です。3ブロック構造に沿っています。
【フック 0-2秒】___(逆張り or 結論先出しのひと言)
【本編 2-25秒】
・ポイント1:___
・ポイント2:___
・(あれば)ポイント3:___
【CTA ラスト3-5秒】___(フォロー/保存/コメントのどれか1つ)
ポイントは本編を欲張らないこと。15〜30秒に詰め込めるのは1〜3ポイントまで。それ以上は別の動画に分けたほうが、1本ごとのメッセージが立ちます。1つのテーマから複数本の台本を切り出す発想が、投稿の継続にも効きます。
「白紙で書く」より「話した内容から起こす」ほうが速い
台本を白紙から書こうとすると、言葉選びに時間を吸われて手が止まります。おすすめは逆の順番——まず伝えたいことを2〜3分しゃべって録音し、その話し言葉を台本に起こすやり方です。
理由はシンプルで、人は書くより話すほうが速く、そして話し言葉のほうがそもそも縦動画向きだからです。縦動画の台本は書き言葉ではなく口語。だから「きれいに書いた文章」より「実際に話した言葉」のほうが、テンポも人間味も乗ります。既存のライブ配信・ポッドキャスト・打ち合わせの雑談も、そのまま台本の素材にできます。
やることは3ステップです。
- 2〜3分しゃべって録音する(お題と要点だけ決めておく/既存の音声・動画でもOK)
- 文字起こしする(話し言葉をテキスト化)
- 3ブロックに整える(フックを立て、本編を1〜3点に絞り、CTAを1つ)
ChatGPTのプロンプトで台本を作る方法
汎用AIでも台本化はできます。文字起こししたテキストを貼り、次のようなプロンプトを渡します。
以下の話した内容を、リール/TikTok/Shorts用の縦動画台本にしてください。
・構成は「フック(0-2秒)→本編→CTA」の3ブロック
・秒数を各行の頭に明記(例:0-2秒/2-15秒)
・全体30秒・話し言葉・合計250字以内
・私の口調(一人称・語尾)はそのまま残す
<話した内容>
(文字起こしを貼る)
十分使えますが、毎回「文字起こし→プロンプト調整→口調が均されるのを直す」を繰り返す手間が残ります。単発なら汎用AI、量産・継続なら専用ツールで自動化、という使い分けが現実的です。
1つの音声・動画から、縦動画台本を含む5媒体を同時に作る
ここがOTOHAの差別化です。多くのツールは「文字起こし」か「要約」止まりで、縦動画台本まで型にして出してはくれません。OTOHAは、1本の音声・動画を入れるだけで、縦動画台本(Reels/TikTok/Shorts共通)に加えてX(3投稿)・note・Instagram・メルマガの下書きを同時に生成します。1回しゃべれば、動画もSNSも一気に埋まります。
口調保持:台本も「その人の話し方」で出る
もう1つの差別化が口調保持です。台本をAIに作らせると、たいてい「よそ行きのナレーション」に均されます。OTOHAは一人称・語尾・口ぐせを保ったまま台本化するので、台本を読み上げても“いつもの自分”の話し方になります。動画とSNSで人格がブレません。
実例:2分しゃべった内容が、縦動画台本を含む5媒体に
朝の準備について雑談した音声を、そのまま5媒体に展開した例です。話し言葉の口ぐせと語尾が、台本になっても残ります。
スマホ収録 · 2:18
「朝バタバタする人さ、たぶん夜の準備をサボってるっしょ。オレも前はそうで、毎朝服を選ぶだけで10分溶かしてた。でも前の夜に明日着る服を1セット出しとくだけで、朝がマジで別物になったんよ…」
朝バタバタする人、たぶん夜の準備サボってるっしょ。オレも服選びで毎朝10分溶かしてた。前夜に1セット出すだけで朝が別物になったんよ。 #朝活 #時短
朝バタバタするのは"夜の準備不足"だった|前夜に服1セット出すだけで朝が変わった話
①朝バタバタの原因は夜にある ②服選びで溶かす10分 ③前夜に1セット出すだけ ④朝が別物になる +キャプション本文
件名:朝が別物になった、たった1つの夜習慣/本文:朝がバタつく原因、実は夜にあったんです——今日はその話をひとつ。
💡 台本でもX・noteでも、一人称の「オレ」も語尾の「〜っしょ/〜んよ」もそのまま。台本を読み上げても"声のまま"なので、動画とSNSの人格がブレません。しかも縦動画台本には秒数配分(0-2秒フック→本編→CTA)まで入って出てきます。
手動 vs 自動化(OTOHA)
| 観点 | 手動 / 汎用AIチャット | OTOHA |
|---|---|---|
| 台本づくり | 白紙 or 文字起こし→プロンプトで指示 | 音声・動画を入れるだけ |
| 出力 | 台本1本(都度依頼) | 縦動画台本+4媒体を同時 |
| 秒数・構成 | 毎回プロンプトで指定 | フック→本編→CTAを秒数付きで |
| 話し方 | 均されやすく都度修正 | 一人称・語尾を自動で保持 |
白紙で悩む時間も、媒体ごとに指示し直す手間も無くなり、1回しゃべる→動画台本+SNSが一度に揃うのがOTOHAの使い方です。
よくある質問
Q. ショート動画の台本の基本構造は? A. 「フック(0〜2秒)→本編(〜終盤)→CTA(ラスト3〜5秒)」の3ブロックが基本です。冒頭2秒に一番強い一言を置き、本編は1〜3ポイントに絞り、最後に行動を1つだけ促す構成が、リール・TikTok・Shorts共通で効きます。
Q. ショート動画の台本は何文字くらいが目安ですか? A. 話し言葉で1秒あたり約6〜8字が目安です。30秒の動画ならフック10〜20字+本編120〜250字+CTA15〜30字で、全体180〜300字程度に収まります。書いたら声に出して秒数を測ると過不足を調整できます。
Q. ChatGPTでショート動画の台本は作れますか? A. 作れます。文字起こしを貼り「フック→本編→CTAの3ブロック・秒数明記・口調はそのまま」と指示すれば台本になります。ただし毎回のプロンプト調整と、口調が均される点の修正が手間です。量産・継続なら専用ツールでの自動化が向いています。
Q. 話した内容や既存の動画から台本を作れますか? A. はい。白紙で書くより、2〜3分しゃべった音声や既存のライブ・ポッドキャスト・動画から起こすほうが速く、話し言葉なので縦動画にも合います。OTOHAなら音声・動画を入れるだけで、縦動画台本を含む5媒体の下書きを同時に作れます。
Q. AIで作ると台本が“それっぽいナレーション”になりませんか? A. 口調を保持して生成する設計なら、一人称・語尾・口ぐせを残したまま台本化できます。読み上げても自分の話し方のままなので、動画とSNSで人格がブレません。生成後に細部だけ整えるのがおすすめです。