ホーム » ブログ » Veo 3.1プロンプトの書き方|初心者向けテンプレートと例

Veo 3.1プロンプトの書き方|初心者向けテンプレートと例

更新日

Veo 3.1で思い通りの動画を作るには、アイデアそのものよりも、AIに伝わるプロンプト設計が重要です。単に「人が歩く」と書くだけでは平坦な動画になりやすく、カメラ、被写体、動き、場所、音まで具体化すると映像の完成度が上がります。

Veo 3.1には、テキストから動画を作る方法と、画像を動かす方法があります。この記事では、それぞれの書き方、テンプレート、実例、そして作成した動画を多くのアカウントへ投稿するGeeLarkの流れをまとめます。

Veo 3.1プロンプトで変わったこと

意図をより正確に理解する

Veo 3.1は、カメラ移動、被写体の表情、照明、環境音などの細かな指示をより正確に反映します。たとえば「4秒かけてゆっくり寄る」「雨に濡れた窓越しのクローズアップ」といった指定が、映像表現に反映されやすくなりました。

音声と環境音が自然になる

Veo 3.1は会話、足音、雨音、オフィスの環境音などをより自然に生成できます。BGMも「明るい」「静かな」だけでなく、ピアノ、環境音、遠くの街のざわめきなど具体的に書くと結果が安定します。

複数シーンの構成が作りやすい

マルチショット、アングル変更、開始・終了シーンの制御、キャラクターの一貫性なども扱いやすくなっています。構造はVeo 3と大きく変わりませんが、Veo 3.1の方が細部を覚え、指示に沿った映像を作りやすいモデルです。

Text-to-Video向けVeo 3.1プロンプト

Text-to-Videoでは、ゼロから映像を作るため、5つの要素を順番に書くと安定します。映画制作のように、カメラから始め、被写体、動き、場所、ムードへ広げます。

  • Cinematography: カメラの構図、動き、レンズ感
  • Subject: 誰が、何が映るのか
  • Action: 何が起き、どんな意図で動くのか
  • Context: 場所、時間、天候、照明
  • Style & Ambiance: 映像の質感、色、音、雰囲気

1. Cinematography – カメラ

まずショットの種類を選びます。広さを見せるならワイド、会話ならミディアム、感情を見せるならクローズアップが向いています。続いて、ドリーイン、トラッキング、固定ショットなどの動きを書きます。

Wide establishing shot, locked-off tripod, subtle depth of field
Slow dolly-in from wide to medium shot over 4 seconds, shallow depth of field
Slow push-in, gentle backlight shaping silhouette, intimate close-up

2. Subject – 被写体

人物なら年齢感、髪型、服装、姿勢、感情を数語で具体化します。商品なら素材、質感、色、光の反射を書きます。細かい特徴は、複数カットでの一貫性にも効きます。

Weak: Man
Better: A friendly founder in a bright studio with soft key light
Professional: A man in his late 20s with shoulder-length auburn hair, confident posture, vintage denim jacket

3. Action – 動き

動詞だけでなく、動き方と意図を書きます。「歩く」より「落ち着いた足取りで歩き、時々カメラを見る」の方が、映像の感情が伝わります。会話を入れる場合は短く自然にします。

4. Context – 場所と時間

同じ人物でも、東京の市場、静かなカフェ、朝のオフィスでは印象が変わります。場所、時間帯、季節、光の方向、背景に見えるものまで書くと、説得力のある世界になります。

5. Style & Ambiance – ムードと音

映像の質感は、cinematic、documentary、commercial などで指定できます。色は warm、cool、champagne、grey など、音は rain、keyboard taps、soft piano のように具体化します。

プロンプトテンプレート

CINEMATOGRAPHY: [shot type], [camera movement], [lens properties]
SUBJECT: [who/what is in frame]
ACTION: [movement and intention]
CONTEXT: [where, when, weather, lighting]
STYLE & AMBIANCE: [visual style, mood, color], Audio: [dialogue/SFX/ambient/music]

完成例

CINEMATOGRAPHY: ミニマルなリビングをゆっくり進むドリーショット。SUBJECT: 30代半ばのプロフェッショナルな女性。ACTION: 大きな窓の前で立ち止まり、街を見下ろしてからカメラへ向き直る。CONTEXT: 朝の光が差し込む現代的な部屋。STYLE & AMBIANCE: 暖かい4Kドキュメンタリー調、足音と遠い街の環境音、控えめなピアノ。

Image-to-Video向けVeo 3.1プロンプト

画像プロンプトが違う理由

Image-to-Videoでは、被写体や照明、背景はすでに画像に含まれています。プロンプトでは、何を動かすのか、カメラがどう動くのか、何を話すのかに集中します。長さは50-100語程度で十分です。

CCADフレームワーク

  • Camera: カメラの動き
  • Character: 画像内の人物や対象
  • Action: 起こしてほしい動き
  • Dialogue: 話す内容や音声

完成例

Camera: Slow push-in over three seconds from wide to medium close-up
Character: The professional woman at her desk
Action: She types, pauses, looks up with a knowing smile
Dialogue: Says "I've got this handled"
Audio: Subtle keyboard typing, soft office ambience

商品写真なら、腕時計を中心に360度ゆっくり回転させ、金属面に光が当たるよう指定できます。旅行写真なら、前方へ少し進むカメラ、波紋、流れる雲、街の環境音などを加えると自然です。

タイムスタンプで複数シーンを作る

Veo 3.1では timestamp prompting により、8秒の中で複数カットを指定できます。時間ごとにカメラ、動作、音を切り替え、短いシーケンスを作れます。

[00:00-00:02] Explorer pushes aside a jungle vine
[00:02-00:04] Reverse shot of her face, distant bird calls
[00:04-00:06] Tracking shot as she touches ancient carvings
[00:06-00:08] Wide crane shot revealing a forgotten temple

作成した動画を1000以上のアカウントへ投稿するには

動画を作るだけでは運用は終わりません。10件、50件、100件以上のアカウントへ手動投稿すると時間がかかり、同じ端末やIPから投稿し続けると平台側に不自然な運用として見られる可能性があります。

GeeLarkとは

GeeLarkは、クラウドスマホと複数アカウント管理ブラウザを一つにまとめたプラットフォームです。物理端末を大量に用意しなくても、アカウントごとに独立したクラウド環境を作り、ダッシュボードから管理できます。

AI動画作成から投稿までのGeeLarkワークフロー

Step 1: 動画を生成する

Library → AI を開き、Text-to-video または Image-to-video を選びます。プロンプト、モデル、フォーマット、音声生成の有無を設定し、Submit を押すと動画がLibraryに保存されます。

Step 2: 自動化テンプレートを選ぶ

Automation → Marketplace で、TikTok video posting のようなテンプレートを選びます。Library内の動画を複数アカウントへ投稿する流れを作れます。

Step 3: 投稿設定を行う

投稿する動画、対象アカウント、投稿スケジュール、タイトル、キャプション、AIタグを設定し、Confirm publication を押します。

Step 4: クラウドで自動実行する

設定後は、指定した時間にGeeLarkがクラウド上で投稿タスクを実行します。PCを開いたままにする必要がなく、複数アカウントの投稿作業をまとめて進められます。