提供中Veo 3.1が登場:参照画像、4K出力、最大約148秒までのシーン延長に対応。 今すぐ試す →

3
AI動画に声を与えたモデル

Veo 3
GoogleのAI動画モデル。

Veo 3はテキストや画像を、音がすでに入った完成動画に変えます。音楽・効果音・リップシンクされたセリフが映像と同じパスで生成されます。ブラウザでテキストから動画、画像から動画を生成できます。

Veo 3を無料で試すスタジオで新しいVeo 3.1と並んで利用できます。
概要

Veo 3とは?

Veo 3はGoogle DeepMindのAI動画生成モデルです。映像と同期音声をワンパスで生成した初の主要モデルで、セリフを引用符で囲むと、キャラクターが対応する口の動きでそれを話します。カメラワーク、照明、トーンの指示を普通の言葉で理解し、見返しても破綻しない物理表現をレンダリングします。

2025年5月のGoogle I/Oでリリースされ、Veo 3は以降のすべての動画モデルが追いかける基準を打ち立てました。Veo Studioでは後継のVeo 3.1と並んで引き続き利用できます。シンプルなプロンプト欄、ダウンロード不要、そして無料で始められるプランがあります。開発者はVeo API経由でも呼び出せます。

機能

Veo 3の機能。

プロンプト

Veo 3は映画の言語を話します。

カメラワーク、ライティング、レンズ選び、感情のトーン。監督が書くようにVeoプロンプトを書けば、モデルがそれを実行します。設定パネルは不要、言葉だけです。

プロンプト夜、自分の車にもたれるストリートレーサーにゆっくりドリーイン、ネオンのリムライト、雨上がり。彼女はにやりと笑って言う「もう手遅れよ。」エンジンが唸るとワイドにカット、重低音のスコアが入る。
はじめ方

Veo 3の使い方。

  1. 01

    ログインしてスタジオを開く

    無料アカウントを作成し、モデルセレクターでVeo 3を選びます(デフォルトはVeo 3.1)。順番待ちも招待コードもダウンロードも不要です。

  2. 02

    プロンプトを書くか画像を追加

    ショット、カメラの動き、引用符で囲んだセリフを描写します。画像から動画を作る場合は、開始フレームとして写真を添付できます。

  3. 03

    生成してダウンロード

    Veo 3は最大1080pの4〜8秒の完成クリップを音声つきで返します。TikTok、Reels、ショート、広告向けに16:9か9:16を選んでエクスポートしましょう。

リリース日

Veo 3のリリース日。

Google DeepMindは2025年5月のGoogle I/OでVeo 3を、より速く安価なVeo 3 Fastと同時にリリースしました。Veo 2(2024年末)の後継で、目玉機能である映像と同時に生成されるネイティブ音声により、その年もっとも話題になったモデルリリースとなりました。

後継のVeo 3.1は2025年10月に登場し、参照画像、最初と最後のフレーム制御、4K出力、シーン延長が加わりました。Veo Studioでは現在すべてのプランでデフォルトモデルとなっており、Veo 3もオプションとして引き続き利用できます。

スペック

Veo 3の仕様。

クリップの長さ
4〜8秒
解像度
720p · 1080p
アスペクト比
16:9 · 9:16
入力
テキスト · 画像(最初のフレーム)
音声
ネイティブ:音楽、効果音、セリフ
来歴証明
不可視ウォーターマーク SynthID

Veo 3.1が登場。

Veo 3.1は、最大3枚の参照画像、最初と最後のフレーム制御、4K出力、最大約148秒のシーン延長を追加。すべてのプランで追加料金なしです。今すぐ使えます。

Veo 3.1を見る
FAQ

Veo 3のFAQ。

Veo 3で作りはじめましょう。

無料プランで月に数本の動画が作れます。あなたのアイデアをVeo 3がどう形にするか、確かめるには十分です。

最初の動画を作る