LiveVeo 3.1 ist live: Referenzbilder, 4K-Ausgabe und Szenenverlängerung bis ~148 Sekunden. Jetzt ausprobieren →

3
Das Modell, das KI-Video eine Stimme gab

Veo 3
Googles KI-Videomodell.

Veo 3 verwandelt Text oder ein Bild in ein fertiges Video mit bereits enthaltenem Ton: Musik, Effekte und lippensynchroner Dialog, generiert im selben Durchlauf wie das Bild. Erstellen Sie Text-zu-Video und Bild-zu-Video im Browser.

Veo 3 kostenlos testenIm Studio verfügbar, neben dem neuen Veo 3.1.
Überblick

Was ist Veo 3?

Veo 3 ist ein KI-Videogenerierungs-Modell von Google DeepMind. Es war das erste große Modell, das Video und synchronisiertes Audio in einem einzigen Durchlauf generierte — setzen Sie eine Dialogzeile in Anführungszeichen, und die Figur sagt sie mit passender Lippenbewegung. Es versteht Anweisungen in normaler Sprache für Kamerabewegungen, Licht und Ton und rendert Physik, die auch beim zweiten Ansehen standhält.

Veröffentlicht im Mai 2025 auf der Google I/O, setzte Veo 3 die Vorlage, der seither jedes Videomodell nachjagt, und es bleibt auf Veo Studio neben seinem Nachfolger Veo 3.1 verfügbar. Sie bekommen eine einfache Prompt-Box, keine Downloads und einen kostenlosen Einstieg. Entwickler können es auch über die Veo API aufrufen.

Funktionen

Die Funktionen von Veo 3.

Prompting

Veo 3 spricht die Sprache des Films.

Kamerabewegungen, Lichtsetups, Objektivwahl, emotionaler Ton — schreiben Sie einen Veo-Prompt wie ein Regisseur, und das Modell setzt ihn um. Keine Einstellungs-Panels, nur Worte.

PromptLangsamer Dolly-in auf eine Straßenrennfahrerin, die nachts an ihrem Auto lehnt, Neon-Kantenlicht, der Regen hat gerade aufgehört. Sie grinst und sagt "du bist schon zu spät." Schnitt auf Totale, als der Motor aufheult, basslastiger Score setzt ein.
Erste Schritte

So nutzen Sie Veo 3.

  1. 01

    Anmelden und Studio öffnen

    Erstellen Sie ein kostenloses Konto und wählen Sie Veo 3 im Modell-Auswahlmenü (Veo 3.1 ist der Standard) — keine Warteliste, kein Einladungscode, nichts herunterzuladen.

  2. 02

    Prompt schreiben oder Bild hinzufügen

    Beschreiben Sie die Einstellung, die Kamerabewegung und Dialoge in Anführungszeichen. Optional hängen Sie ein Foto als Startbild für Bild-zu-Video an.

  3. 03

    Generieren und herunterladen

    Veo 3 liefert einen fertigen Clip von 4 bis 8 Sekunden in bis zu 1080p, mit Ton. Wählen Sie 16:9 oder 9:16 für TikTok, Reels, Shorts oder Werbung und exportieren Sie.

Release-Datum

Das Release-Datum von Veo 3.

Google DeepMind veröffentlichte Veo 3 im Mai 2025 auf der Google I/O, zusammen mit einer schnelleren, günstigeren Variante Veo 3 Fast. Es folgte auf Veo 2 (Ende 2024), und sein Hauptfeature — natives Audio, generiert mit dem Bild — machte es zum meistdiskutierten Modell-Release des Jahres.

Sein Nachfolger Veo 3.1 erschien im Oktober 2025 mit Referenzbildern, Erst-und-Letztbild-Steuerung, 4K-Ausgabe und Szenenverlängerung. Auf Veo Studio ist es jetzt das Standardmodell für jeden Tarif, und Veo 3 bleibt als Option verfügbar.

Datenblatt

Die Spezifikationen von Veo 3.

Cliplänge
4–8 Sekunden
Auflösung
720p · 1080p
Seitenverhältnisse
16:9 · 9:16
Eingaben
Text · Bild (erstes Bild)
Audio
nativ: Musik, SFX, Dialog
Herkunft
unsichtbares SynthID-Wasserzeichen

Veo 3.1 ist da.

Veo 3.1 bringt bis zu 3 Referenzbilder, Erst-und-Letztbild-Steuerung, 4K-Ausgabe und Szenenverlängerung bis ~148 Sekunden — in jedem Tarif, ohne Aufpreis. Es ist jetzt live.

Veo 3.1 entdecken
FAQ

Veo 3 FAQ.

Starten Sie mit Veo 3.

Der Gratis-Tarif gibt Ihnen ein paar Videos im Monat — genug, um zu sehen, was Veo 3 aus Ihrer Idee macht.

Machen Sie Ihr erstes Video