LiveVeo 3.1 ist live: Referenzbilder, 4K-Ausgabe und Szenenverlängerung bis ~148 Sekunden. Jetzt ausprobieren →
Veo 3
Googles KI-Videomodell.
Veo 3 verwandelt Text oder ein Bild in ein fertiges Video mit bereits enthaltenem Ton: Musik, Effekte und lippensynchroner Dialog, generiert im selben Durchlauf wie das Bild. Erstellen Sie Text-zu-Video und Bild-zu-Video im Browser.
Was ist Veo 3?
Veo 3 ist ein KI-Videogenerierungs-Modell von Google DeepMind. Es war das erste große Modell, das Video und synchronisiertes Audio in einem einzigen Durchlauf generierte — setzen Sie eine Dialogzeile in Anführungszeichen, und die Figur sagt sie mit passender Lippenbewegung. Es versteht Anweisungen in normaler Sprache für Kamerabewegungen, Licht und Ton und rendert Physik, die auch beim zweiten Ansehen standhält.
Veröffentlicht im Mai 2025 auf der Google I/O, setzte Veo 3 die Vorlage, der seither jedes Videomodell nachjagt, und es bleibt auf Veo Studio neben seinem Nachfolger Veo 3.1 verfügbar. Sie bekommen eine einfache Prompt-Box, keine Downloads und einen kostenlosen Einstieg. Entwickler können es auch über die Veo API aufrufen.
Die Funktionen von Veo 3.
Nativer Ton und Dialog
Musik, Umgebungseffekte und Sprache der Figuren werden mit dem Bild generiert, synchron zur Handlung. Setzen Sie einen Satz in Anführungszeichen, und Ihre Figur sagt ihn — Lippenbewegung inklusive. Kein separater Audio-Durchlauf, kein manuelles Synchronisieren.
Text-zu-Video und Bild-zu-Video
Prompten Sie mit Worten, einem Foto oder beidem. Liefern Sie ein Bild, und Veo 3 animiert es zu einer vollständigen Einstellung — Ihr Produktfoto oder Porträt wird zum Eröffnungsbild.
Physik, die standhält
Sport, Tanz, Kollisionen, Stoff und Wasser — komplexe Bewegung rendert so, wie Ihr Auge es erwartet, sodass der Clip auch ein zweites Ansehen übersteht.
Spricht die Sprache des Films
Dolly-ins, weite Establishing Shots, Neon-Kantenlicht, geringe Schärfentiefe — schreiben Sie Regieanweisungen wie ein Filmemacher, und Veo 3 setzt sie um. Keine Einstellungs-Panels, nur Worte.
Veo 3 spricht die Sprache des Films.
Kamerabewegungen, Lichtsetups, Objektivwahl, emotionaler Ton — schreiben Sie einen Veo-Prompt wie ein Regisseur, und das Modell setzt ihn um. Keine Einstellungs-Panels, nur Worte.
So nutzen Sie Veo 3.
- 01
Anmelden und Studio öffnen
Erstellen Sie ein kostenloses Konto und wählen Sie Veo 3 im Modell-Auswahlmenü (Veo 3.1 ist der Standard) — keine Warteliste, kein Einladungscode, nichts herunterzuladen.
- 02
Prompt schreiben oder Bild hinzufügen
Beschreiben Sie die Einstellung, die Kamerabewegung und Dialoge in Anführungszeichen. Optional hängen Sie ein Foto als Startbild für Bild-zu-Video an.
- 03
Generieren und herunterladen
Veo 3 liefert einen fertigen Clip von 4 bis 8 Sekunden in bis zu 1080p, mit Ton. Wählen Sie 16:9 oder 9:16 für TikTok, Reels, Shorts oder Werbung und exportieren Sie.
Das Release-Datum von Veo 3.
Google DeepMind veröffentlichte Veo 3 im Mai 2025 auf der Google I/O, zusammen mit einer schnelleren, günstigeren Variante Veo 3 Fast. Es folgte auf Veo 2 (Ende 2024), und sein Hauptfeature — natives Audio, generiert mit dem Bild — machte es zum meistdiskutierten Modell-Release des Jahres.
Sein Nachfolger Veo 3.1 erschien im Oktober 2025 mit Referenzbildern, Erst-und-Letztbild-Steuerung, 4K-Ausgabe und Szenenverlängerung. Auf Veo Studio ist es jetzt das Standardmodell für jeden Tarif, und Veo 3 bleibt als Option verfügbar.
Die Spezifikationen von Veo 3.
- Cliplänge
- 4–8 Sekunden
- Auflösung
- 720p · 1080p
- Seitenverhältnisse
- 16:9 · 9:16
- Eingaben
- Text · Bild (erstes Bild)
- Audio
- nativ: Musik, SFX, Dialog
- Herkunft
- unsichtbares SynthID-Wasserzeichen
Veo 3.1 ist da.
Veo 3.1 bringt bis zu 3 Referenzbilder, Erst-und-Letztbild-Steuerung, 4K-Ausgabe und Szenenverlängerung bis ~148 Sekunden — in jedem Tarif, ohne Aufpreis. Es ist jetzt live.
Veo 3 FAQ.
Was ist Veo 3?+
Veo 3 ist ein KI-Videogenerierungs-Modell von Google DeepMind. Es verwandelt einen Text-Prompt oder ein Bild in einen fertigen Videoclip mit Kameraführung und nativem Ton — Musik, Effekte und lippensynchroner Dialog werden im selben Durchlauf wie das Bild generiert.
Wann wurde Veo 3 veröffentlicht?+
Veo 3 wurde von Google DeepMind im Mai 2025 auf der Google I/O veröffentlicht, zusammen mit der schnelleren Variante Veo 3 Fast. Sein Nachfolger Veo 3.1 erschien im Oktober 2025 und ist jetzt das Standardmodell auf Veo Studio.
Ist Veo 3 kostenlos?+
Sie können Veo 3 im Gratis-Tarif von Veo Studio kostenlos nutzen — mit ein paar 720p-Videos im Monat, ohne Karte. Bezahltarife ab 14 $/Monat bringen mehr Videos, 1080p- und 4K-Ausgabe und eine kommerzielle Lizenz.
Wie bekomme ich Zugang zu Veo 3?+
Registrieren Sie sich kostenlos und wählen Sie Veo 3 im Modell-Auswahlmenü der Prompt-Box (Veo 3.1 ist der Standard). Es läuft im Browser und funktioniert auf jedem Gerät, ohne App oder Download.
Ist Veo 3 Open Source?+
Nein. Veo 3 ist ein proprietäres Modell von Google DeepMind, verfügbar über gehostete Apps und APIs, nicht als Open-Source-Gewichte. Jeder Veo-Clip trägt SynthID, Googles unsichtbares Herkunfts-Wasserzeichen.
Ist Veo 3 in den USA verfügbar?+
Ja. Veo Studio führt Veo 3 im Browser aus und ist in den USA und weltweit verfügbar — Sie brauchen nur ein Konto.
Starten Sie mit Veo 3.
Der Gratis-Tarif gibt Ihnen ein paar Videos im Monat — genug, um zu sehen, was Veo 3 aus Ihrer Idee macht.
Machen Sie Ihr erstes Video