Ya disponibleVeo 3.1 ya está aquí: imágenes de referencia, salida 4K y extensión de escena hasta ~148 segundos. Pruébalo ahora →

3
El modelo que le dio voz al vídeo IA

Veo 3
el modelo de vídeo IA de Google.

Veo 3 convierte texto o una imagen en un vídeo terminado con el sonido ya incluido: música, efectos y diálogo con sincronización labial generados en la misma pasada que la imagen. Genera texto a vídeo e imagen a vídeo en el navegador.

Prueba Veo 3 gratisDisponible en el estudio junto al nuevo Veo 3.1.
Resumen

¿Qué es Veo 3?

Veo 3 es un modelo de generación de vídeo con IA de Google DeepMind. Fue el primer modelo popular en generar vídeo y audio sincronizado en una sola pasada — pon una frase entre comillas y el personaje la dice con el movimiento de labios a juego. Entiende indicaciones en lenguaje normal para movimientos de cámara, iluminación y tono, y renderiza físicas que aguantan un segundo visionado.

Lanzado en mayo de 2025 en Google I/O, Veo 3 marcó la pauta que todos los modelos de vídeo han perseguido desde entonces, y sigue disponible en Veo Studio junto a su sucesor, Veo 3.1. Tienes un cuadro de prompt sencillo, sin descargas, y un nivel gratis para empezar. Los desarrolladores también pueden usarlo a través de la API de Veo.

Funciones

Funciones de Veo 3.

Prompts

Veo 3 habla el lenguaje del cine.

Movimientos de cámara, esquemas de luz, elección de lentes, tono emocional: escribe un prompt de Veo como lo haría un director y el modelo lo ejecuta. Sin paneles de ajustes, solo palabras.

PromptDolly-in lento hacia una piloto callejera apoyada en su coche de noche, luz de contorno de neón, acaba de dejar de llover. Sonríe de lado y dice "ya llegas tarde." Corte a plano general mientras ruge el motor, entra una banda sonora cargada de graves.
Primeros pasos

Cómo usar Veo 3.

  1. 01

    Inicia sesión y abre el estudio

    Crea una cuenta gratis y elige Veo 3 en el selector de modelos (Veo 3.1 es el predeterminado), sin lista de espera, sin código de invitación y sin nada que descargar.

  2. 02

    Escribe un prompt o añade una imagen

    Describe el plano, el movimiento de cámara y cualquier diálogo entre comillas. Si quieres, adjunta una foto como fotograma inicial para imagen a vídeo.

  3. 03

    Genera y descarga

    Veo 3 devuelve un clip terminado de 4 a 8 segundos hasta en 1080p, con sonido. Elige 16:9 o 9:16 para TikTok, Reels, Shorts o anuncios y expórtalo.

Fecha de lanzamiento

Fecha de lanzamiento de Veo 3.

Google DeepMind lanzó Veo 3 en mayo de 2025 en Google I/O, junto con una variante Veo 3 Fast más rápida y barata. Siguió a Veo 2 (finales de 2024), y su función estrella — audio nativo generado con la imagen — lo convirtió en el lanzamiento de modelo más comentado del año.

Su sucesor, Veo 3.1, llegó en octubre de 2025 con imágenes de referencia, control de primer y último fotograma, salida 4K y extensión de escena. En Veo Studio ahora es el modelo por defecto en todos los planes, y Veo 3 sigue disponible como opción.

Ficha técnica

Especificaciones de Veo 3.

Duración del clip
4–8 segundos
Resolución
720p · 1080p
Relaciones de aspecto
16:9 · 9:16
Entradas
texto · imagen (primer fotograma)
Audio
nativo: música, efectos, diálogo
Procedencia
marca de agua invisible SynthID

Veo 3.1 ya está aquí.

Veo 3.1 añade hasta 3 imágenes de referencia, control de primer y último fotograma, salida 4K y extensión de escena hasta ~148 segundos, en todos los planes, sin coste extra. Ya está disponible.

Descubre Veo 3.1
FAQ

Preguntas frecuentes sobre Veo 3.

Empieza a crear con Veo 3.

El plan gratis te da un par de vídeos al mes, suficiente para ver qué hace Veo 3 con tu idea.

Haz tu primer vídeo