Ya disponibleVeo 3.1 ya está aquí: imágenes de referencia, salida 4K y extensión de escena hasta ~148 segundos. Pruébalo ahora →
Veo 3
el modelo de vídeo IA de Google.
Veo 3 convierte texto o una imagen en un vídeo terminado con el sonido ya incluido: música, efectos y diálogo con sincronización labial generados en la misma pasada que la imagen. Genera texto a vídeo e imagen a vídeo en el navegador.
¿Qué es Veo 3?
Veo 3 es un modelo de generación de vídeo con IA de Google DeepMind. Fue el primer modelo popular en generar vídeo y audio sincronizado en una sola pasada — pon una frase entre comillas y el personaje la dice con el movimiento de labios a juego. Entiende indicaciones en lenguaje normal para movimientos de cámara, iluminación y tono, y renderiza físicas que aguantan un segundo visionado.
Lanzado en mayo de 2025 en Google I/O, Veo 3 marcó la pauta que todos los modelos de vídeo han perseguido desde entonces, y sigue disponible en Veo Studio junto a su sucesor, Veo 3.1. Tienes un cuadro de prompt sencillo, sin descargas, y un nivel gratis para empezar. Los desarrolladores también pueden usarlo a través de la API de Veo.
Funciones de Veo 3.
Sonido y diálogo nativos
La música, los efectos de ambiente y la voz de los personajes se generan con la imagen, sincronizados con la acción. Pon una frase entre comillas y tu personaje la dice, con movimiento de labios incluido. Sin pasada de audio aparte, sin sincronizar a mano.
Texto a vídeo e imagen a vídeo
Haz el prompt con palabras, con una foto o con ambas. Dale una imagen y Veo 3 la anima hasta convertirla en un plano completo — la foto de tu producto o tu retrato se convierte en el fotograma inicial.
Físicas que aguantan
Deporte, baile, colisiones, tela y agua: el movimiento complejo se renderiza como tu ojo espera, así que el clip sobrevive a un segundo visionado.
Habla el lenguaje del cine
Dolly-in, planos generales, luz de contorno de neón, poca profundidad de campo — escribe la dirección como lo haría un cineasta y Veo 3 la ejecuta. Sin paneles de ajustes, solo palabras.
Veo 3 habla el lenguaje del cine.
Movimientos de cámara, esquemas de luz, elección de lentes, tono emocional: escribe un prompt de Veo como lo haría un director y el modelo lo ejecuta. Sin paneles de ajustes, solo palabras.
Cómo usar Veo 3.
- 01
Inicia sesión y abre el estudio
Crea una cuenta gratis y elige Veo 3 en el selector de modelos (Veo 3.1 es el predeterminado), sin lista de espera, sin código de invitación y sin nada que descargar.
- 02
Escribe un prompt o añade una imagen
Describe el plano, el movimiento de cámara y cualquier diálogo entre comillas. Si quieres, adjunta una foto como fotograma inicial para imagen a vídeo.
- 03
Genera y descarga
Veo 3 devuelve un clip terminado de 4 a 8 segundos hasta en 1080p, con sonido. Elige 16:9 o 9:16 para TikTok, Reels, Shorts o anuncios y expórtalo.
Fecha de lanzamiento de Veo 3.
Google DeepMind lanzó Veo 3 en mayo de 2025 en Google I/O, junto con una variante Veo 3 Fast más rápida y barata. Siguió a Veo 2 (finales de 2024), y su función estrella — audio nativo generado con la imagen — lo convirtió en el lanzamiento de modelo más comentado del año.
Su sucesor, Veo 3.1, llegó en octubre de 2025 con imágenes de referencia, control de primer y último fotograma, salida 4K y extensión de escena. En Veo Studio ahora es el modelo por defecto en todos los planes, y Veo 3 sigue disponible como opción.
Especificaciones de Veo 3.
- Duración del clip
- 4–8 segundos
- Resolución
- 720p · 1080p
- Relaciones de aspecto
- 16:9 · 9:16
- Entradas
- texto · imagen (primer fotograma)
- Audio
- nativo: música, efectos, diálogo
- Procedencia
- marca de agua invisible SynthID
Veo 3.1 ya está aquí.
Veo 3.1 añade hasta 3 imágenes de referencia, control de primer y último fotograma, salida 4K y extensión de escena hasta ~148 segundos, en todos los planes, sin coste extra. Ya está disponible.
Preguntas frecuentes sobre Veo 3.
¿Qué es Veo 3?+
Veo 3 es un modelo de generación de vídeo con IA de Google DeepMind. Convierte un prompt de texto o una imagen en un clip de vídeo terminado con dirección de cámara y sonido nativo — la música, los efectos y el diálogo con sincronización labial se generan en la misma pasada que la imagen.
¿Cuándo salió Veo 3?+
Google DeepMind lanzó Veo 3 en mayo de 2025 en Google I/O, junto con la variante más rápida Veo 3 Fast. Su sucesor, Veo 3.1, llegó en octubre de 2025 y ahora es el modelo por defecto en Veo Studio.
¿Veo 3 es gratis?+
Puedes usar Veo 3 gratis con el plan gratuito de Veo Studio, que incluye un par de vídeos 720p al mes sin tarjeta. Los planes de pago desde 14 $/mes añaden más vídeos, salida 1080p y 4K, y licencia comercial.
¿Cómo accedo a Veo 3?+
Regístrate con una cuenta gratis y elige Veo 3 en el selector de modelos del cuadro de prompt (Veo 3.1 es el predeterminado). Funciona en el navegador, así que va en cualquier dispositivo sin app ni descargas.
¿Veo 3 es de código abierto?+
No. Veo 3 es un modelo propietario de Google DeepMind, disponible a través de apps alojadas y APIs, no como pesos de código abierto. Cada clip de Veo lleva SynthID, la marca de agua de procedencia invisible de Google.
¿Veo 3 está disponible en EE. UU.?+
Sí. Veo Studio ejecuta Veo 3 en el navegador y está disponible en Estados Unidos y en todo el mundo, solo necesitas una cuenta.
Empieza a crear con Veo 3.
El plan gratis te da un par de vídeos al mes, suficiente para ver qué hace Veo 3 con tu idea.
Haz tu primer vídeo