Features
Workflows
Solutions
Resources
ATRÁS

Guía de prompting de Veo 3.1: Cada función explicada con prompts para copiar y pegar

Guía de prompting de Veo 3.1: Cada función explicada con prompts para copiar y pegar

Guía de prompting de Veo 3.1: Cada función explicada con prompts para copiar y pegar

Todas las funciones de Veo 3.1 de esta guía están disponibles dentro de Atlabs AI. Pruébelas gratis en atlabs.ai

La diferencia entre una generación de Veo 3.1 que parece un cortometraje de estudiantes y una que parece un tráiler cinematográfico no es el modelo. Es el prompt.

Veo 3.1 es actualmente el modelo de video con IA de mayor rendimiento en el mercado en cuanto a cumplimiento de prompts, sincronización de audio, consistencia de personajes y realismo físico. Lidera las pruebas de preferencia humana en calidad general, fidelidad visual, sincronización de audio y precisión física en comparación con todos los demás modelos probados en 2026. El problema es que la mayoría de los creadores están utilizando el 10 por ciento de lo que puede hacer.

Esta guía cubre cada función principal de Veo 3.1 con una explicación en lenguaje sencillo de lo que hace, cuándo usarla y un prompt listo para copiar y pegar para cada una. Ya sea que esté creando un anuncio de producto, un cortometraje, un video educativo o una campaña para redes sociales, cada sección le brinda algo que puede usar hoy mismo dentro de Atlabs AI, donde Veo 3.1 está disponible junto con todos los demás modelos principales de video con IA en un único espacio de trabajo.

Qué es Veo 3.1 y por qué es importante en 2026


Veo 3.1 - Designed to empower creatives

Veo 3.1 es el modelo de generación de texto a video e imagen a video más avanzado de Google DeepMind. Lanzado como una actualización importante en enero de 2026, introdujo el escalado a 4K, soporte nativo para video vertical, una función mejorada de Ingredientes a Video, Extensión de Escenas y generación completa de audio en todos los modos de creación.

A diferencia de los modelos anteriores de video con IA que procesaban cada fotograma de forma independiente, Veo 3.1 procesa el espacio, el tiempo y el audio de forma simultánea. Esta arquitectura unificada es la razón por la que su sincronización labial, física y movimiento se sienten realistas en lugar de inconsistentes. Los pasos de los personajes suenan cuando sus pies tocan el suelo. La ropa cruje al moverse. La lluvia suena como si estuviera cayendo en el entorno que describió.

La actualización de enero de 2026 convirtió a Veo 3.1 en el primer generador de videos con IA convencional con salida nativa en 4K, superando a OpenAI Sora 2, que estaba limitado a 1080p antes de su discontinuación en marzo de 2026. También introdujo el primer flujo de trabajo de Ingredientes a Video totalmente compatible con audio, lo que significa que ahora puede generar escenas con consistencia de personajes y sonido sincronizado en un solo flujo de trabajo.

Veo 3.1 está disponible dentro de Atlabs AI junto con Kling 3.0, Nano Banana y otros modelos líderes. No necesita una cuenta de Google separada, configuración de Vertex IA ni clave de API. Acceda directamente desde su espacio de trabajo de Atlabs.

Referencia completa de funciones de Veo 3.1

Todas las funciones que se enumeran a continuación están disponibles dentro de Atlabs AI sin ninguna configuración adicional.

Función

Qué hace

Mejor caso de uso

Disponible en Atlabs

Texto a video

Generar video a partir de un prompt escrito sin imagen de origen

Creación de nuevas escenas, conceptos

Sí

Imagen a video

Animar una imagen estática con movimiento y audio

Anuncios de productos, animación de personajes

Sí

Ingredientes a video

Fijar un personaje, objeto o estilo en todas las tomas

Películas, series, campañas

Sí

Primer y último fotograma

Definir los fotogramas inicial y final; la IA genera la transición

Transiciones cinematográficas, revelaciones

Sí

Audio nativo y diálogo

Generar diálogos sincronizados, efectos de sonido y sonido ambiental

Escenas de conversación, anuncios, narrativas

Sí

Extensión de escena

Continuar un clip más allá de los 8 segundos con continuidad visual

Narración de historias de formato largo

Sí

Escalado a 4K

Escalar la resolución de salida a 4K para transmisión o pantallas grandes

Cine, transmisión, comerciales

Sí

Vertical nativo 9:16

Generar de forma nativa en formato vertical para redes sociales

TikTok, Reels, Shorts

Sí

La fórmula de prompt de Veo 3.1 que produce resultados cinematográficos de manera consistente

Cada salida de alta calidad de Veo 3.1 sigue la misma lógica estructural. Una vez que interiorice esta fórmula, sus generaciones se volverán predecibles en lugar de ser una lotería.

La fórmula:

[Cinematografía] + [Sujeto] + [Acción] + [Contexto] + [Estilo visual y ambiente]

  • Cinematografía: cómo se mueve la cámara y cómo encuadra la escena

  • Sujeto: la persona, producto o entorno principal en la toma

  • Acción: qué está sucediendo y cómo evoluciona a lo largo del clip

  • Contexto: la ubicación, hora del día, condiciones ambientales

  • Estilo visual y ambiente: iluminación, gradación de color, tono y tratamiento cinematográfico

No todos los prompts necesitan las cinco capas. Un prompt fuerte de tres capas supera a uno débil de cinco. Agregue capas para aumentar la precisión, no la longitud.

El prompt mínimo viable frente al prompt cinematográfico completo

Prompt mínimo (obtiene un resultado, pero no excelente)

Mejor para: prueba rápida de concepto

Una mujer caminando por un bosque.

Prompt cinematográfico completo (obtiene exactamente lo que desea)

Mejor para: toma principal, cortometraje, campaña de marca

Toma de seguimiento lenta desde atrás, una mujer con chaqueta de lino blanca camina por un bosque de secuoyas brumoso al amanecer. Rayos de luz dorada atraviesan la copa de los árboles. La cámara se mantiene baja, siguiéndola a la altura de la cadera. Su paso es pausado y deliberado. Relación cinematográfica 2.39:1, verdes desaturados, preservación del tono de piel cálido, grano de película analógica.

La diferencia entre esos dos prompts es la diferencia entre un clip y una escena. El segundo le dice a Veo 3.1 exactamente cómo dirigir la toma, no solo qué poner en ella.


Función 1: Texto a video

El texto a video es la base. Usted escribe un prompt y Veo 3.1 genera un clip. No se requiere imagen de origen. El modelo construye la escena, los personajes, el entorno y el movimiento enteramente a partir de su descripción.

Este es el modo correcto cuando está creando una escena desde cero: un concepto que aún no existe en ningún lado, un entorno que no puede fotografiar o un personaje que está inventando en lugar de tomar como referencia de la vida real.

El error más común con el texto a video es la falta de descripción. Veo 3.1 llena cada vacío que deje con su propia interpretación. A veces eso es genial. Con mayor frecuencia, significa que pierde el control específico sobre las cosas que más importan: posición de la cámara, apariencia del personaje, tono de la iluminación.

Prompt 1: Toma de establecimiento cinematográfica

Mejor para: aperturas de cortometrajes, videos de marca, intros de YouTube

Prompt 1

Mejor para: Apertura de cortometraje, notoriedad de marca, contenido cinematográfico

Toma amplia de establecimiento. Un faro solitario en un acantilado costero irregular en el momento previo al amanecer. El mar de abajo se agita con olas lentas y pesadas. El haz del faro barre una vez a través del encuadre. Sin personas. Paleta de colores verde azulado y pizarra apagados. Niebla atmosférica densa entra desde la izquierda. Sensación cinematográfica de 24 fps, lente gran angular, toma estática.

Prompt 2: Escena de introducción de personaje

Mejor para: video narrativo, intros de canales de YouTube, narración de marca

Prompt 2

Mejor para: Narrativa basada en personajes, historia de marca, estilo documental

Toma media. Una mujer de unos treinta y tantos años parada detrás de un mostrador de cocina concurrido a las 6:00 a. m., moliendo café metódicamente. Su postura es concentrada pero relajada. Luz natural de la mañana proveniente de una ventana a su izquierda. La cocina se siente habitada y cálida. La cámara se mantiene quieta. Sin diálogo. Ruido ambiental: el molinillo funciona, sonidos distantes de la calle afuera. Auténtico y sin prisa.

https://youtube.com/shorts/64-2c1-Cves?feature=share

Prompt 3: Toma principal de producto desde texto

Mejor para: marcas de comercio electrónico, lanzamientos de productos, publicidad pagada en redes

Prompt 3

Mejor para: Anuncio de producto, marca directa al consumidor, fotograma principal para Meta o TikTok

Primer plano extremo. Una botella de vidrio de sérum para el cuidado de la piel sobre una superficie de mármol frío. Una sola gota de líquido ámbar cae en cámara lenta desde la punta del gotero y golpea el mármol. La onda se propaga con detalles nítidos. Configuración a contraluz, tonos ámbar cálidos refractados a través del vidrio. Sin texto. Sin elementos de fondo. El producto ocupa todo el encuadre.


Prompt 4: Toma de acción y energía

Mejor para: marcas deportivas, contenido de fitness, anuncios de ropa activa

Prompt 4

Mejor para: Marca de rendimiento, campaña de fitness, anuncio creativo de alta energía

Toma de seguimiento de ángulo bajo. Una atleta con un conjunto para correr sin costuras de color azul marino oscuro corre a lo largo de una carretera costera vacía al amanecer. El ángulo de la cámara se sitúa a la altura del tobillo, siguiendo hacia adelante a su lado. Desenfoque de movimiento en la superficie de la carretera. Detalle nítido en la tela y la zancada. Respiración audible. Ritmo de las pisadas sobre el asfalto. Contraluz naranja cálido, destello de lente en el horizonte, sin voz en off.

Función 2: Imagen a video

La función de Imagen a video toma un fotograma estático que usted proporciona y le añade movimiento, audio y consistencia temporal. Usted suministra el anclaje visual. Veo 3.1 le da vida.

Este modo casi siempre es más consistente que el texto a video puro para contenidos con muchos personajes. Cuando necesita que una persona específica, un producto específico o un entorno específico permanezcan visualmente idénticos a una referencia, la imagen a video es el punto de partida adecuado. El modelo trata la imagen cargada como la verdad absoluta para la identidad, el color y la composición.

El prompt en el modo de imagen a video describe el movimiento, el comportamiento de la cámara y el audio. No necesita volver a describir todo lo que se ve en la imagen. Concéntrese en lo que cambia: qué se mueve, cómo se mueve y qué hace la cámara.

Prompt 5: Animar una foto de producto

Mejor para: tomar una imagen de producto existente y hacer que se mueva para anuncios

Prompt 5

Mejor para: Anuncio de producto a partir de fotografía existente, video de comercio electrónico, creativo para redes sociales

Anima esta imagen de producto. La cámara realiza un movimiento orbital lento en el sentido de las agujas del reloj alrededor del producto, comenzando en la parte delantera izquierda y completando un arco de 90 grados. El producto gira ligeramente sobre su eje a medida que la cámara se mueve. Una suave iluminación de borde desde atrás resalta el borde del empaque. Sin cambios de fondo. No entran personas en el encuadre. Audio ambiental: sutil sonido de textura específico del producto.

https://youtube.com/shorts/nSn8lOoteC0

Prompt 6: Animar un retrato para contenido de marca

Mejor para: contenido de creadores, videos de embajadores de marca, redes sociales

Prompt 6

Mejor para: Contenido de marca, video de creador, animación para redes sociales

Anima este retrato. El sujeto gira la cabeza muy levemente hacia la derecha y se forma una leve sonrisa a lo largo de 3 segundos. El cabello se mueve mínimamente como por una ligera brisa interior. Los ojos están vivos y presentes. La cámara se mantiene completamente inmóvil. Se mantiene la iluminación cálida de estudio de la imagen de origen. Sin cambios dramáticos. Sutil, natural y humano.

Prompt 7: Entorno que cobra vida

Mejor para: bienes raíces, viajes, marcas de hospitalidad

Prompt 7

Mejor para: Video de propiedad inmobiliaria, marca de viajes, anuncio de hospitalidad

Anima esta fotografía de interior. La luz de la ventana cambia lentamente como si pasara una nube afuera. La cortina se balancea suavemente. Una vela sobre la mesa parpadea. Nada más se mueve. La cámara se mantiene estática. Audio ambiental: sonidos distantes de la calle, débil canto de pájaros a través de la ventana abierta. La escena respira sin que nadie entre en ella.


Función 3: Ingredientes a video

Ingredientes a video es la función comercialmente más significativa de Veo 3.1. Resuelve el problema que hace que el video con IA sea inutilizable para el trabajo de producción real: la pérdida de identidad.

Sin imágenes de referencia, los personajes generados por IA cambian de rostro, vestimenta y proporciones entre tomas. Un personaje que se ve de una manera en la escena uno parece un primo en la escena tres. Ingredientes a video elimina esto al permitirle cargar hasta cuatro imágenes de referencia que anclan la generación. Su personaje sigue siendo su personaje. Su producto sigue siendo su producto. Su estilo visual se mantiene consistente.

La actualización de enero de 2026 hizo que Ingredientes a video fuera totalmente compatible con audio, lo que significa que sus escenas con consistencia de personajes ahora también tienen diálogos sincronizados, sonido ambiental y efectos de sonido. Este es el flujo de producción completo en una sola función.

Prompt 8: Personaje consistente en una escena de múltiples tomas

Mejor para: cortometrajes, series de videos educativos, campañas de marca

Prompt 8

Mejor para: Narrativa de múltiples tomas, cortometraje, campaña de embajador de marca

Usando la imagen de referencia de personaje proporcionada: toma media de [nombre del personaje] ingresando a una cocina cálidamente iluminada por la mañana. Deja su bolso sobre el mostrador y mira por la ventana con una expresión de silencioso alivio. La cámara se mantiene a la altura de los ojos, acercándose suavemente durante 4 segundos. Luz de la mañana desde la izquierda, sombras cálidas. Audio: el bolso cae sobre el mostrador, un suspiro silencioso, pájaros distantes.


Prompt 9: Consistencia del producto en las tomas de la campaña

Mejor para: campañas de comercio electrónico directas al consumidor, conjuntos de anuncios creativos múltiples

Prompt 9

Mejor para: Campaña de anuncios múltiples, marca directa al consumidor, serie de videos de productos de comercio electrónico

Usando la imagen de referencia del producto proporcionada: el producto se encuentra centrado sobre una superficie de mármol negro. Una mano entra por la izquierda, lo levanta lentamente, examina la etiqueta y lo vuelve a colocar en su lugar. La cámara se mantiene estática a la altura del producto. Iluminación de estudio. La etiqueta del producto permanece legible y sin distorsiones en todo momento. Sin otros elementos. El clip dura 6 segundos.

Prompt 10: Referencia de estilo para consistencia visual

Mejor para: mantener una estética específica en una serie de videos

Prompt 10

Mejor para: Serie de contenido, campaña de marca con estilo visual fijo

Usando la imagen de referencia de estilo proporcionada como guía visual para todo este clip: un hombre de unos cuarenta y tantos años se sienta en un escritorio de madera desgastada escribiendo en un diario a la luz de una lámpara. Se detiene, mira hacia arriba a la nada en particular, luego vuelve a escribir. La cámara se mantiene estática, plano medio corto. Coincidir exactamente con la gradación de color, el contraste y la textura del grano de la imagen de referencia.

Función 4: Primer y último fotograma

Primer y último fotograma le permite definir las imágenes exactas de apertura y cierre de un clip. Usted proporciona ambas. Veo 3.1 calcula todo lo que hay en medio: el movimiento, la trayectoria de la cámara, la física, el audio.

Esta función es lo que separa a los directores de los redactores de prompts. En lugar de describir una transición y esperar que el modelo la interprete de la manera deseada, usted le muestra exactamente dónde comienza la escena y exactamente dónde termina. El modelo construye el puente.

El caso de uso más potente es la narración visual. Puede diseñar el arco emocional de una toma eligiendo un primer fotograma que establezca un estado de ánimo y un último fotograma que lo resuelva o transforme. La IA se encarga de la lógica física y temporal para la transición entre ellos.

Prompt 11: Transición de revelación de cámara

Mejor para: revelaciones cinematográficas, transiciones de escenas, lanzamientos de productos

Prompt 11 (describa la transición; proporcione los fotogramas inicial y final como imágenes)

Mejor para: Revelación cinematográfica de cámara, lanzamiento de producto, transición de película

La cámara realiza un movimiento lento de grúa hacia arriba desde el primer fotograma hasta el último. A medida que se eleva, se revela la escena más amplia detrás del sujeto. El movimiento es suave y pausado. Audio: un único aumento musical sostenido que comienza en el primer fotograma y se resuelve en el último. La atmósfera cambia de íntima a expansiva a lo largo de los 8 segundos.

Prompt 12: Cambio de estado del personaje

Mejor para: narración emocional, narrativa de antes y después, arcos de transformación en anuncios

Prompt 12 (proporcione la imagen de retrato como primer fotograma, la imagen con diferente expresión como último fotograma)

Mejor para: Narrativa emocional, historia de marca, anuncio de transformación

Genere la transición entre los dos fotogramas de forma natural. La expresión del personaje evoluciona continuamente sin saltos bruscos. El cambio de emoción se lee como interno y genuino, no actuado. La cámara se mantiene estática. La iluminación coincide con ambos fotogramas de entrada. Audio: tono ambiental de la sala, sin música, sin diálogo. El silencio convierte al cambio emocional en el evento principal.

Prompt 13: Transformación del entorno

Mejor para: campañas estacionales, contenido de marca de antes y después, bienes raíces

Prompt 13 (proporcione el primer fotograma que muestra el entorno en el estado A, el último fotograma en el estado B)

Mejor para: Campaña de transformación de marca, contenido estacional, marketing inmobiliario

El espacio realiza una transición continua desde el estado del primer fotograma al del último fotograma a lo largo de 8 segundos. El cambio se desarrolla como una progresión temporal natural, no como un corte o disolvencia. La iluminación cambia para adaptarse al nuevo estado. La cámara se mantiene estática. El audio transiciona del paisaje sonoro ambiental del primer fotograma al del último. La transformación se siente inevitable.

Función 5: Audio nativo y diálogo

La generación de audio de Veo 3.1 no es un elemento secundario añadido sobre un video silencioso. Se genera simultáneamente con el contenido visual utilizando la misma arquitectura unificada. Esta es la razón por la que el audio se siente físicamente integrado: los pasos ocurren cuando los pies tocan el suelo, la lluvia suena como si cayera en ese entorno específico y el diálogo está sincronizado a un nivel que resiste una inspección cercana.

El lenguaje del prompt de audio tiene tres componentes distintos, y la forma en que los estructure determina si su audio suena diseñado o accidental.

  • Diálogo: use comillas para cualquier línea hablada específica. El modelo sincroniza el habla con el movimiento y la expresión del personaje.

  • Efectos de sonido (SFX): describa sonidos específicos con indicaciones de tiempo. Veo 3.1 los genera con precisión contra la acción visual.

  • Audio ambiental: defina el paisaje sonoro de fondo. Esto es lo que hace que una escena se sienta como un lugar real y no como un simple telón de fondo.

Prompt 14: Escena de diálogo

Mejor para: escenas de cortometrajes, videos de portavoces de marca, anuncios testimoniales

Prompt 14

Mejor para: Escena de diálogo, cortometraje, portavoz de marca, testimonio

Toma media. Un hombre de unos treinta y tantos años se sienta frente a la cámara en la mesa de un pequeño café. Se inclina ligeramente hacia adelante y dice: "He estado haciendo esto durante veinte años y nunca había visto algo así". Hace una pausa y mira de reojo su café antes de volver a levantar la vista. La cámara se mantiene estática. Luz cálida de la tarde de una ventana detrás de él. Audio ambiental: suave ruido de fondo de café, sonidos distantes de la calle.

Prompt 15: Escena impulsada por efectos de sonido

Mejor para: anuncios de productos donde el sonido del producto es el punto de venta

Prompt 15

Mejor para: Anuncio de producto, contenido impulsado por audio, video de producto estilo ASMR

Primer plano extremo de una taza de café de cerámica que se coloca deliberadamente sobre una superficie de mármol. SFX: el clic preciso de cerámica sobre mármol al asentarse, luego silencio, luego el sonido sutil del líquido asentándose dentro de la taza. Sin diálogo. Sin música. Sin voces ambientales. Solo el objeto y sus sonidos. La cámara se mantiene estática. Contraluz, iluminación cálida de estudio.


Prompt 16: Paisaje sonoro ambiental completo

Mejor para: videos de marca atmosféricos, contenido de viajes, videos inmobiliarios

Prompt 16

Mejor para: Video de marca, contenido de viajes, bienes raíces, video atmosférico

Toma amplia de un prado de montaña a media mañana a principios de verano. Una figura solitaria se sienta en la distancia media leyendo. La cámara se mantiene completamente estática. Audio ambiental: viento moviéndose a través de la hierba alta, un arroyo en algún lugar fuera de encuadre, cantos de pájaros ocasionales a intervalos naturales, ningún sonido hecho por humanos. La escena transcurre durante 8 segundos sin que nadie hable o se mueva dramáticamente.

Prompt 17: Escena de diálogo multilingual

Mejor para: campañas internacionales, contenido de marca global, anuncios regionales

Prompt 17

Mejor para: Campaña publicitaria internacional, contenido de marca multilingüe

Toma media. Una mujer en el mostrador de una cocina se gira hacia la cámara y dice: [insertar línea en el idioma de destino]. Su sincronización labial coincide exactamente con el idioma. La cámara se mantiene estática. Luz natural de la mañana en la cocina. Tono conversacional y cálido. Genere este prompt por separado para cada versión de idioma requerida, manteniendo idénticos todos los demás parámetros visuales en todas las versiones.

Función 6: Extensión de escena

La Extensión de escena resuelve una de las limitaciones estructurales más persistentes del video con IA: el límite de 8 segundos. En lugar de limitarse a clips cortos que deben unirse de forma externa, la Extensión de escena le permite generar la continuación de cualquier clip existente que se conecte sin problemas con el segmento anterior.

En la práctica, esto significa que puede construir una narrativa que dure un minuto o más, todo generado dentro de Veo 3.1 con una identidad visual consistente, un entorno de audio consistente y un lenguaje de cámara consistente en todo momento. Cada extensión hereda el contexto visual y de audio del segmento anterior.

La clave para que la Extensión de escena funcione bien es la descripción de la superposición. Al escribir el prompt de extensión, haga referencia a detalles visuales específicos del segmento anterior: la ropa del personaje, la condición de iluminación, la acción en curso. Cuanto más específicamente ancle la extensión a lo que vino antes, más fluida será la conexión.

Prompt 18: Extender una escena narrativa

Mejor para: cortometrajes, contenido documental, videos de marca de formato largo

Prompt 18

Mejor para: Cortometraje, narrativa de marca de formato largo, contenido documental

Continúe desde el segmento anterior donde [el personaje con el abrigo de lana gris] estaba de pie junto a la ventana mirando hacia afuera. Ahora se gira lentamente desde la ventana y camina hacia la puerta de la cocina. Su expresión ha cambiado de reflexiva a decidida. La cámara la sigue a media distancia. La iluminación sigue siendo la misma luz interior de última hora de la tarde. Audio: sus pasos sobre el suelo de madera, luego los sonidos ambientales de la escena anterior continúan.

Prompt 19: Extender una escena de campaña de producto

Mejor para: demostraciones de productos de formato largo, series de videos de campañas

Prompt 19

Mejor para: Video de demostración de producto, campaña de formato largo, comercio electrónico

Continúe desde el clip anterior donde [el producto, botella de vidrio ámbar] estaba centrado en la superficie de mármol. Una mano entra ahora por la derecha y abre la tapa lentamente. La cámara se mantiene en el mismo ángulo y altura. Continúa la misma configuración de iluminación. Audio: el sonido sutil de la tapa al ser retirada, luego una breve pausa que sugiere aroma. Sin narración. La acción del producto continúa sin cortes.


Lenguaje de cámara: La capa de prompt que la mayoría de los creadores omite

La dirección de cámara es el elemento menos utilizado en la creación de prompts de video con IA. La mayoría de los creadores describen qué hay en la escena. Los creadores que logran resultados cinematográficos describen cómo lo ve la cámara.

Veo 3.1 interpreta el lenguaje de dirección de cámara a nivel profesional. No son sugerencias. Son instrucciones que el modelo sigue con precisión cuando se enuncian con claridad.

Prompts de movimiento

Qué hace la cámara a través del espacio

Dolly in (acercamiento)

Mejor para: generar intimidad, enfatizar emociones, entrar en una escena

CÁMARA: ACERCAMIENTO LENTO CON DOLLY. La cámara se mueve físicamente hacia adelante hacia [el sujeto], cerrando la distancia de plano abierto a medio a lo largo de 6 segundos. La perspectiva del fondo se amplía a medida que la cámara avanza. El sujeto no se mueve.

Grúa hacia arriba (Crane up)

Mejor para: establecer escala, finalizar una escena, revelar el contexto superior

CÁMARA: MOVIMIENTO DE GRÚA HACIA ARRIBA. Comenzando a nivel del suelo mirando hacia arriba a [el sujeto], la cámara se eleva vertical y continuamente hasta alcanzar una altura cenital, revelando todo el entorno de abajo. El movimiento es constante y sin prisas.

Seguimiento orbital (Orbital track)

Mejor para: tomas de productos, revelaciones de personajes, narración espacial

CÁMARA: SEGUIMIENTO ORBITAL LENTO. La cámara rodea a [el sujeto] en el sentido de las agujas del reloj, completando un arco de 180 grados a lo largo de 8 segundos. El sujeto permanece centrado en todo momento. El fondo gira continuamente detrás de él.

Cámara en mano (Handheld)

Mejor para: contenido estilo UGC, sensación de documental, autenticidad

CÁMARA: CÁMARA EN MANO. La cámara sostiene a [el sujeto] con movimiento humano natural: ligero desplazamiento, microajustes ocasionales, ritmo de respiración auténtico. El movimiento es intencional y observacional, no inestable. Realismo documental.

Prompts de encuadre

Qué tan cerca está la cámara del sujeto y desde qué ángulo

Primer plano extremo

Mejor para: textura del producto, intensidad emocional, tomas de detalles

PRIMER PLANO EXTREMO. El encuadre contiene únicamente [detalle específico: la costura del cuello / la etiqueta de la botella / el contacto visual]. Nada más es visible. El detalle llena todo el encuadre. Profundidad de campo muy reducida, fondo completamente disuelto.

Ángulo bajo

Mejor para: comunicar poder, escala o aspiración

TOMA DE ÁNGULO BAJO. Cámara posicionada por debajo del nivel de los ojos de [el sujeto], mirando hacia arriba a aproximadamente 30 grados. Esto hace que el sujeto parezca más alto y más imponente. El cielo o el techo llena la parte superior del encuadre detrás de él.

Sobre el hombro (Over-the-shoulder)

Mejor para: escenas de diálogo, revelar lo que un personaje está viendo o haciendo

TOMA SOBRE EL HOMBRO. Cámara posicionada detrás y ligeramente a la derecha de [personaje A], mirando más allá de su hombro hacia [personaje B u objeto]. El hombro del personaje A ocupa la parte inferior izquierda del encuadre. El enfoque está en aquello a lo que se enfrenta.

Función 8: Salida en 4K y video vertical nativo

Dos especificaciones de formato que importan enormemente para el uso posterior de su salida de Veo 3.1.

Escalado a 4K

Veo 3.1 introdujo la salida en 4K (3840 x 2160) en enero de 2026, convirtiéndose en el primer generador de videos con IA convencional en alcanzar esta resolución. La implicación práctica: las salidas ahora son utilizables para transmisiones de televisión, cine y pantallas comerciales de gran formato sin ninguna degradación visible de la calidad.

Para la mayoría de las aplicaciones web y de redes sociales, 1080p es suficiente y más rápido de generar. Utilice 4K para:

  • Comerciales de televisión y pautas de transmisión

  • Publicidad en pantallas de gran formato (fuera del hogar, pantallas de eventos)

  • Videos de marca de alta gama destinados a proyecciones teatrales o festivales

  • Cualquier salida que vaya a ser recortada o ampliada significativamente en postproducción

Prompt 20: Video vertical nativo para TikTok y Reels

Mejor para: TikTok, Instagram Reels, YouTube Shorts

Prompt 20

Mejor para: Anuncio de TikTok, Instagram Reels, YouTube Shorts, contenido social vertical

Encuadre vertical 9:16. Una astronauta solitaria con traje blanco se arrodilla en una llanura desértica roja y planta con cuidado una pequeña plántula verde en el suelo. La cámara retrocede lentamente para revelar la interminable y desolada llanura a su alrededor. Al retroceder, miles de flores ya están floreciendo en el paisaje hasta donde alcanza el encuadre. Esperanzador y cinematográfico. Sin diálogo. Audio ambiental: viento, el suave sonido de la tierra, luego un aumento de tono musical silencioso.

Prompt 21: Anuncio de producto vertical

Mejor para: TikTok Shop, colocación de productos en Reels, publicidad pagada vertical en redes

Prompt 21

Mejor para: Anuncio de TikTok Shop, colocación de producto en Reels, creativo publicitario social vertical

Encuadre vertical 9:16. Una mano sostiene [el producto] en el centro del encuadre contra un fondo blanco limpio. El producto gira lentamente un cuarto de vuelta. La cámara realiza un acercamiento suave hacia el detalle de la etiqueta. Audio: sin música, sin voz en off, solo la textura ambiental del material del producto. Todo el clip dura 6 segundos. Limpio, minimalista, centrado en el producto.

Flujo de trabajo avanzado: Creación de una escena de múltiples tomas dentro de Atlabs

La forma más potente de utilizar Veo 3.1 no es generar clips aislados. Es construir una secuencia estructurada de múltiples tomas donde cada clip se planifica como parte de una escena coherente. Este es el flujo de trabajo exacto para hacer eso dentro de Atlabs, combinando Nano Banana para imágenes de referencia y Veo 3.1 para la generación.

Flujo de trabajo 1: Escena de diálogo con personajes consistentes

  1. Genere imágenes de referencia de personajes utilizando Nano Banana dentro de Atlabs. Cree una referencia para cada personaje que muestre su apariencia completa, vestimenta y expresión. Genere una referencia de entorno para el escenario.

  2. Cargue todas las imágenes de referencia como Ingredientes a video en Veo 3.1. Esto fija la identidad del personaje y el entorno en cada toma.

  3. Escriba el prompt de la toma 1: la toma de establecimiento o amplia que ambienta la escena y presenta a los personajes.

  4. Escriba el prompt de la toma 2: la primera toma de diálogo. Incluya la línea hablada exacta entre comillas. Especifique qué personaje habla y su posición en el encuadre.

  5. Escriba el prompt de la toma 3: la toma de respuesta. Mismas referencias de entorno, diferente personaje en primer plano. Incluya su línea de respuesta.

  6. Utilice Primer y último fotograma si necesita un movimiento de cámara o transición específica entre tomas.

  7. Utilice la Extensión de escena para conectar tomas en una secuencia más larga e ininterrumpida si la escena dura más de 8 segundos.

Dentro de Atlabs, todos estos pasos ocurren en un solo espacio de trabajo. No necesita exportar, importar ni reconstruir entre cambios de modelo. Nano Banana y Veo 3.1 comparten el mismo entorno de proyecto.

Flujo de trabajo 2: Campaña de producto con consistencia visual

  1. Genere una imagen principal del producto en Nano Banana utilizando el estilo de prompt de explosión de ingredientes o toma de producto principal.

  2. Cargue esa imagen como referencia de Ingredientes a video para todas las generaciones posteriores de Veo 3.1. Cada escena tratará esa imagen del producto como la verdad visual para el color, la forma y el detalle de la etiqueta.

  3. Genere la toma 1: producto principal con movimiento de cámara. De 6 a 8 segundos.

  4. Genere la toma 2: producto en contexto de estilo de vida. Diferente entorno, misma identidad visual del producto.

  5. Genere la toma 3: primer plano de características del producto. Misma referencia de producto, diferente encuadre.

  6. Agregue voz en off o diálogo usando Atlabs Avatar en cualquiera de los idiomas de destino de la campaña.

  7. Exporte cada clip en el formato requerido: 9:16 para TikTok, 1:1 para el feed de Meta, 16:9 para YouTube.

Prompts negativos: Qué evitar y cómo decirlo

Veo 3.1 no responde bien a negativos instruccionales como "sin fondo borroso" o "sin personas". Responde mucho mejor a descripciones que hacen que el elemento no deseado esté ausente de forma natural.

Débil: "Sin estructuras construidas por el hombre en el fondo".

Fuerte: "Una naturaleza estéril que se extiende hasta el horizonte en todas las direcciones, pastizales y cielo intactos, sin carreteras, sin edificios, sin vallas, nada más que tierra y luz".

Débil: "Sin texto en pantalla".

Fuerte: "Encuadre visual limpio, sin superposiciones, sin marcas de agua, sin subtítulos, sin gráficos. La imagen es el único elemento".

Débil: "No demasiado dramático".

Fuerte: "Atmósfera silenciosa, sobria. Contraste mínimo. Paleta apagada. El tono es observacional, no teatral".

20 prompts más de Veo 3.1 listos para copiar y pegar por caso de uso

Cada uno de los prompts a continuación está listo para pegarse en Veo 3.1 dentro de Atlabs. Cambie los detalles entre corchetes por su contenido específico.

Cortometraje y narrativa

Prompt 22: Apertura de escena

Mejor para: Cortometraje, video narrativo, apertura de serie de YouTube

Dolly in lento. Una mesa de cocina a las 7:00 a. m. con dos tazas de café vacías y una nota doblada por la mitad. Sin personas. Luz de la mañana a través de cortinas blancas. Audio: sonidos lejanos de un vecindario que despierta. La escena da a entender que alguien acaba de estar aquí. 6 segundos.

Prompt 23: Clímax emocional

Mejor para: Punto de inflexión en cortometraje, anuncio emocional

Primer plano del rostro de una mujer. Lee algo fuera de pantalla. Su expresión pasa lentamente de la confusión a la comprensión y luego a algo difícil de nombrar. La cámara se mantiene completamente quieta. Sin diálogo. Audio: el tenue sonido ambiental se desvanece aún más. El silencio es intencional. 8 segundos.

Redes sociales y contenido orgánico

Prompt 24: Apertura de un día en la vida

Mejor para: vlog de YouTube, serie de TikTok, contenido de marca de estilo de vida

Toma POV desde un poco arriba. Una mano se estira y apaga la alarma de un teléfono a las 5:47 a. m. La pantalla del teléfono muestra la hora con claridad. Oscuridad cálida de dormitorio alrededor. Audio: la alarma se apaga, luego el sonido de las sábanas moviéndose. Sensación de cámara en mano. Auténtico, no escenificado.

Prompt 25: Bucle de proceso satisfactorio

Mejor para: orgánico de TikTok, Reels, video de Pinterest

Toma cenital de manos dando forma a una porción de masa sobre una superficie enharinada. El movimiento es rítmico y practicado. La masa responde de forma natural. Audio: los sonidos suaves de presión del proceso, sin música. 6 segundos, se repite en bucle de forma limpia.

Educativo y explicativo

Prompt 26: Visualización de conceptos

Mejor para: Video educativo, contenido explicativo, curso en línea

Diagrama isométrico animado de [concepto o proceso]. Fondo blanco limpio. Los elementos aparecen secuencialmente como si se estuvieran dibujando. Las etiquetas aparecen en una fuente sans-serif clara. Tranquilo, organizado y legible en pantallas pequeñas. Sin voz en off en el clip, espacio libre para superposición de narración.

Prompt 27: Introducción del sujeto

Mejor para: Serie educativa, introducción de avatar de profesor, apertura de módulo de curso

Toma media. [El personaje del instructor] se sienta frente a un escritorio limpio mirando a la cámara. Se inclina ligeramente hacia adelante y dice: "En esta lección, vamos a cubrir [tema] y al final sabrán exactamente cómo [resultado]". Contacto visual natural. Energía cálida pero enfocada. Fondo sencillo. Sin distracciones.

Bienes raíces y arquitectura

Prompt 28: Apertura de recorrido por propiedad

Mejor para: Publicación inmobiliaria, marketing de propiedades, portafolio de arquitectura

Toma de seguimiento constante hacia adelante entrando por la puerta principal de una casa de diseño abierto llena de luz. La cámara se mueve lenta y continuamente a través del vestíbulo hacia la sala de estar. La luz de la mañana inunda el espacio. Sin personas. Audio: los sonidos ambientales sutiles de la casa, sin música. El espacio se vende solo.

Prompt 29: Toma de establecimiento exterior

Mejor para: Publicación inmobiliaria, video de fotografía arquitectónica

Toma de establecimiento amplia. Un edificio residencial blanco moderno en una calle arbolada a primera hora de la mañana. La cámara se mantiene estática durante 2 segundos y luego comienza un empuje muy lento hacia la entrada. Luz de la hora dorada. Sombras limpias. Sin personas. Audio: pájaros, un coche lejano, luego silencio. 8 segundos.

Viajes y hospitalidad

Prompt 30: Pieza de ambiente de destino

Mejor para: Marca de viajes, campaña de turismo, marca de hospitalidad

Vuelo de dron. Un pequeño pueblo de pescadores al amanecer. Barcos en un puerto tranquilo, edificios pintados de colores en una colina, humo que comienza a subir de una chimenea. La cámara se mueve lentamente hacia adelante y un poco hacia abajo, como si descendiera. Audio: gaviotas, agua, el arranque lejano del motor de un barco. Sin narración. Pura atmósfera.


Prompt 31: Revelación de habitación de hotel

Mejor para: Marca de hotel, viajes de lujo, contenido de hospitalidad

CÁMARA: ACERCAMIENTO LENTO CON DOLLY a través de las puertas abiertas del balcón. Una cama de hotel perfectamente hecha se encuentra frente a la cámara con vistas al océano del piso al techo detrás de ella. La luz de la mañana inunda la habitación. Cortinas ligeras flotan con una suave brisa. Audio: olas del mar, viento, silencio absoluto. 8 segundos. La vista y la habitación lo son todo.

Salud y bienestar

Prompt 32: Ritual matutino

Mejor para: Marca de bienestar, anuncio de suplementos, contenido de estilo de vida

Toma de seguimiento lenta en primer plano que sigue a una mano que coloca un vaso de agua, una botella de suplementos y un diario uno al lado del otro sobre una superficie blanca. El movimiento es deliberado y tranquilo. Audio: el sonido de los elementos al ser colocados, luego silencio. Luz de la mañana. Sin texto. Sin narración. La rutina es el mensaje.

Prompt 33: Movimiento y respiración

Mejor para: Marca de fitness, estudio de yoga, contenido para aplicaciones de salud mental

Toma amplia estática de una figura sobre una esterilla de yoga al amanecer en una terraza al aire libre. La figura se mueve a través de una secuencia de respiración lenta. La cámara se mantiene completamente inmóvil. Audio: el sonido de la respiración, el canto de los pájaros, un viento suave. Sin música. Sin voz en off. 8 segundos.


Finanzas y servicios profesionales

Prompt 34: Escena de confianza y credibilidad

Mejor para: Marca de servicios financieros, bufete de abogados, servicios profesionales

Toma media. Una mujer vestida con atuendo profesional se sienta frente a la cámara en un escritorio limpio y dice: "Hemos ayudado a más de [número] familias a proteger lo que más importa y estamos listos para hacer lo mismo por usted". Tranquilo y directo. Fondo cálido y neutro. Iluminación profesional suave. Sin más movimiento que el habla natural.

Prompt 35: Revelación de visualización de datos

Mejor para: Marca B2B, fintech, video de producto SaaS

Gráfico animado: un panel de control limpio con métricas clave aparece elemento por elemento sobre un fondo oscuro. Cada punto de datos se materializa con un sutil énfasis visual. Sin voz en off en el clip. Audio: diseño de sonido de interfaz de usuario mínimo. La complejidad visual se acumula hasta un momento de claridad donde el número clave ocupa el centro del encuadre.

Moda y lujo

Prompt 36: Estética de pasarela

Mejor para: Campaña de marca de moda, etiqueta de lujo, contenido editorial

Toma de seguimiento lateral en cámara lenta extrema. Una modelo con un abrigo estructurado largo de color marfil se aleja de la cámara a través de un espacio de galería blanco y vacío. La tela se mueve dramáticamente con cada paso. La cámara realiza el seguimiento a la altura de las caderas, perfectamente nivelada. Conversión a blanco y negro de alto contraste. Audio: silencio roto solo por el sonido amplificado de la tela.

Prompt 37: Primer plano de producto para marca de lujo

Mejor para: Lanzamiento de producto de lujo, venta minorista de alta gama, marca de relojes o joyería

Primer plano macro de [producto: esfera de reloj mecánico]. El segundero avanza en tiempo real. La luz incide en diferentes facetas de la esfera mientras la cámara realiza un movimiento orbital microscópico. Audio: el tictac preciso y amplificado del mecanismo. Sin música. La artesanía es toda la historia.

Alimentación y restauración

Prompt 38: Chef en acción

Mejor para: Marca de restaurante, campaña de marca de alimentos, contenido culinario

Toma media de seguimiento de las manos de un chef mientras se mueven de manera eficiente a través de una secuencia de preparación: picar, organizar, salsear. La cámara sigue las manos en lugar de la cara. Audio: el ritmo del picado, el chisporroteo de una sartén, ambiente de cocina. Sin diálogo. 8 segundos de puro arte culinario.

Prompt 39: La revelación del plato perfecto

Mejor para: Marketing de restaurantes, marca de entrega de alimentos, contenido de recetas

Toma cenital con un empuje lento hacia un plato terminado. El plato está centrado. La comida está dispuesta con deliberada precisión. La cámara se acerca hasta que el ingrediente principal llena el encuadre. Audio: un leve chisporroteo al principio, luego el sonido ambiental de un comedor tranquilo. Sin voz en off. Deje que la comida hable por sí misma.


Tecnología y SaaS

Prompt 40: Recorrido por la interfaz del producto

Mejor para: Marketing de productos SaaS, lanzamiento de aplicaciones, marca de software B2B

Toma de seguimiento a nivel de pantalla que se desplaza suavemente por la pantalla de una computadora portátil que muestra [la interfaz del producto]. El cursor se mueve de forma natural entre los elementos de la interfaz. Audio: sonidos sutiles de interacción de la interfaz de usuario en cada punto de contacto clave. Entorno cálido de oficina en casa reflejado tenuemente en la pantalla. Sin voz en off. La interfaz se demuestra por sí misma.

Cómo usar Veo 3.1 dentro de Atlabs AI

Atlabs AI es la única plataforma donde todas las funciones de Veo 3.1 de esta guía son accesibles en un solo espacio de trabajo junto con Kling 3.0, Nano Banana y todos los demás modelos líderes de IA. Sin claves de API. Sin configuración de Vertex IA. Sin cuenta de Google separada.

  1. Vaya a atlabs.ai y cree una cuenta gratuita.

  2. Abra un nuevo proyecto de video y seleccione Veo 3.1 como su modelo.

  3. Elija su modo: Texto a video, Imagen a video, Ingredientes a video, Primer y último fotograma o Extensión de escena.

  4. Si utiliza Ingredientes a video o Primer y último fotograma, genere primero sus imágenes de referencia utilizando Nano Banana en el mismo espacio de trabajo.

  5. Pegue su prompt utilizando la fórmula de cinco capas de esta guía.

  6. Seleccione su formato de salida: 720p o 1080p, 4K si es necesario, 16:9 o 9:16 para formato vertical.

  7. Genere. Altere. Utilice el mismo espacio de trabajo para agregar voz en off, subtítulos y mezcla de audio antes de exportar.

Tiempo total desde el prompt hasta el video listo para exportar: de 8 a 20 minutos para una escena completa, dependiendo del número de tomas y alteraciones.

Pruebe gratis todas las funciones de Veo 3.1 de esta guía dentro de Atlabs AI. Comience en atlabs.ai

¿Listo para contar tu historia?

¿Listo para contar tu historia?

¿Listo para contar tu historia?