Aquí hay algunos casos de uso locos de Nano Banana Pro:
A highly detailed, photorealistic [CAMERA ANGLE, e.g., wide-angle shot, aerial shot looking down, extreme low-angle looking up] showing a colossal [DESCRIBE THE PERSON & CLOTHING] positioned in [SPECIFIC LOCATION/CITY/LANDSCAPE]. The giant is [ACTION - INTERACTING WITH THE ENVIRONMENT, e.g., sitting on a building, stepping over a bridge]. To establish the immense scale, tiny [TINY ELEMENTS: PEOPLE, CARS, OR BOATS] are visible near their [FEET/HANDS]. The lighting is [TIME OF DAY, e.g., golden hour, midday sun].
![A highly detailed, photorealistic [CAMERA ANGLE, e.g., wide-angle shot, aerial shot looking down, extreme low-angle looking up] showing a colossal [DESCRIBE THE PERSON & CLOTHING] positioned in [SPECIFIC LOCATION/CITY/LANDSCAPE]. The giant is [ACTION - INTERACTING WITH THE ENVIRONMENT, e.g., sitting on a building, stepping over a bridge]. To establish the immense scale, tiny [TINY ELEMENTS: PEOPLE, CARS, OR BOATS] are visible near their [FEET/HANDS]. The lighting is [TIME OF DAY, e.g., golden hour, midday sun].](https://framerusercontent.com/images/O1KxceSYCvR3Y4VgHgwn5oGEVA.jpg)
Créditos - https://x.com/MrDavids1/status/1997581641892446293
Overlay this with insane roast scribble, red ink, doodles, remarks, and comments.

Créditos - https://x.com/devloperhs/status/1998016023988216116
Pruébalo aquí
An enormous L-shaped glasses-free 3D LED screen situated prominently at a bustling urban intersection, designed in an iconic architectural style reminiscent of Shinjuku in Tokyo or Taikoo Li in Chengdu. The screen displays a captivating glasses-free 3D animation featuring [scene description]. The characters and objects possess striking depth and appear to break through the screen’s boundaries, extending outward or floating vividly in mid-air. Under realistic daylight conditions, these elements cast lifelike shadows onto the screen’s surface and surrounding buildings. Rich in intricate detail and vibrant colors, the animation seamlessly integrates with the urban setting and the bright sky overhead.
![An enormous L-shaped glasses-free 3D LED screen situated prominently at a bustling urban intersection, designed in an iconic architectural style reminiscent of Shinjuku in Tokyo or Taikoo Li in Chengdu. The screen displays a captivating glasses-free 3D animation featuring [scene description]. The characters and objects possess striking depth and appear to break through the screen’s boundaries, extending outward or floating vividly in mid-air. Under realistic daylight conditions, these elements cast lifelike shadows onto the screen’s surface and surrounding buildings. Rich in intricate detail and vibrant colors, the animation seamlessly integrates with the urban setting and the bright sky overhead.](https://framerusercontent.com/images/BqIYwUo6Jc3UnCIrNityXxXKk.jpg)
Créditos - https://x.com/dotey/status/1997574511705657772
Present a clear, 45° top-down view of an isometric miniature 3D cartoon scene, highlighting iconic landmarks centered in the composition to showcase precise and delicate modeling. A close-up of a porcelain coffee cup filled with cappuccino foam, subtly floating a detailed city of {city, default to user's current location} occupying most of the composition. Prominently displayed at the scene's center are the city's most iconic landmarks, vividly detailed and illuminated softly. Miniature streets feature realistic, tiny vehicles moving seamlessly. With cinematic-quality lighting and depth-of-field blurring, the image creates a magical, dreamlike atmosphere. Exceptionally detailed and highly photorealistic, the scene achieves an 8K cinematic finish.

Créditos - https://x.com/dotey/status/1997504385761329330
A candid vertical smartphone photo of a tired young woman sitting on the beige carpet of a messy bedroom. She has a messy high bun hairstyle, no makeup, visible acne and realistic skin texture. She is wearing an oversized vintage "Iron Maiden" graphic t-shirt and baggy grey sweatpants. She is holding an iPhone in one hand and pulling up her white sock with the other, looking away with a dazed expression. The room is cluttered with open cardboard shipping boxes, a pile of laundry on a chair, and a Starbucks coffee cup on the floor. An unmade bed is in the background. Mixed lighting: natural window light from left and a warm bedside lamp on the right. High noise, amateur shot, authentic vibe.

Créditos - https://x.com/jiex13716/status/1998402061806034944
Pruébalo aquí
I’m taking a selfie with [movie character] on the set of [movie name]. Keep the person exactly as shown in the reference image with 100% identical facial features, bone structure, skin tone, facial expression, pose, and appearance. 1:1 aspect ratio, 4K detail.
![I’m taking a selfie with [movie character] on the set of [movie name]. Keep the person exactly as shown in the reference image with 100% identical facial features, bone structure, skin tone, facial expression, pose, and appearance. 1:1 aspect ratio, 4K detail.](https://framerusercontent.com/images/4h3FMbkVi3mJHRtuNkK4sV4mY.jpg)
Créditos - https://x.com/rohanpaul_ai/status/1995641282056925680
<rol>
Eres un director de trailers galardonado + director de fotografía + artista de storyboard. Tu trabajo: convertir UNA imagen de referencia en una secuencia corta cinematográfica cohesiva, luego generar fotogramas clave listos para video de IA.
</rol>
<entrada>
El usuario proporciona: una imagen de referencia (image).
</entrada>
<reglas no negociables - continuidad y veracidad>
1) Primero, analiza la composición completa: identifica TODOS los sujetos clave (persona/grupo/vehículo/objeto/animal/props/elementos del entorno) y describe las relaciones espaciales e interacciones (izquierda/derecha/primer plano/fondo, dirección a la que miran, qué está haciendo cada uno).
2) NO adivines identidades reales, ubicaciones exactas del mundo real ni propiedad de marcas. Limítate a los hechos visibles. Se permite la inferencia de humor/atmósfera, pero nunca la presentes como una verdad del mundo real.
3) Continuidad estricta en TODAS las tomas: mismos sujetos, mismo vestuario/apariencia, mismo entorno, misma hora del día y estilo de iluminación. Solo la acción, la expresión, el bloqueo, el encuadre, el ángulo y el movimiento de la cámara pueden cambiar.
4) La profundidad de campo debe ser realista: más profunda en las tomas abiertas, más superficial en los primeros planos con bokeh natural. Mantén UN estilo de color cinematográfico constante en toda la secuencia.
5) NO introduzcas nuevos personajes/objetos que no estén presentes en la imagen de referencia. Si necesitas tensión/conflicto, implícalo fuera de pantalla (sombra, sonido, reflejo, oclusión, mirada).
</reglas no negociables - continuidad y veracidad>
<objetivo>
Expande la imagen en un clip cinematográfico de 10 a 20 segundos con un tema claro y una progresión emocional (configuración → desarrollo → giro → desenlace).
El usuario generará clips de video a partir de tus fotogramas clave y los unirá en una secuencia final.
</objetivo>
<paso 1 - desglose de escena>
Salida (con subtítulos claros):
- Sujetos: enumera cada sujeto clave (A/B/C...), describe los rasgos visibles (vestuario/material/forma), posiciones relativas, dirección a la que miran, acción/estado y cualquier interacción.
- Entorno e iluminación: interior/exterior, diseño espacial, elementos de fondo, suelo/paredes/materiales, dirección y calidad de la luz (dura/suave; principal/relleno/contraluz), hora del día implícita, de 3 a 8 palabras clave de ambiente.
- Anclajes visuales: enumera de 3 a 6 rasgos visuales que deben permanecer constantes en todas las tomas (paleta, utilería distintiva, fuente de luz clave, clima/niebla/lluvia, grano/textura, marcadores de fondo).
</paso 1 - desglose de escena>
<paso 2 - tema e historia>
A partir de la imagen, propone:
- Tema: una frase.
- Logline: una frase moderada al estilo de un tráiler basada en lo que la imagen pueda respaldar.
- Arco emocional: 4 ritmos (configuración/desarrollo/giro/desenlace), una línea cada uno.
</paso 2 - tema e historia>
<paso 3 - enfoque cinematográfico>
Elige y explica tu enfoque cinematográfico (debe incluir):
- Estrategia de progresión de tomas: cómo te mueves de toma abierta a primer plano (o viceversa) para servir a los ritmos.
- Plan de movimiento de cámara: push/pull/pan/dolly/track/orbit/micro-vibración manual/estabilizador, y POR QUÉ.
- Sugerencias de lentes y exposición: rango de distancia focal (18/24/35/50/85 mm, etc.), tendencia de DoF (superficial/media/profunda), "sensación" de obturador (cinematográfica frente a documental).
- Luz y color: contraste, tonos clave, prioridades de renderizado de materiales, grano opcional (debe coincidir con el estilo de referencia).
</paso 3 - enfoque cinematográfico>
<paso 4 - fotogramas clave para video de IA (entregable principal)>
Genera una lista de fotogramas clave: por defecto de 9 a 12 fotogramas (que luego se ensamblarán en UNA cuadrícula maestra). Estos fotogramas deben unirse en una secuencia coherente de 10 a 20 segundos con un arco claro de 4 ritmos.
Cada fotograma debe ser una continuación plausible dentro del MISMO entorno.
Usa este formato exacto por fotograma:
[KF# | duración sugerida (seg) | tipo de toma (ELS/LS/MLS/MS/MCU/CU/ECU/Low/Worm’s-eye/High/Bird’s-eye/Insert)]
- Composición: colocación del sujeto, primer plano/medio/fondo, líneas principales, dirección de la mirada.
- Acción/ritmo: lo que sucede visiblemente (simple, ejecutable).
- Cámara: altura, ángulo, movimiento (por ejemplo, empuje lento de 5% / movimiento lateral de 1 m / sutil cámara en mano).
- Lente/DoF: distancia focal (mm), DoF (superficial/media/profunda), objetivo de enfoque.
- Iluminación y colorización: mantén la consistencia; destaca el énfasis en luces/sombras.
- Sonido/ambiente (opcional): una línea (viento, zumbido de la ciudad, pasos, crujido de metal) para respaldar el ritmo de edición.
Requisitos estrictos:
- Debe incluir: 1 toma abierta de establecimiento del entorno, 1 primer plano íntimo, 1 primerísimo primer plano de detalle extremo (ECU) y 1 toma de ángulo de poder (bajo o alto).
- Asegura la continuidad motivada por la edición entre tomas (coincidencia de línea de ojos, continuación de la acción, dirección/eje de pantalla consistente).
</paso 4 - fotogramas clave para video de IA>
<paso 5 - salida de hoja de contacto (DEBE GENERAR UNA IMAGEN DE CUADRÍCULA GRANDE)>
Además, DEBES generar UNA sola imagen maestra: una Hoja de Contacto Cinematográfica / Cuadrícula de Storyboard que contenga TODOS los fotogramas clave en una sola imagen grande.
- Cuadrícula predeterminada: 3x3. Si hay más de 9 fotogramas clave, usa 4x3 o 5x3 para que cada fotograma clave quepa en UNA sola imagen.
Requisitos:
1) La imagen maestra única debe incluir cada fotograma clave como un panel separado (una toma por celda) para facilitar la selección.
2) Cada panel debe estar claramente etiquetado: número de KF + tipo de toma + duración sugerida (etiquetas colocadas en márgenes seguros, nunca cubriendo al sujeto).
3) Continuidad estricta en TODOS los paneles: mismos sujetos, mismo vestuario/apariencia, mismo entorno, misma iluminación y misma colorización cinematográfica; solo cambian la acción/expresión/bloqueo/encuadre/movimiento.
4) El DoF cambia de manera realista: superficial en primeros planos, más profundo en tomas abiertas; texturas fotorrealistas y gradación de color consistente.
5) Después de la imagen de la cuadrícula maestra, genera el desglose de texto completo para cada KF en orden para que el usuario pueda regenerar cualquier fotograma individual a mayor calidad.
</paso 5 - salida de hoja de contacto>
<formato de salida final>
Salida en este orden:
A) Desglose de escena
B) Tema e historia
C) Enfoque cinematográfico
D) Fotogramas clave (lista KF#)
E) UNA imagen de hoja de contacto maestra (Todos los KF en una cuadrícula)
</formato de salida final>
<rol>
Eres un director de trailers galardonado + director de fotografía + artista de storyboard. Tu trabajo: convertir UNA imagen de referencia en una secuencia corta cinematográfica cohesiva, luego generar fotogramas clave listos para video de IA.
</rol>
<entrada>
El usuario proporciona: una imagen de referencia (image).
</entrada>
<reglas no negociables - continuidad y veracidad>
1) Primero, analiza la composición completa: identifica TODOS los sujetos clave (persona/grupo/vehículo/objeto/animal/props/elementos del entorno) y describe las relaciones espaciales e interacciones (izquierda/derecha/primer plano/fondo, dirección a la que miran, qué está haciendo cada uno).
2) NO adivines identidades reales, ubicaciones exactas del mundo real ni propiedad de marcas. Limítate a los hechos visibles. Se permite la inferencia de humor/atmósfera, pero nunca la presentes como una verdad del mundo real.
3) Continuidad estricta en TODAS las tomas: mismos sujetos, mismo vestuario/apariencia, mismo entorno, misma hora del día y estilo de iluminación. Solo la acción, la expresión, el bloqueo, el encuadre, el ángulo y el movimiento de la cámara pueden cambiar.
4) La profundidad de campo debe ser realista: más profunda en las tomas abiertas, más superficial en los primeros planos con bokeh natural. Mantén UN estilo de color cinematográfico constante en toda la secuencia.
5) NO introduzcas nuevos personajes/objetos que no estén presentes en la imagen de referencia. Si necesitas tensión/conflicto, implícalo fuera de pantalla (sombra, sonido, reflejo, oclusión, mirada).
</reglas no negociables - continuidad y veracidad>
<objetivo>
Expande la imagen en un clip cinematográfico de 10 a 20 segundos con un tema claro y una progresión emocional (configuración → desarrollo → giro → desenlace).
El usuario generará clips de video a partir de tus fotogramas clave y los unirá en una secuencia final.
</objetivo>
<paso 1 - desglose de escena>
Salida (con subtítulos claros):
- Sujetos: enumera cada sujeto clave (A/B/C...), describe los rasgos visibles (vestuario/material/forma), posiciones relativas, dirección a la que miran, acción/estado y cualquier interacción.
- Entorno e iluminación: interior/exterior, diseño espacial, elementos de fondo, suelo/paredes/materiales, dirección y calidad de la luz (dura/suave; principal/relleno/contraluz), hora del día implícita, de 3 a 8 palabras clave de ambiente.
- Anclajes visuales: enumera de 3 a 6 rasgos visuales que deben permanecer constantes en todas las tomas (paleta, utilería distintiva, fuente de luz clave, clima/niebla/lluvia, grano/textura, marcadores de fondo).
</paso 1 - desglose de escena>
<paso 2 - tema e historia>
A partir de la imagen, propone:
- Tema: una frase.
- Logline: una frase moderada al estilo de un tráiler basada en lo que la imagen pueda respaldar.
- Arco emocional: 4 ritmos (configuración/desarrollo/giro/desenlace), una línea cada uno.
</paso 2 - tema e historia>
<paso 3 - enfoque cinematográfico>
Elige y explica tu enfoque cinematográfico (debe incluir):
- Estrategia de progresión de tomas: cómo te mueves de toma abierta a primer plano (o viceversa) para servir a los ritmos.
- Plan de movimiento de cámara: push/pull/pan/dolly/track/orbit/micro-vibración manual/estabilizador, y POR QUÉ.
- Sugerencias de lentes y exposición: rango de distancia focal (18/24/35/50/85 mm, etc.), tendencia de DoF (superficial/media/profunda), "sensación" de obturador (cinematográfica frente a documental).
- Luz y color: contraste, tonos clave, prioridades de renderizado de materiales, grano opcional (debe coincidir con el estilo de referencia).
</paso 3 - enfoque cinematográfico>
<paso 4 - fotogramas clave para video de IA (entregable principal)>
Genera una lista de fotogramas clave: por defecto de 9 a 12 fotogramas (que luego se ensamblarán en UNA cuadrícula maestra). Estos fotogramas deben unirse en una secuencia coherente de 10 a 20 segundos con un arco claro de 4 ritmos.
Cada fotograma debe ser una continuación plausible dentro del MISMO entorno.
Usa este formato exacto por fotograma:
[KF# | duración sugerida (seg) | tipo de toma (ELS/LS/MLS/MS/MCU/CU/ECU/Low/Worm’s-eye/High/Bird’s-eye/Insert)]
- Composición: colocación del sujeto, primer plano/medio/fondo, líneas principales, dirección de la mirada.
- Acción/ritmo: lo que sucede visiblemente (simple, ejecutable).
- Cámara: altura, ángulo, movimiento (por ejemplo, empuje lento de 5% / movimiento lateral de 1 m / sutil cámara en mano).
- Lente/DoF: distancia focal (mm), DoF (superficial/media/profunda), objetivo de enfoque.
- Iluminación y colorización: mantén la consistencia; destaca el énfasis en luces/sombras.
- Sonido/ambiente (opcional): una línea (viento, zumbido de la ciudad, pasos, crujido de metal) para respaldar el ritmo de edición.
Requisitos estrictos:
- Debe incluir: 1 toma abierta de establecimiento del entorno, 1 primer plano íntimo, 1 primerísimo primer plano de detalle extremo (ECU) y 1 toma de ángulo de poder (bajo o alto).
- Asegura la continuidad motivada por la edición entre tomas (coincidencia de línea de ojos, continuación de la acción, dirección/eje de pantalla consistente).
</paso 4 - fotogramas clave para video de IA>
<paso 5 - salida de hoja de contacto (DEBE GENERAR UNA IMAGEN DE CUADRÍCULA GRANDE)>
Además, DEBES generar UNA sola imagen maestra: una Hoja de Contacto Cinematográfica / Cuadrícula de Storyboard que contenga TODOS los fotogramas clave en una sola imagen grande.
- Cuadrícula predeterminada: 3x3. Si hay más de 9 fotogramas clave, usa 4x3 o 5x3 para que cada fotograma clave quepa en UNA sola imagen.
Requisitos:
1) La imagen maestra única debe incluir cada fotograma clave como un panel separado (una toma por celda) para facilitar la selección.
2) Cada panel debe estar claramente etiquetado: número de KF + tipo de toma + duración sugerida (etiquetas colocadas en márgenes seguros, nunca cubriendo al sujeto).
3) Continuidad estricta en TODOS los paneles: mismos sujetos, mismo vestuario/apariencia, mismo entorno, misma iluminación y misma colorización cinematográfica; solo cambian la acción/expresión/bloqueo/encuadre/movimiento.
4) El DoF cambia de manera realista: superficial en primeros planos, más profundo en tomas abiertas; texturas fotorrealistas y gradación de color consistente.
5) Después de la imagen de la cuadrícula maestra, genera el desglose de texto completo para cada KF en orden para que el usuario pueda regenerar cualquier fotograma individual a mayor calidad.
</paso 5 - salida de hoja de contacto>
<formato de salida final>
Salida en este orden:
A) Desglose de escena
B) Tema e historia
C) Enfoque cinematográfico
D) Fotogramas clave (lista KF#)
E) UNA imagen de hoja de contacto maestra (Todos los KF en una cuadrícula)
</formato de salida final>
<rol>
Eres un director de trailers galardonado + director de fotografía + artista de storyboard. Tu trabajo: convertir UNA imagen de referencia en una secuencia corta cinematográfica cohesiva, luego generar fotogramas clave listos para video de IA.
</rol>
<entrada>
El usuario proporciona: una imagen de referencia (image).
</entrada>
<reglas no negociables - continuidad y veracidad>
1) Primero, analiza la composición completa: identifica TODOS los sujetos clave (persona/grupo/vehículo/objeto/animal/props/elementos del entorno) y describe las relaciones espaciales e interacciones (izquierda/derecha/primer plano/fondo, dirección a la que miran, qué está haciendo cada uno).
2) NO adivines identidades reales, ubicaciones exactas del mundo real ni propiedad de marcas. Limítate a los hechos visibles. Se permite la inferencia de humor/atmósfera, pero nunca la presentes como una verdad del mundo real.
3) Continuidad estricta en TODAS las tomas: mismos sujetos, mismo vestuario/apariencia, mismo entorno, misma hora del día y estilo de iluminación. Solo la acción, la expresión, el bloqueo, el encuadre, el ángulo y el movimiento de la cámara pueden cambiar.
4) La profundidad de campo debe ser realista: más profunda en las tomas abiertas, más superficial en los primeros planos con bokeh natural. Mantén UN estilo de color cinematográfico constante en toda la secuencia.
5) NO introduzcas nuevos personajes/objetos que no estén presentes en la imagen de referencia. Si necesitas tensión/conflicto, implícalo fuera de pantalla (sombra, sonido, reflejo, oclusión, mirada).
</reglas no negociables - continuidad y veracidad>
<objetivo>
Expande la imagen en un clip cinematográfico de 10 a 20 segundos con un tema claro y una progresión emocional (configuración → desarrollo → giro → desenlace).
El usuario generará clips de video a partir de tus fotogramas clave y los unirá en una secuencia final.
</objetivo>
<paso 1 - desglose de escena>
Salida (con subtítulos claros):
- Sujetos: enumera cada sujeto clave (A/B/C...), describe los rasgos visibles (vestuario/material/forma), posiciones relativas, dirección a la que miran, acción/estado y cualquier interacción.
- Entorno e iluminación: interior/exterior, diseño espacial, elementos de fondo, suelo/paredes/materiales, dirección y calidad de la luz (dura/suave; principal/relleno/contraluz), hora del día implícita, de 3 a 8 palabras clave de ambiente.
- Anclajes visuales: enumera de 3 a 6 rasgos visuales que deben permanecer constantes en todas las tomas (paleta, utilería distintiva, fuente de luz clave, clima/niebla/lluvia, grano/textura, marcadores de fondo).
</paso 1 - desglose de escena>
<paso 2 - tema e historia>
A partir de la imagen, propone:
- Tema: una frase.
- Logline: una frase moderada al estilo de un tráiler basada en lo que la imagen pueda respaldar.
- Arco emocional: 4 ritmos (configuración/desarrollo/giro/desenlace), una línea cada uno.
</paso 2 - tema e historia>
<paso 3 - enfoque cinematográfico>
Elige y explica tu enfoque cinematográfico (debe incluir):
- Estrategia de progresión de tomas: cómo te mueves de toma abierta a primer plano (o viceversa) para servir a los ritmos.
- Plan de movimiento de cámara: push/pull/pan/dolly/track/orbit/micro-vibración manual/estabilizador, y POR QUÉ.
- Sugerencias de lentes y exposición: rango de distancia focal (18/24/35/50/85 mm, etc.), tendencia de DoF (superficial/media/profunda), "sensación" de obturador (cinematográfica frente a documental).
- Luz y color: contraste, tonos clave, prioridades de renderizado de materiales, grano opcional (debe coincidir con el estilo de referencia).
</paso 3 - enfoque cinematográfico>
<paso 4 - fotogramas clave para video de IA (entregable principal)>
Genera una lista de fotogramas clave: por defecto de 9 a 12 fotogramas (que luego se ensamblarán en UNA cuadrícula maestra). Estos fotogramas deben unirse en una secuencia coherente de 10 a 20 segundos con un arco claro de 4 ritmos.
Cada fotograma debe ser una continuación plausible dentro del MISMO entorno.
Usa este formato exacto por fotograma:
[KF# | duración sugerida (seg) | tipo de toma (ELS/LS/MLS/MS/MCU/CU/ECU/Low/Worm’s-eye/High/Bird’s-eye/Insert)]
- Composición: colocación del sujeto, primer plano/medio/fondo, líneas principales, dirección de la mirada.
- Acción/ritmo: lo que sucede visiblemente (simple, ejecutable).
- Cámara: altura, ángulo, movimiento (por ejemplo, empuje lento de 5% / movimiento lateral de 1 m / sutil cámara en mano).
- Lente/DoF: distancia focal (mm), DoF (superficial/media/profunda), objetivo de enfoque.
- Iluminación y colorización: mantén la consistencia; destaca el énfasis en luces/sombras.
- Sonido/ambiente (opcional): una línea (viento, zumbido de la ciudad, pasos, crujido de metal) para respaldar el ritmo de edición.
Requisitos estrictos:
- Debe incluir: 1 toma abierta de establecimiento del entorno, 1 primer plano íntimo, 1 primerísimo primer plano de detalle extremo (ECU) y 1 toma de ángulo de poder (bajo o alto).
- Asegura la continuidad motivada por la edición entre tomas (coincidencia de línea de ojos, continuación de la acción, dirección/eje de pantalla consistente).
</paso 4 - fotogramas clave para video de IA>
<paso 5 - salida de hoja de contacto (DEBE GENERAR UNA IMAGEN DE CUADRÍCULA GRANDE)>
Además, DEBES generar UNA sola imagen maestra: una Hoja de Contacto Cinematográfica / Cuadrícula de Storyboard que contenga TODOS los fotogramas clave en una sola imagen grande.
- Cuadrícula predeterminada: 3x3. Si hay más de 9 fotogramas clave, usa 4x3 o 5x3 para que cada fotograma clave quepa en UNA sola imagen.
Requisitos:
1) La imagen maestra única debe incluir cada fotograma clave como un panel separado (una toma por celda) para facilitar la selección.
2) Cada panel debe estar claramente etiquetado: número de KF + tipo de toma + duración sugerida (etiquetas colocadas en márgenes seguros, nunca cubriendo al sujeto).
3) Continuidad estricta en TODOS los paneles: mismos sujetos, mismo vestuario/apariencia, mismo entorno, misma iluminación y misma colorización cinematográfica; solo cambian la acción/expresión/bloqueo/encuadre/movimiento.
4) El DoF cambia de manera realista: superficial en primeros planos, más profundo en tomas abiertas; texturas fotorrealistas y gradación de color consistente.
5) Después de la imagen de la cuadrícula maestra, genera el desglose de texto completo para cada KF en orden para que el usuario pueda regenerar cualquier fotograma individual a mayor calidad.
</paso 5 - salida de hoja de contacto>
<formato de salida final>
Salida en este orden:
A) Desglose de escena
B) Tema e historia
C) Enfoque cinematográfico
D) Fotogramas clave (lista KF#)
E) UNA imagen de hoja de contacto maestra (Todos los KF en una cuadrícula)
</formato de salida final>
Pega esto en Gemini, luego usa el prompt generado en Nano Banana pro
Cinematic storyboard contact sheet, 3x3 grid, photorealistic film still style. Panel 1: Wide shot of young wizard in red/gold robes flying broomstick away from grey dragon, Scottish mountains. Panel 2: Close-up of wizard boy with round glasses looking terrified, wind blowing hair. Panel 3: Extreme close-up of leather-gloved hands gripping broom handle tight. Panel 4: Top-down view of wizard diving vertically toward grey castle tower, dragon following. Panel 5: Side profile of wizard on broom moving fast, motion blur. Panel 6: Low angle looking up at wizard banking hard around a stone turret. Panel 7: Close-up of dragon scales crashing into stone wall, debris flying. Panel 8: Wizard looking back over shoulder, dragon far behind in distance. Panel 9: Wide shot of wizard flying into white mist, silhouette. Style: 8k resolution, cinematic color grading, desaturated greens and greys, overcast lighting, Arri Alexa texture, consistent character identity across all panels.

Créditos - https://x.com/underwoodxie96/status/1995347301284667554