Blog · Video con IA

Cómo escribir prompts para Veo y Nano Banana

La diferencia entre un video con IA que se ve profesional y uno que se ve genérico casi nunca está en la herramienta: está en el prompt. Escribo prompts para Veo y Nano Banana todos los días y la mayoría de los resultados flojos vienen del mismo problema: pedir de más y describir de menos. Acá te dejo la estructura que uso.

Primero la imagen, después el movimiento

Nano Banana genera la imagen fija que después animás en Veo. Si esa base no está sólida, ningún prompt de movimiento la va a salvar. Por eso escribo el prompt de imagen pensando en tres cosas: sujeto, ambiente y luz. Nada más. Cuantos más adjetivos sueltos meto, más se diluye el resultado.

Un prompt de Nano Banana que funciona bien suena así: "producto de skincare sobre mármol blanco, luz natural suave desde la izquierda, fondo desenfocado con plantas verdes, estilo editorial minimalista". Es concreto, tiene un orden y no compite consigo mismo.

La estructura que uso para prompts de imagen

  • Sujeto: qué o quién está en cuadro, con el detalle justo (material, color, tamaño relativo).
  • Ambiente: dónde pasa la escena y qué hay alrededor.
  • Luz: natural, dorada, dura, suave, de estudio. Esto cambia todo el clima de la imagen.
  • Estilo: editorial, cinematográfico, documental, publicitario. Una sola palabra alcanza.

Cómo escribir el prompt de movimiento en Veo

Acá cambia el juego: ya no describís qué se ve, describís qué pasa. Veo responde mejor a instrucciones de cámara claras que a descripciones poéticas. En vez de "un video elegante y dinámico", funciona mejor "cámara se acerca lentamente al producto, leve movimiento hacia la derecha, sin cortes".

Palabras que le dan control a la cámara

Términos como dolly in, paneo lateral, toma cenital o cámara en mano le dan a Veo una referencia concreta de movimiento. Si no especificás nada, el modelo elige por vos, y ahí es cuando el resultado se siente aleatorio.

Un prompt de video no describe una foto en movimiento: describe una decisión de cámara. Esa es la diferencia entre pedir y dirigir.

Errores que veo repetirse

Pedir demasiadas acciones a la vez

Si el prompt tiene tres o cuatro acciones distintas ("el producto gira, la luz cambia, aparece texto y la cámara se aleja"), el modelo prioriza mal y el resultado queda confuso. Un movimiento principal por clip da resultados mucho más limpios.

No fijar la estética antes de animar

Animar una imagen que todavía no te convence es perder tiempo. Iterás la imagen en Nano Banana hasta que esté lockeada, y recién ahí pasás a Veo.

Ignorar la duración del clip

Un movimiento de cámara ambicioso necesita más segundos para que se vea natural. Pedir un dolly in largo en un clip corto suele salir brusco.

Un ejemplo de flujo completo

Para una marca de indumentaria armé la imagen base en Nano Banana con "modelo de perfil con campera oversize, fondo urbano nocturno, luz de neón azul y rosa, estilo cinematográfico". Una vez que la estética quedó aprobada, en Veo pedí "paneo lateral lento de izquierda a derecha, la modelo camina hacia cámara, luces de fondo desenfocadas". Dos prompts, cada uno con un solo trabajo.

Si querés ver qué herramientas conviene sumar después de Veo y Nano Banana para terminar el video, te dejo esta guía de herramientas de edición con IA, y si preferís que arme el video completo por vos, mirá mi trabajo con video con IA.

¿Querés el video listo sin pelearte con los prompts?

Yo me encargo de todo el proceso, desde la imagen base hasta el video final.

Escribime →