
De vídeo de YouTube a prompts plano por plano
Aprende a desglosar un vídeo en planos, describir movimientos de cámara y redactar prompts de IA coherentes con un ejemplo de tres planos.
La cámara se acerca a la taza, o una mano acerca la taza a la cámara. Parece un detalle pequeño hasta que escribes el prompt y obtienes otro movimiento. Al trabajar con una referencia de YouTube, empieza por un fragmento corto y anota qué ocurre en cada plano. Los adjetivos pueden esperar.
Puedes empezar con vídeo a prompt de NanoPhoto.AI, mediante YouTube o un archivo local. El análisis describe imágenes visibles: no recupera el prompt original, la semilla ni parámetros de cámara desconocidos.

Prepara una referencia manejable
Utiliza material propio o autorizado. Elige un fragmento con un sujeto claro, unos pocos cortes y al menos un movimiento de cámara. Anota duración, relación de aspecto y uso previsto. Comprueba los límites actuales del formulario antes de subirlo; una página web no equivale a un archivo de vídeo.
Crea primero una lista de planos
Un plano mantiene una perspectiva continua entre cortes; una escena puede contener varios planos. Revisa especialmente insertos breves y fundidos. Los tiempos de la IA necesitan comprobación en la línea de tiempo.
| Campo | Qué anotar |
|---|---|
| Tiempo | Inicio y final comprobados |
| Sujeto | Aspecto, ropa y objetos que deben mantenerse |
| Acción | Un movimiento principal y su dirección |
| Encuadre | Plano general, medio o detalle |
| Cámara | Fija, desplazamiento lateral o acercamiento |
| Ambiente | Luz, fondo y paleta visibles |
No confundas el movimiento del sujeto con el de la cámara. Si no puedes confirmar una focal, describe el resultado visual en lugar de inventar milímetros.
Ejemplo: un anuncio de café de 12 segundos
Este ejemplo es ficticio y sirve como plantilla; no es una salida medida del producto.
| Tiempo | Plano | Instrucción principal |
|---|---|---|
| 0–4 s | General | Mesa de madera junto a una ventana, cámara fija |
| 4–8 s | Detalle | Una mano vierte café en una taza, acercamiento lento |
| 8–12 s | Medio | La misma taza humeante, desplazamiento lateral suave |
Plano detalle de una taza de cerámica crema sobre una mesa de madera.
Una mano vierte café desde la izquierda. La cámara se acerca lentamente.
Luz cálida de ventana desde la derecha, fondo de cocina desenfocado.
Mantener la misma taza, mesa y dirección de la luz. Sin texto añadido.
Conserva la continuidad y revisa
Repite los rasgos estables de la taza, la ropa, el entorno y la iluminación en cada prompt. Ajusta el movimiento y el encuadre por separado. Evita mezclar varias acciones incompatibles en una sola instrucción; la duración final depende del generador y de sus ajustes.
Primero corrige cortes omitidos, acciones inventadas y cambios de identidad. Después adapta el texto al generador. Si necesitas detección reproducible de cortes, PySceneDetect ofrece herramientas específicas, pero la detección no sustituye la descripción visual.
Dudas frecuentes
¿Se puede recrear exactamente el vídeo?
No se puede garantizar. Una descripción no contiene todos los datos de la grabación o generación original. Úsala para estudiar estructura y crear tu propia versión.
¿La transcripción basta?
Recoge el habla, pero no describe por sí sola el encuadre, el montaje o los movimientos silenciosos. Consulta la comparación entre análisis automático y desglose manual.
NanoPhoto.AI publica la herramienta citada. Capturamos la interfaz pública el 10 de septiembre de 2026. El texto y la portada se elaboraron con ayuda de IA; los ejemplos didácticos y las demostraciones existentes están identificados.
Más artículos

Vídeo a prompt o desglose manual: qué elegir
Compara transcripción, detección de cortes, desglose manual y vídeo a prompt con una prueba que mide correcciones, tiempo y coste.


H3 Max Turbo vs MiniMax H3: velocidad, calidad, resolución y cuál elegir
Comparamos H3 Max Turbo y MiniMax H3 por velocidad, resolución 480P/768P/2K, duración, referencias, edición de vídeo y casos de uso.


Quitar subtítulos incrustados sin recortar el vídeo
Distingue los subtítulos fijos de las pistas desactivables y comprueba bordes, textura, parpadeo, encuadre y audio después de eliminarlos.

Newsletter
Join the community
Subscribe to our newsletter for the latest news and updates