Un prompt complejo para crear una película de 20 segundos en formato 4:3 con objetos de pixel art, siluetas estilo cámara térmica y subtítulos sincronizados usando Opus 5.5, incluyendo dirección detallada y estructura.
Instrucción
<inputs>
Pídeme: una voz en off o canción con una línea hablada (el archivo de audio) y su transcripción, 10-12 objetos pequeños que resuman mi vida, dos siluetas iluminadas como una cámara térmica (una cabeza de perfil y una mano levantada), y las 3 palabras que quiero que impacten más fuerte. Si omito alguna, usa los valores predeterminados: vinilo, libro, cámara, gato, moneda, control de videojuego, gorra, corazón, dinero, planta, claqueta, skateboard; siluetas CC0 gratuitas de Openverse; acción, intención, curiosidad.
</inputs>
<direction>
Una película de 20 segundos en formato 4:3, 1440x1080 a 60fps, editada al ritmo de la voz. Papel blanco roto, negro, un rojo, un amarillo, Geist para cada palabra. Grano de película en todo, una viñeta suave y una cámara que nunca descansa: un flotante lento de cámara en mano bajo todo más un empuje lento dentro de cada escena.
Sin cortes de escena a la siguiente: cada transición comienza exactamente en el último fotograma de la escena anterior. Los únicos cortes secos son los cambios de ritmo en la última palabra.
Cada objeto es pixel art que tú dibujas: una cuadrícula de 16x16 por objeto, cada celda un color colocado a mano, renderizado como un bloque 3D (una extrusión más oscura hacia abajo-derecha, un bisel fino en cada celda) con una sombra de contacto suave.
Las siluetas están iluminadas como una cámara térmica: el calor proviene del grosor del cuerpo en cada punto, por lo que la nariz, el cabello y las puntas de los dedos son más fríos, más un punto caliente y un ruido que se mueve lentamente, mapeado a través de una rampa negro > rojo > naranja > crema. El borde permanece afilado como una navaja, con un resplandor suave fuera de él.
Reglas de movimiento: nada aparece de golpe (deslizamientos suaves de aproximadamente 0.5s con un inicio suave), los movimientos rápidos obtienen desenfoque de movimiento real en lugar de copias fantasma, y los subtítulos se escriben con la voz detrás de un cursor de bloque.
Prohibido: metraje de stock, video AI, movimientos de cámara 3D, partículas, glitch.
</direction>
<structure>
Coloca cada escena según los tiempos de las palabras de la transcripción (mídelos con timestamps de palabras de faster-whisper, un fragmento corto a la vez):
1. La primera palabra llena una tarjeta amarilla. La tarjeta se borra hacia la izquierda y la pregunta se escribe debajo en dos líneas centradas que se deslizan para mantenerse centradas mientras crecen, la palabra clave subrayada en rojo mientras se pronuncia.
2. Los objetos pasan velozmente en carriles encima y debajo de las palabras, un destello de cuatro puntos cian barre hacia adentro, luego la página se quema: el negro cierra desde los bordes hacia la cabeza, detrás de un borde rojo caliente.
3. La cabeza se calienta sobre negro mientras la respuesta se escribe baja a la izquierda. Una órbita blanca fina se dibuja alrededor de la cabeza, su mitad lejana pasa detrás de ella. En la última palabra, el papel florece desde dentro de la cabeza con los objetos dentro, y la cámara cae a través: la cabeza pasa velozmente frente al lente hasta que el papel es todo lo que vemos.
4. Los objetos se sientan sobre un anillo inclinado visto en perspectiva (los frontales más grandes y bajos, dibujados al final), girando lentamente, cada uno rebotando; la moneda gira y aterriza con chispas.
5. En cada una de las 3 palabras, ese objeto vuela fuera del anillo hacia la izquierda y crece, la página se inunda de negro desde él, y la palabra se escribe a su lado (cámara: una estrella de obturador roja; libro: un barrido de cinta roja; disco: dos órbitas blancas y notas rojas). Luego la inundación drena de vuelta al objeto mientras vuela a casa, y la cámara se sumerge más cerca en el anillo. Pon cada objeto héroe en la ranura que está al frente-izquierda cuando su palabra aterriza.
6. El anillo se contrae un poco, estalla hacia afuera, cada objeto se convierte en tinta, y las manchas de tinta crecen y se tragan la página.
7. La mano sube al encuadre, caliente, con la línea dividida a ambos lados de ella. El corazón cae en su palma, luego se eleva al centro al tamaño que la siguiente escena sostiene.
8. La última palabra, una letra por beat, el fondo alternando papel / negro / rojo, el corazón manteniendo su lugar a través del corte, el objeto central transformándose píxel por píxel en el siguiente.
9. Pinceladas finas barren a través, las letras se separan y flotan, luego se asientan de vuelta en la palabra con el corazón encima. La cámara sigue empujando a través de la pausa.
</structure>
<build>
1. Un lienzo HTML. Cada fotograma es una función pura del tiempo dentro de seek(t).
2. Hornea cada sprite de píxeles una vez en un lienzo fuera de pantalla (las capas de extrusión, luego la cara), luego dibújalo escalado y rotado.
3. El calor: precalcula el calor base de cada silueta una vez (una transformación de distancia de la máscara, mantenida en el valor del borde fuera de ella para que nada oscuro se filtre cuando se amplía). Cada fotograma, agrega el punto caliente y dos octavas de ruido de valor a resolución de cuarto, mapéalo a través de una búsqueda de 256 pasos, amplíalo y córtalo con la máscara de resolución completa.
4. La caída a través de la cabeza: dibuja la escena del anillo en una capa fuera de pantalla, enmascárala con la cabeza escalada alrededor de un punto dentro del cráneo, y aumenta esa escala en una curva cúbica hasta que la cabeza cubra el cuadro. El anillo dentro hace zoom menos que la cabeza, por lo que se lee como profundidad.
5. La transformación de píxeles: empareja cada celda del objeto A con una celda del objeto B y desliza la posición y el color de cada una, con un pequeño retraso aleatorio por celda.
6. Renderiza con Playwright a 60fps con 8 subfotogramas de desenfoque de movimiento, luego coloca el audio original de nuevo con ffmpeg.
</build>
<gotchas>
Una máscara PNG sin canal alfa llena toda la caja con calor, así que pon la silueta en el alfa. Una extremidad cortada por el borde de la foto se muestra como un borde recto, así que extiende la máscara más allá del cuadro. Una transición solo se lee como suave cuando el último fotograma de una escena es el primer fotograma de la siguiente: dibuja la escena saliente bajo la transición, y da a las escenas que muestran el mismo anillo una función de zoom compartida. Una inundación que aún se retira cuando comienza la siguiente escena se lee como un corte seco, así que deja que termine primero. Una inundación de salida rápida se lee como un salto; usa un inicio suave.
</gotchas>
<start>
Pídeme los inputs, mide los tiempos de las palabras, luego muéstrame 8 fotogramas fijos antes de renderizar.
</start>
Cómo usar este prompt
1
Copia el prompt completo de arriba.
2
Abre una plataforma compatible con Claude Opus 5.5, como YouMind, y pega el prompt.
3
Cambia el tema, el estilo o los detalles según tu idea y luego genera.
Este es un prompt de IA gratuito de la biblioteca de prompts de YouMind. Explora miles de prompts de vídeo más, todos gratis para copiar y adaptar.
Que la IA busque entre decenas de miles de prompts. Filtrá por modelo, rango de fechas y palabras clave, y ordená por interacción: vistas, guardados, reposts y más.
Convierte cualquier foto en un prompt de imagen IA detallado. El conversor gratuito de imagen a prompt analiza composición, estilo e iluminación para recrear cualquier estética en segundos.