Un prompt sofisticado para una escena cinematográfica de 10 segundos centrada en microexpresiones y comedia inexpresiva entre dos personajes Wuxia, utilizando un sistema ambiental de 'mundo vivo' de múltiples capas.
Textura cinematográfica fotorrealista, estética pura de Xianxia chino antiguo, actuación de comedia inexpresiva y contenida, cinematografía observacional, microexpresiones realistas, peso corporal, material de seda, grano de película fino, profundidad de aire volumétrica, desplazamiento de cámara 3D real y un mundo de referencia que vive continuamente desde el primer hasta el último fotograma. Protocolo de control: tres pistas deben ejecutarse simultáneamente, pero nunca deben competir por la autoridad narrativa. La pista de la trama del protagonista tiene el 100% del poder de guion. La pista de vida del entorno tiene derechos de movimiento continuo pero 0% de poder de guion. La pista de personajes de fondo tiene derechos de vida independiente pero 0% de derechos de interacción con el protagonista. El entorno no debe crear, activar, explicar, interrumpir, resolver, cambiar, enfatizar ni cronometrar ninguna trama de los personajes. El viento, las nubes, la niebla, la luz, los reflejos, la arquitectura, los personajes distantes, la vegetación y los cuerpos de agua no deben producir reacciones especiales debido a diálogos, contacto visual, gags cómicos o acciones del protagonista. El motivo del movimiento de cámara está determinado únicamente por la trama del protagonista y la programación de los personajes. Pero mientras tanto: todas las áreas que no sean del protagonista nunca deben estar congeladas. Entienda todas las imágenes de referencia como el ADN del mundo, no como píxeles congelados o fondos estáticos. Antes de la generación, comprenda la lógica geomorfológica, la arquitectura, la escala, los materiales, el clima, los sistemas de nubes, la vegetación, los reflejos, las líneas de movimiento, las direcciones de la luz y las extensiones espaciales para reconstruir una ubicación 3D real. Mantenga la identidad pero permita la reorganización espacial. A lo largo de los 10 segundos, cada ventana de 2 segundos necesita fuentes de movimiento visibles que no sean del protagonista a través de las capas. Los movimientos no pueden comenzar simultáneamente ni moverse a velocidades idénticas. Fondo extremo: enormes capas de nubes migrando lenta y constantemente. Plano medio profundo: 4-6 extras pequeños e independientes (caminando, usando escaleras, arreglándose la ropa, cruzándose) sin conexión ni reacción a los protagonistas. Capa de aire de plano medio: niebla y nubes bajas pasando por alto estructuras con oclusión realista y lógica espacial. Capa de primer plano: elementos consistentes (niebla, plantas, pancartas) pasando brevemente cerca de la lente para establecer presencia espacial. Las superficies reflectantes cambian con los ángulos de cámara. Todo el movimiento comparte un sistema meteorológico unificado. Personaje A: Hermana mayor, 25-30 años, mujer de Asia oriental, rostro ovalado, ojos almendrados oscuros, cabello negro largo con horquilla de jade blanco, alta/delgada, Hanfu de seda bordado en blanco. Personaje B: Hermana menor, 20-25 años, mujer de Asia oriental, rostro redondo/ágil, cabello negro trenzado, pequeña, Hanfu de lino cian. Trama 0-5s: La cámara hace un travelling hacia adelante/lateral. Los protagonistas caminan. La hermana mayor dice seriamente: 'Hoy practicaremos la concentración. Quien se ría primero, pierde'. La hermana menor detiene toda expresión. Se enfrentan. La trama está activa, el fondo es independiente. Trama 5-10s: Cara a cara. La hermana menor infla una mejilla ligeramente durante 0.5s. La hermana mayor levanta una ceja ligeramente. Los labios de la hermana mayor tiemblan imperceptiblemente. La cámara gira 15-20 grados con paralaje real. La comedia proviene de las microexpresiones. Estado final: 9.5-10s, personajes estables pero el mundo continúa moviéndose (nubes, extras caminando) para servir como puente para la Parte 2. 16:9, diálogo en mandarín, banda sonora contenida, foley realista. Negativo (Parte 1): borroso, mala calidad, etc. Parte 2: Generado como un video extendido que hereda personajes idénticos, estado del mundo, fases de movimiento y risas reprimidas del final de la Parte 1. Trama 10-15s: La hermana menor imita la expresión fría de la hermana mayor. Las fosas nasales de la hermana mayor se ensanchan ligeramente. Ambas intentan no reaccionar ante el rostro de la otra. 14.5s: Ambas rompen el personaje con una risa corta y real. El entorno permanece independiente y no reactivo a la risa. Conclusión 15-20s: Riendo brevemente, luego recuperando la seriedad. '¿Empate?' 'Otra vez'. Se dan la vuelta y siguen caminando. Intercambian una mirada final con un toque de sonrisa. La cámara sigue con un seguimiento lateral. Últimos 0.5s: Caminan hacia adelante mientras el mundo de fondo permanece completamente vivo y en movimiento. Negativo (Parte 2): borroso, mala calidad, reinicio de fondo, extras congelados, reacciones ambientales sincronizadas, etc.