Cómo crear videos exactamente como los imaginas: La forma profesional de usar Seedance 2.5

@casthirotaka
JAPONÉS15 ago 2026
159K
165
24
2
600

TL;DR

Esta guía explica cómo dominar Seedance 2.5 tratando los prompts como instrucciones de dirección en lugar de descripciones, utilizando referencias de video para manejar movimientos complejos y la consistencia de los personajes.

Quienes ahora mismo están poniéndose a prueba con Seedance 2.5 probablemente están buscando la plantilla del "prompt perfecto" y probando todas las ideas que se les ocurren.

Sin embargo...

El alcance de responsabilidad de un prompt es más reducido de lo que crees

Seedance 2.5 acepta 30 imágenes, 10 videos y 10 archivos de audio como referencias en una sola generación (anunciado oficialmente por ByteDance, el 31 de julio de 2026).

Esta especificación implica que los prompts no pretenden explicarlo todo.

吉田洋孝|Cast Japan代表 - inline image

Qué decidir

Idoneidad del prompt

Dónde reside la respuesta "correcta"

Propósito del video, visión del mundo, atmósfera

Alta

Prompt

Tipo de ubicación, qué sucede

Alta

Prompt

Qué conservar, qué cambiar

Muy alta

Prompt

Prioridades

Muy alta

Prompt

Dirección de iluminación, sensación del lente

Media

Prompt / Imagen

Rostro de la persona, identidad

Baja

Imagen

Forma precisa del producto

Baja

Imagen

Movimientos corporales complejos

Baja

Video

Contacto humano, posicionamiento, mirada

Baja

Video

Trayectoria precisa de cámara

Baja

Video / Modelo blanco

Sincronización cuadro a cuadro

Baja

Video / Edición

Solo hay un criterio para juzgar: ¿Quién tiene la información más precisa?

La fuente más precisa para el movimiento es el video del movimiento en sí, no una descripción textual del mismo.

5 cosas que no deberías escribir en un prompt

1. Descripciones atmosféricas cargadas de adjetivos

吉田洋孝|Cast Japan代表 - inline image

La guía oficial dice: "Intenta no acumular adjetivos". Luego añade: "Ser específico con el movimiento y la elección del lente suele funcionar mejor".

2. "Nombres" de movimientos

Los nombres conceptuales como playful cheeky mini-dance producen un rango de resultados tan amplio como su rango de interpretación.

En realidad, esa instrucción devolvió un video de alguien bailando frente a otras personas: "acercarse a la pareja -> poner las manos hacia adelante -> mirar a la pareja". El objetivo era "caminar solo mientras hace el tonto, con un movimiento rápido y un poco desordenado", que ni siquiera es un baile.

3. Descomponer en texto los movimientos de las partes del cuerpo

吉田洋孝|Cast Japan代表 - inline image

Incluso al reescribir descomponiendo cómo se balancean los brazos, cómo se mueven los hombros y cómo reacciona la cámara en sincronía con cada parte, el resultado no cambió. La guía oficial dice que las referencias de movimiento son "más útiles que un párrafo largo y vago".

Aunque la descompongas y la alargues, no alcanzará la densidad de información de una sola referencia.

4. Información que el material de referencia ya tiene

吉田洋孝|Cast Japan代表 - inline image

Los ejemplos oficiales de prompts especifican qué información tomar de cada referencia.

" Del @Clay Render 1, toma como referencia el movimiento de cámara, el ritmo, las transiciones de tamaño de plano, la trayectoria del sujeto y el posicionamiento.

De @Image 2, toma como referencia el diseño del personaje, la escena, los materiales, la iluminación, el color y la atmósfera."

Si en el texto escribes información que la referencia ya posee, la referencia y el texto empezarán a decir cosas distintas, lo que lleva a un desajuste.

5. Instrucciones contradictorias entre sí

Los párrafos densos hacen que las instrucciones choquen entre sí. En el momento en que se cuela una instrucción imposible, la IA decide por su cuenta cuál descartar.

5 cosas que sí deberías escribir en un prompt

1. El rol de cada archivo de referencia

吉田洋孝|Cast Japan代表 - inline image

La instrucción de la guía oficial es "menciona los roles de las referencias con claridad". Entre los roles enumerados se incluyen: identidad del producto, consistencia del personaje, movimiento mediante modelos blancos, actuación en pantalla verde, audio, estilo y correcciones parciales. Los roles no se determinan solo por adjuntar archivos.

2. Qué NO usar de esa referencia

Al asignar roles, indica con claridad la información que no quieres que tome. Esta redacción funcionó de verdad:

No copies la ubicación, la ropa, el texto, las personas ni la historia de @Video1. Copia solo el ritmo corporal, los gestos de los brazos, el ritmo al caminar y el movimiento de cámara ligado al cuerpo.

Sepáralo: "Imita solo el movimiento; no imites la ubicación, la ropa ni las personas".

3. Enumeración de los elementos innegociables

吉田洋孝|Cast Japan代表 - inline image

La guía oficial de referencia de movimiento indica construir el prompt así: "Empieza nombrando las referencias subidas y luego enumera los detalles innegociables".

  • identidad
  • forma
  • escala
  • plano de planta
  • diseño del producto
  • pose
  • tiempos
  • voz
  • orden de tomas

4. Qué conservar y qué cambiar

Escribe por separado qué conservar (actuación, tiempos, mirada, posicionamiento, movimiento de cámara) y qué cambiar (persona, entorno, vestuario). Sin esa distinción, la IA tiene libertad para rehacerlo todo.

5. Prioridades

Especifica qué proteger primero en situaciones donde no se puede seguir todo a la vez. En un prompt real, se escribió así:

PRIORIDAD: 1. Iguala el ritmo corporal y el movimiento de brazos de @Video1. 2. Iguala el movimiento de cámara ligado al cuerpo de @Video1. 3. Conserva la perspectiva POV y el entorno de @Image1. 4. Mantén el movimiento juguetón y casual, no coreografiado.

Primero decide la "respuesta correcta"

Divide el video deseado en elementos y decide qué "material tiene la respuesta correcta" para cada elemento.

Elemento

Dónde reside la respuesta correcta

Motivo

Rostro / identidad de la persona

Imagen

El texto no puede mantener la identidad

Movimiento corporal, posicionamiento, mirada, tiempos

Video

Declarado oficialmente como objetivo de control de la referencia de video

Estructura espacial, trayectoria de cámara

Modelo blanco (3D sin textura)

Oficial: "Efectivo cuando el espacio, la trayectoria de la cámara y la posición relativa son más importantes que la textura final"

Acciones humanas, demostración de producto

Material de pantalla verde

Declarado oficialmente como caso de uso

Visión del mundo, ubicación, significado, prioridad

Prompt

El área donde el texto es más fuerte

Forma de los muebles, objetos pequeños, detalles de fondo

Dejar a la IA

No hay necesidad de fijarlos

吉田洋孝|Cast Japan代表 - inline image
吉田洋孝|Cast Japan代表 - inline image

Además, divide la fuerza de exigencia de cada elemento en tres niveles:

  • Fijo: No permitir que se rehaga arbitrariamente (persona, forma del producto, material de movimiento original).
  • Guiado: Dar dirección pero permitir interpretación (departamento de lujo, noche, iluminación cálida, ambiente divertido).
  • Automático: Dejarlo a la IA (forma del sofá, objetos del estante, detalles en la pared).

Si fijas todo, el video se vuelve poco natural; si lo dejas todo en automático, se desvía del objetivo. Diseñar dónde fijar y dónde soltar es el trabajo del prompt.

3 formas de crear. Graba primero los movimientos difíciles

Método

Situaciones adecuadas

Dejar que la IA cree todo

Mundos inexistentes, movimientos simples, visión de mundo marcada

Proporcionar muestras para crear

El rostro/la forma del producto están fijados, se quiere continuar con la composición

Grabar primero y luego cambiar

Movimientos complejos, contacto humano, varias personas interactuando

La razón por la que el tercer método es importante es que ByteDance mismo enumera "estabilidad de escenas donde interactúan varios sujetos" como un área de mejora en Seedance 2.5. Es una batalla perdida intentar forzar a través del texto un área que el desarrollador admite que es difícil.

吉田洋孝|Cast Japan代表 - inline image

El método de "grabar primero" funciona porque cambia el trabajo de la IA de "inventar la actuación" a "cambiar la apariencia de una actuación que ya está establecida". El posicionamiento, los tiempos, la mirada y el contacto los aporta el material grabado por personas, mientras que la IA solo se encarga de la identidad y el entorno.

En X se compartió un caso donde un único material con tres personas distintas se convirtió en la misma persona para las tres. (El autor explicó que usó Seedance 2.0 y que no se usaron composiciones ni máscaras. Al ser una publicación de terceros, los detalles del proceso de producción no han sido verificados.)

También hay casos claros en los que no es adecuado.

Cuando se genera todo sin material de origen, el contacto es demasiado complejo, los rostros quedan completamente ocultos, no está claro quién está dónde, o el posicionamiento ya viene roto desde la etapa del material de origen.

Si estas cinco condiciones se cumplen, grabar primero no lo va a resolver.

La plantilla de prompt que muestra la guía oficial

El orden básico es:

Sujeto (Quién/Qué) -> Acción (Qué hace) -> Cámara (Cómo grabar) -> Estilo (Qué textura)

Para una toma única de 30 segundos, la guía oficial incluso muestra la distribución del tiempo:

  • 00–06s: Muestra la situación con un plano general
  • 06–14s: Entra al movimiento principal con un primer plano
  • 14–24s: Desarrolla moviendo la cámara o añadiendo insertos
  • 24–30s: Converge

Plantilla para completar y usar cuando uses referencias👇

text
1REFERENCIAS:
2@Image1 = [Rol]. Usa solo [Información a usar] de aquí. No uses [Información que no se debe usar].
3@Video1 = [Rol]. Usa solo [Información a usar] de aquí. No uses [Información que no se debe usar].
4
5ACCIÓN:
6[Quién] [Dónde] [Hace qué].
7[Calidad del movimiento. Escribe si es rápido o lento, desordenado o cuidadoso, y hacia quién está dirigido, en lugar de "un movimiento llamado X"]
8
9CÁMARA:
10[Tipo de punto de vista / Ángulo de visión del lente].
11[Con qué se mueve la cámara en sincronía].
12[Comportamientos de cámara que no deben hacerse].
13
14ACTUACIÓN:
15[Temperatura de la actuación. ¿Se muestra a alguien o se hace en solitario?]
16
17ENTORNO:
18[Ubicación, momento, carácter de la luz. No especifiques detalles]
19
20CONSERVAR / CAMBIAR:
21Conservar = [Actuación / Tiempos / Mirada / Posicionamiento / Movimiento de cámara]
22Cambiar = [Persona / Entorno / Vestuario]
23
24PRIORIDAD:
251. [Lo que hay que proteger con mayor prioridad]
262. [Lo que hay que proteger después]
273. [Siguiente]

Esta plantilla es efectiva no porque reduzca la cantidad de escritura.

Es porque la función del texto cambia de "describir el video" a "dirigir la división de roles de los materiales".

El video tiene la respuesta correcta para el movimiento, la imagen la tiene para el rostro y el modelo blanco la tiene para el espacio. El prompt decide cómo se organizan.

Gracias por leer hasta el final.

En X ([@casthirotaka](https://x.com/@casthirotaka)), comparto historias que son útiles para este tipo de trabajo práctico todos los días.

Me alegraría que me siguieras.

Recrear en YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales