Come creare video esattamente come li immagini: il metodo professionale per utilizzare Seedance 2.5

@casthirotaka
GIAPPONESE15 ago 2026
159K
165
24
2
600

TL;DR

Questa guida spiega come padroneggiare Seedance 2.5 trattando i prompt come istruzioni registiche anziché come semplici descrizioni, utilizzando riferimenti video per gestire movimenti complessi e coerenza dei personaggi.

Those che attualmente si cimentano con Seedance 2.5 stanno probabilmente cercando il modello di "prompt perfetto" e testando ogni idea che gli viene in mente.

Tuttavia...

L'ambito di responsabilità di un prompt è più limitato di quanto pensi

Seedance 2.5 accetta 30 immagini, 10 video e 10 file audio come riferimenti in una singola generazione (annunciato ufficialmente da ByteDance, 31 luglio 2026).

Questa specifica implica che i prompt non sono pensati per spiegare tutto.

吉田洋孝|Cast Japan代表 - inline image

Cosa decidere

Idoneità al prompt

Dove si trova la risposta "corretta"

Scopo del video, visione del mondo, atmosfera

Alta

Prompt

Tipo di luogo, cosa accade

Alta

Prompt

Cosa mantenere, cosa cambiare

Molto alta

Prompt

Priorità

Molto alta

Prompt

Direzione dell'illuminazione, resa dell'obiettivo

Media

Prompt / Immagine

Volto della persona, identità

Bassa

Immagine

Forma precisa del prodotto

Bassa

Immagine

Movimenti corporei complessi

Bassa

Video

Contatto umano, posizionamento, sguardo

Bassa

Video

Traiettoria precisa della camera

Bassa

Video / Modello bianco

Tempi fotogramma per fotogramma

Bassa

Video / Montaggio

C'è un solo criterio di giudizio: Chi possiede le informazioni più accurate?

La fonte più accurata per il movimento è il video del movimento stesso, non una descrizione testuale dello stesso.

5 cose che non dovresti scrivere in un prompt

1. Descrizioni d'atmosfera con accumulo di aggettivi

吉田洋孝|Cast Japan代表 - inline image

La guida ufficiale afferma: «Cerca di non accumulare aggettivi». E continua: «Essere specifici su movimento e scelta dell'obiettivo di solito funziona meglio».

2. "Nomi" dei movimenti

Nomi concettuali come playful cheeky mini-dance producono una gamma di output ampia quanto la gamma di interpretazioni.

In realtà, questa istruzione ha restituito un video di qualcuno che balla davanti ad altri: «avvicinarsi al partner -> mettere le mani in avanti -> guardare il partner». L'obiettivo era «camminare da solo scherzando, con un movimento leggermente disordinato e veloce», che non è nemmeno una danza.

3. Scomporre i movimenti del corpo in testo

吉田洋孝|Cast Japan代表 - inline image

Anche riscrivendo scomponendo come oscillano le braccia, come tremano le spalle e come la camera reagisce in sincronia per ogni parte, l'output non è cambiato. La guida ufficiale afferma che i riferimenti di movimento sono «più utili di un lungo paragrafo vago».

Anche se lo scomponi e lo allunghi, non raggiungerà la densità informativa di un singolo riferimento.

4. Informazioni che il materiale di riferimento possiede già

吉田洋孝|Cast Japan代表 - inline image

Gli esempi ufficiali di prompt specificano quali informazioni prendere da ciascun riferimento.

"Dal @Clay Render 1, prendi come riferimento il movimento della camera, il ritmo, le transizioni di dimensione delle inquadrature, la traiettoria del soggetto e il posizionamento.

Da @Image 2, prendi come riferimento il design del personaggio, la scena, i materiali, l'illuminazione, il colore e l'atmosfera."

Se scrivi nel testo informazioni che il riferimento possiede già, il riferimento e il testo inizieranno a dire cose diverse, portando a un conflitto.

5. Istruzioni tra loro contraddittorie

I paragrafi densi fanno sì che le istruzioni entrino in conflitto tra loro. Nel momento in cui si inserisce un'istruzione impossibile, l'AI decide da sola quale scartare.

5 cose che dovresti scrivere in un prompt

1. Il ruolo di ciascun file di riferimento

吉田洋孝|Cast Japan代表 - inline image

L'istruzione della guida ufficiale è di «menzionare chiaramente i ruoli dei riferimenti». I ruoli elencati includono identità del prodotto, coerenza del personaggio, movimento tramite modelli bianchi, recitazione su green screen, audio, stile e correzioni parziali. I ruoli non sono determinati solo dall'allegare i file.

2. Cosa NON usare di quel riferimento

Mentre assegni i ruoli, dichiara chiaramente le informazioni che non vuoi che vengano raccolte. Questa formulazione ha funzionato davvero:

Non copiare la posizione, l'abbigliamento, il testo, le persone o la storia da @Video1. Copia solo il ritmo del corpo, i gesti delle braccia, il ritmo del cammino e il movimento della camera collegato al corpo.

Separalo: «Imita solo il movimento; non imitare la posizione, i vestiti o le persone».

3. Elenco degli elementi non negoziabili

吉田洋孝|Cast Japan代表 - inline image

La guida ufficiale ai riferimenti di movimento istruisce la costruzione del prompt così: «Inizia nominando i riferimenti caricati, poi elenca i dettagli non negoziabili».

  • identità
  • forma
  • scala
  • pianta
  • design del prodotto
  • posa
  • tempi
  • voce
  • ordine delle inquadrature

4. Cosa mantenere e cosa cambiare

Scrivi separatamente cosa mantenere (recitazione, tempi, sguardo, posizionamento, movimento della camera) e cosa cambiare (persona, ambiente, costume). Senza questa distinzione, l'AI ha la libertà di rifare tutto.

5. Priorità

Specifica cosa proteggere per primo nelle situazioni in cui non tutto può essere seguito contemporaneamente. In un prompt reale, è stato scritto così:

PRIORITÀ: 1. Rispetta il ritmo del corpo e il movimento delle braccia di @Video1. 2. Rispetta il movimento della camera collegato al corpo di @Video1. 3. Mantieni la prospettiva POV e l'ambiente da @Image1. 4. Mantieni il movimento giocoso e informale, non coreografato.

Decidi prima la "risposta corretta"

Scomponi il video desiderato in elementi e decidi quale "materiale contiene la risposta corretta" per ciascun elemento.

Elemento

Dove si trova la risposta corretta

Motivo

Volto / identità della persona

Immagine

Il testo non può mantenere l'identità

Movimento del corpo, posizionamento, sguardo, tempi

Video

Dichiarati ufficialmente come obiettivi di controllo per il riferimento video

Struttura spaziale, traiettoria della camera

Modello bianco (3D senza texture)

Ufficiale: «Efficace quando spazio, percorso della camera e posizione relativa sono più importanti della texture finale»

Azioni umane, dimostrazione del prodotto

Materiale su green screen

Dichiarato ufficialmente come caso d'uso

Visione del mondo, luogo, significato, priorità

Prompt

L'ambito in cui il testo è più forte

Forma dei mobili, piccoli oggetti, dettagli dello sfondo

Lascia all'AI

Non c'è bisogno di fissarli

吉田洋孝|Cast Japan代表 - inline image
吉田洋孝|Cast Japan代表 - inline image

Inoltre, dividi la forza del vincolo per ciascun elemento in tre livelli:

  • Fisso: Non consentire rimodellamenti arbitrari (persona, forma del prodotto, materiale di movimento originale).
  • Guidato: Dai una direzione ma consenti l'interpretazione (appartamento di lusso, notte, illuminazione calda, atmosfera divertente).
  • Automatico: Lascia all'AI (forma del divano, oggetti sulla libreria, dettagli sulla parete).

Se fissi tutto, il video diventa innaturale; se lasci tutto in automatico, si allontana dall'obiettivo. Progettare dove fissare e dove allentare è il compito del prompt.

3 modi per creare. Gira prima i movimenti difficili

Metodo

Situazioni adatte

Lascia che l'AI crei tutto

Mondi inesistenti, movimenti semplici, forte visione del mondo

Fornisci campioni da cui creare

Volto/forma del prodotto fissati, si vuole continuare la composizione

Gira prima, poi cambia

Movimenti complessi, contatto umano, interazioni tra più persone

Il motivo per cui il terzo metodo è importante è che ByteDance stessa elenca la "stabilità delle scene in cui interagiscono più soggetti" come area di miglioramento in Seedance 2.5. È una battaglia persa cercare di imporre tramite testo un ambito che lo sviluppatore ammette essere difficile.

吉田洋孝|Cast Japan代表 - inline image

Il metodo "gira prima" funziona perché trasforma il compito dell'AI da "inventare la recitazione" a "cambiare l'aspetto di una recitazione già stabilita". Posizionamento, tempi, sguardo e contatto sono gestiti dal materiale girato da umani, mentre l'AI gestisce solo identità e ambiente.

Su X è stato condiviso un caso in cui un singolo materiale con tre persone diverse è stato convertito nella stessa persona per tutte e tre. (Usando Seedance 2.0, l'autore ha spiegato che non sono stati usati compositing o maschere. Trattandosi di un post di terze parti, i dettagli del processo di produzione non sono stati verificati.)

Ci sono anche casi evidenti in cui non è adatto.

Generare tutto senza materiale di partenza, contatti troppo complessi, volti completamente nascosti, ambiguità su chi è dove, o posizionamento già compromesso nella fase del materiale di partenza.

Se queste cinque condizioni si applicano, girare prima non risolverà il problema.

Il template di prompt mostrato dalla guida ufficiale

L'ordine di base è:

Soggetto (Chi/Cosa) -> Azione (Fa cosa) -> Camera (Come riprendere) -> Stile (Quale texture)

Per una singola inquadratura di 30 secondi, la guida ufficiale mostra persino la suddivisione dei tempi:

  • 00–06s: Mostra la situazione con un campo largo
  • 06–14s: Entra nel movimento principale con un primo piano
  • 14–24s: Sviluppa muovendo la camera o aggiungendo inserti
  • 24–30s: Convergi

Template da compilare e usare con i riferimenti 👇

text
1RIFERIMENTI:
2@Image1 = [Ruolo]. Usa solo [Informazioni da usare] da qui. Non usare [Informazioni da non usare].
3@Video1 = [Ruolo]. Usa solo [Informazioni da usare] da qui. Non usare [Informazioni da non usare].
4
5AZIONE:
6[Chi] [Dove] [Fa cosa].
7[Qualità del movimento. Scrivi se è veloce o lento, disordinato o educato, e a chi è rivolto, piuttosto che "un movimento chiamato X"]
8
9CAMERA:
10[Tipo di punto di vista / Angolo di campo dell'obiettivo].
11[Con cosa la camera si muove in sincronia].
12[Comportamenti della camera che non devono essere eseguiti].
13
14RECITAZIONE:
15[Temperatura della recitazione. È mostrata a qualcuno o fatta da soli?]
16
17AMBIENTE:
18[Luogo, ora, carattere della luce. Non specificare dettagli]
19
20MANTENERE / CAMBIARE:
21Mantieni = [Recitazione / Tempi / Sguardo / Posizionamento / Movimento della camera]
22Cambia = [Persona / Ambiente / Costume]
23
24PRIORITÀ:
251. [Cosa proteggere con la massima priorità]
262. [Cosa proteggere subito dopo]
273. [Prossimo]

Questo template è efficace non perché riduce la quantità di scrittura.

È perché il compito del testo passa da "descrivere il video" a "dirigere la divisione dei ruoli dei materiali".

Il video contiene la risposta corretta per il movimento, l'immagine contiene la risposta corretta per il volto e il modello bianco contiene la risposta corretta per lo spazio. Il prompt decide la loro disposizione.

Grazie per aver letto fino alla fine.

Su X ([@casthirotaka](https://x.com/@casthirotaka)), condivido ogni giorno storie utili per questo tipo di lavoro pratico.

Sarei felice se mi seguissi.

Rielabora in YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Per i creator

Trasforma il tuo Markdown in un articolo 𝕏 pulito

Quando pubblichi i tuoi testi lunghi, formattare immagini, tabelle e blocchi di codice per 𝕏 è una seccatura. YouMind trasforma un'intera bozza Markdown in un articolo 𝕏 pulito e pronto da pubblicare.

Prova Markdown verso 𝕏

Altri pattern da decodificare

Articoli virali recenti

Esplora altri articoli virali