Suggerimenti avanzati 2 min di lettura Seedance Team
Suggerimenti input multimodale: far capire all'IA la tua "intenzione da regista"
Padroneggia strategie di combinazione di testo, immagine, audio e video per trasmettere con precisione l'intento creativo.
Multimodale non è semplice accumulo
L’input multimodale di Seedance 2.0 non significa «più asset = meglio». Ogni modalità deve avere un ruolo chiaro. Un buon prompt multimodale è come uno storyboard conciso.
Modello di divisione in quattro modalità
| Modalità | Uso migliore | Quantità consigliata |
|---|---|---|
| Testo | Logica narrativa, dettagli, tono emotivo | 1 istruzione concisa |
| Immagine | Stile visivo, aspetto, composizione | 3–5 immagini |
| Video | Movimento camera, ritmo, transizioni | 1–2 clip |
| Audio | Stile musicale, suono, ritmo parlato | 1 clip |
Scenario 1: Pubblicità di marca
Obiettivo: Video prodotto di 15 secondi
- Immagini: 3 foto HD (fronte, lato, uso)
- Video: Ritmo camera da spot esistente
- Audio: Colonna sonora di riferimento
- Testo: «Stile premium minimal — prodotto si accende lentamente dal buio, rotazione 360°, hold sul logo»
Scenario 2: Corto narrativo
Obiettivo: Clip di 12 secondi con storia
- Immagini: 2 character sheet + 2 concept di scena
- Video: Riferimento camera cinematografica
- Testo: Descrizione completa con inizio, sviluppo, chiusura
Scenario 3: Segmento MV musicale
Obiettivo: Sync AV per danza/performance
- Audio: Estratto canzone (il modello legge il ritmo)
- Video: Riferimento coreografia o stile
- Immagini: Riferimenti visivi palco
- Testo: Illuminazione e atmosfera
«Mentalità da regista» per i prompt
- Prima il tono: Quale emozione?
- Poi la struttura: Quanti piani? Durata?
- Poi i dettagli: Contenuto per piano
- Infine lo stile: Carattere visivo e sonoro
Suggerimenti di debug
Se l’output devia, verifica in ordine:
- Contraddizioni tra modalità
- Riduci riferimenti, aggiungi uno alla volta
- Dividi il testo in descrizioni più specifiche
- Usa editing video invece di rigenerare tutto