Zaawansowane wskazówki 2 min czytania Seedance Team
Wskazówki wejścia multimodalnego: niech AI zrozumie twoją „intencję reżysera"
Opanuj strategie łączenia tekstu, obrazu, audio i wideo, aby precyzyjnie przekazać intencję twórczą.
Multimodalność to nie proste nakładanie
Wejście multimodalne Seedance 2.0 to nie «im więcej assetów, tym lepiej». Każda modalność musi mieć jasną rolę. Dobry prompt multimodalny to jak zwięzły storyboard.
Model podziału czterech modalności
| Modalność | Najlepsze zastosowanie | Zalecana liczba |
|---|---|---|
| Tekst | Logika narracji, detale, ton emocjonalny | 1 zwięzła instrukcja |
| Obraz | Styl wizualny, wygląd, kompozycja | 3–5 obrazów |
| Wideo | Ruch kamery, rytm, przejścia | 1–2 klipy |
| Audio | Styl muzyki, dźwięk, rytm mowy | 1 klip |
Scenariusz 1: Reklama marki
Cel: 15-sekundowe wideo produktu
- Obrazy: 3 zdjęcia HD ( przód, bok, użycie)
- Wideo: Tempo kamery z istniejącej reklamy
- Audio: Referencyjna ścieżka dźwiękowa
- Tekst: «Minimal premium — produkt powoli rozświetla się z ciemności, obrót 360°, hold na logo»
Scenariusz 2: Krótki narracyjny
Cel: 12-sekundowy klip z historią
- Obrazy: 2 character sheet + 2 koncepty sceny
- Wideo: Kinowa referencja kamery
- Tekst: Pełny opis sceny z początkiem, rozwinięciem, finałem
Scenariusz 3: Segment teledysku
Cel: Sync AV dla tańca/występu
- Audio: Fragment utworu (model czyta rytm)
- Wideo: Referencja choreografii lub stylu
- Obrazy: Referencje sceny
- Tekst: Oświetlenie i atmosfera
„Myślenie reżysera” przy promptach
- Najpierw ton: Jaka emocja?
- Struktura: Ile ujęć? Jak długie?
- Detale: Konkretna treść ujęć
- Styl: Cechy wizualne i dźwiękowe
Wskazówki debugowania
Gdy wynik odbiega, sprawdź kolejno:
- Sprzeczności między modalnościami
- Zmniejsz referencje, dodawaj pojedynczo
- Podziel tekst na bardziej szczegółowe opisy
- Edycja wideo zamiast pełnej regeneracji