はじめに:Seedance 2.5 で「Prompt だけ」が足りない理由
「Seedance 画像から動画」「AI マルチモーダル参照」「Seedance 参照画像」「Seedance 動画参照」を検索するクリエイターは storyboard テキストは書けるのに、次の3点で止まりがちです:
- キャラ/商品が毎回ブレる:テキストを細かくしても外見が安定しない
- カメラワークが真似できない:「あの CM のような push」が言葉では伝わらない
- 参照が多いほど崩れる:画像・動画・音声を全部入れるとモデルが「誰が主役か分からない」
Seedance 2.5 はテキスト+画像+動画+音声のマルチモーダル入力に対応し、1 クリップ約 20 秒、ショット間一貫性を強化。本記事は「マルチモーダル入門」(サイトに別途あり)ではなく、実行可能な Seedance 画像から動画&参照組み合わせハンドブック—いつどの参照を使うか、比率、反復、トラブルシュート。
《分鏡 Prompt テンプレート集》(テキスト構造)とは異なり 参照素材でフレームを固定 に焦点。2.0《マルチモーダル入力》より 2026 Seedance 2.5 の長尺・強一貫性 の実戦レシピ。
まず役割分担:4 モダリティが担うこと
| モダリティ | 最適な役割 | 期待しないこと |
|---|---|---|
| テキスト Prompt | 叙事、タイムライン、カメラ用語、禁止事項 | 特定の顔/パッケージ詳細の精密再現 |
| 画像参照 | キャラ外見、商品形状、シーン mood、構図スタイル | 連続アクションとレンズ速度 |
| 動画参照 | カメラ軌道、アクションリズム、トランジション感 | クリップ内キャラの同一性コピー(同一性は画像で固定) |
| 音声参照 | BGM リズム、環境ノイズ、ナレーション調 | 明確な台詞脚本の代替(台詞は Prompt に) |
一言原則:テキスト=「ストーリーと指示」、画像=「見た目」、動画=「レンズの動き」、音声=「聴こえ方」。役割が重なると混乱しやすい。
画像から動画 vs テキストのみ:参照画像が必須な場面
| シーン | テキストのみ | 画像参照推奨 | 理由 |
|---|---|---|---|
| ムード概念 / 情緒片 | ✅ まず試す | mood 任意 | テキストで気質可 |
| 固定キャラ連載 / IP | ❌ 不安定 | ✅ 必須 | 外見連続性優先 |
| EC 商品 / パッケージ再現 | ❌ 歪みやすい | ✅ 必須 | 形状・配色・logo 域 |
| ブランドトーン統一 | ⚪ | ✅ 推奨 | 主色とマテリアル言語 |
| 複雑な二人芝居 | ⚪ | ✅ 各 1–2 枚 | 顔混ざり低減 |
| 一度きり抽象 VFX | ✅ | 不要なこと多い | 参照が発散を制限 |
Seedance 画像から動画 の核心は「静止画を動かす」だけでなく、画像で同一性と商品を固定し、テキスト/動画で演出意図を明確に。
参照素材準備チェックリスト(着手前)
1. 画像参照(最もよく使う)
| 種類 | 推奨枚数 | 要件 |
|---|---|---|
| キャラ正面半身 | 1–2 | 同じヘア・衣装・年齢感 |
| 商品白背景 / メインビジュアル | 2–3 | 同色同比例、競合なし |
| シーン mood | 1–2 | 固定時間・光キーワード |
| スタイル参照(任意) | 0–1 | 光/grade のみ、第二主人公混入禁止 |
鉄則:
- 1 枚 1 役(正面 / ディテール / シーン分離)
- 同一キャラ/SKU 参照セットは campaign 全体で不変
- コラージュ、大 watermark、1 枚に複数人禁止
2. 動画参照(任意だが強力)
- 長さ:3–8 秒の明確なカメラワークで十分
- 用途:push、orbit、follow—レンズを学ぶ、顔は学ばない
- Prompt:「カメラは参照動画;キャラ外見は画像厳守」
3. 音声参照(任意)
- リズム CM、MV 風、環境雰囲気
- セリフあり:音声は調子、短い台詞は Prompt
Seedance 2.5 マルチモーダル組み合わせレシピ(そのまま使える)
レシピ A:キャラ短編(画像+テキスト)
- 画像:キャラ設定 × 2
- テキスト:三ショット timeline(建立→葛藤→定格)
- 動画/音声:最初は追加しない
向き:短編ドラマの hook、ペルソナテスト、同一性アンカー。
レシピ B:商品展示(画像+テキスト、動画任意)
- 画像:商品 × 2–3+シーン × 1 任意
- テキスト:登場→セールスポイント特写→CTA 余白
- 動画:ブランド CM カメラ 1 本(任意)
向き:EC hero、フィード商品動画。
レシピ C:監督級 CM(画像+動画+テキスト、音声任意)
- 画像:商品/キャラ固定
- 動画:カメラの temperament
- 音声:BGM リズム
- テキスト:絵コンテ+禁止+「外見は画像準拠」
向き:ブランド短 TVC、提案サンプル。
レシピ D:トーク/パフォーマンス(画像+テキスト+音声)
- 画像:出演者設定
- 音声:調子または beat
- テキスト:短い台詞+景別;長い独白は回避
向き:多言語ナレーション前の単語 master。
推奨 Prompt 骨格(画像から動画専用)
【タスク】縦/横ショート、シネマ grade、約 16–20 秒。
【外見ロック】主体外見は参照画像厳守:顔替え・髪型・パッケージ比例・主色変更禁止。
【カメラ】[動画 ref あり] 参照動画の push/orbit リズム;[なし] push/follow/固定を明記。
【ショット 1 | 0–5s】建立:[シーン]、[主体が入画]。
【ショット 2 | 5–13s】展開:[アクション/利益点]、ミディアムまたはクローズアップ。
【ショット 3 | 13–20s】収束:[表情/商品定格]、余白クリーン;読める小文字禁止。
【音声】[雰囲気または「音声リズム参照」];セリフ 1–2 短句以内。
【禁止】背景の乱码文字、余計な通行人、途中の衣装/商品変更。
キー文をほぼ毎 Prompt に:「外見は参照画像厳守」—Seedance マルチモーダルで最安・最有效の一貫性スイッチ。
三大完全ケース
ケース 1:人物 IP アンカー(12 秒→18 秒)
目標:ナラティブ前に「同一人物」を確認。
- キャラ画像 × 2+テキスト:「中近景、緩やか push、中性表情、クリーン背景」
- 合格後に三ショット故事、同一画像セット
- 失敗時は事件密度を下げ、雑画像を増やさない
ケース 2:ヘッドホン画像から動画(16 秒·9:16)
叙事:白台登場→イヤーカップ材质特写→装着定格余白。
参照:白底商品 × 2、细节 × 1。 Prompt 要点:外見ロック+三ショット timeline+「包装小字生成禁止」。 任意:5 秒 orbit 参照動画、「カメラのみ学習」明記。
ケース 3:雨夜情緒片(図+動画+音声)
画像:雨夜 street mood × 1、キャラ × 1 動画:緩やか follow 参照 音声:湿った ambient または low pad テキスト:三ショット hook;SMS/画面の清晰小字回避
典型 Seedance マルチモーダル参照 フル構成—「身份は画像、レンズは動画、故事はテキスト」。
反復四ステップ(マルチモーダル専用)
- テキスト only で構造(10–12 秒):hook 読めるか
- 画像のみで外見ロック(仍 12 秒):同一人物/商品か
- 動画または音声を一つ追加—同時に満載しない
- 16–20 秒に延長:後半で外見/カメラ崩れチェック
第 4 步失敗:二段生成して編集、または第 2 步で参照削減。
よくある誤区
- 参照越多越好:必要以上は打架
- 動画で顔ロック:画像で身份、動画はカメラのみ
- 1 枚コラージュ複数キャラ:解析困難
- 画面内清晰 slogan:乱码—後期字幕
- 初回から 20 秒+全モダリティ:短→長、図→音视频
- 途中で参照セット変更:役者/商品変更と同じ
よくある失敗と修正
| 現象 | 原因 | 修正 |
|---|---|---|
| 顔替え/商品歪み | 画像冲突またはロック文なし | 核心 1–3 枚固定+ロック文反復 |
| 画像あり仍不像 | 解像度/妆发不一致 | 同妆发正面に差替、侧面削除 |
| カメラが参照と無関係 | 「カメラは動画参照」未声明 | Prompt で分工明確化 |
| 二人顔混ざり | 参照過多 | 各 1–2 枚、名前で区別 |
| 音声が主役、口型飘 | 台詞長すぎ | 1 句に;AV 意図整合 |
| 動画追加後身份漂 | 動画の別顔を学習 | 「外見は画像準拠」または動画削除 |
テキストのみ workflow との選び方
| 目標 | 推奨路径 |
|---|---|
| 快速試想法/抽象 mood | テキスト only→mood 図判断 |
| 連載キャラ/投放商品 | 画像から動画主(レシピ A/B) |
| 「あの片」の镜头感 | 図で身份+動画でカメラ(C) |
| リズム/口播驱动 | 図+文+音声(D) |
SEO と产能:「Seedance 画像から動画」と「マルチモーダル参照」は同じ生产线の二つの検索—参照で随机性低減。
SEO と素材管理
- タイトル/カバーに「画像から動画/マルチモーダル参照」
- 本文に Seedance 2.5、画像から動画、参照画像、動画参照、音声参照
- キャラ/SKU ごと「参照パック」フォルダ(版管理)、随意替换禁止
- 质检合格レシピを内部模板 化、Prompt 模板库と交叉 reuse
FAQ
Q:Seedance 2.5 画像から動画は画像必須? A:必須ではない。ただしキャラ連載・商品再現・ブランド調性では強く推奨;否则一貫性コスト急増。
Q:画像は何枚まで? A:「职责清晰」が基準—キャラ 1–2、商品 2–3、シーン 1–2 足够。少なく綺麗に。
Q:動画参照で参照片の人物も入る? A:あり得る。Prompt で外見はあなたの画像、または主角なし纯カメラ clip。
Q:Seedance 2.0 マルチモーダルとの違い? A:流程互換;2.5 は長尺とショット間一貫性—参照ロック後 16–20 秒 hook を一気に。
Q:生成後カメラ変更可能? A:可—同一画像セット、テキストカメラまたは動画 ref 差替え再 run;外見描述と参照図を同時大変更しない。
结语:参照を Seedance の「スクリプトスーパーバイザー板」に
マルチモーダルは素材堆叠競争ではなく、Seedance 2.5 への明確な场记板:
- 画像で身份と商品を釘付け
- 動画でレンズ言語を借りる
- 音声でリズムと breath を安定
- テキストで timeline と禁止を書く
今日対照実験:同一三ショット故事—纯テキスト 1 本、参照図 2 枚追加 1 本。「後者が連載資産に感じる」時、Seedance 画像から動画生产线が本当に始動。