はじめに:「Seedance テキストから動画」を単独で学ぶ理由
「Seedance テキストから動画」「AI テキストから動画」「Seedance Prompt の書き方」「文字から動画生成」「Seedance 2.5 純テキスト」で検索する人は、しばしば二つの極端に詰まります。
- 短すぎる:「かっこいい広告を作って」の一行だけ—Seedance が自由に解釈し、結果が制御できない
- 断片的すぎる:形容詞だらけで、タイムラインもショット役割もない—20 秒の中でイベントがぶつかる
本サイトにはすでに「画像から動画ハンドブック」(参照で見た目を固定する方法)と「絵コンテ Prompt テンプレート集」(コピー可能な脚本)があります。本稿は 純テキスト / 弱参照シナリオ に焦点を当てます。まだ見た目固定のスチルや磨き上げた製品アートがないとき、あるいは Seedance テキストから動画 でナラティブとカメラを素早く検証したいとき—監督級絵コンテ のように Prompt を書く方法です。
境界:テキストから動画はムード、ナラティブ構造、カメラ意図、音画リズムの下書きに優れます。特定の顔やパッケージロゴを再現する必要がある場合は、画像から動画ワークフローに引き継ぎ—テキストで「ピクセルまで描写」させないでください。
Seedance の中でテキストから動画とは何か?
| 表現 | Seedance 2.5 での意味 |
|---|---|
| テキストから動画 | テキスト Prompt を主駆動とする(参照なし、または弱参照のみ) |
| 画像から動画 | 画像で被写体の見た目を固定し、テキストで動作とタイムラインを補う |
| マルチモーダル生成 | テキスト + 画像 + 動画 + 音声の任意の組み合わせ |
一行で:Seedance テキストから動画 = 絵コンテ式のテキストで、約 15–20 秒 の聴ける・観られるショート単位を演出すること。それは「ワンクリック長編」ではなく、高品質なフック草稿です。
いつテキストから動画を優先するか?いつ画像が必須か?
| シナリオ | T2V 優先? | 注記 |
|---|---|---|
| コンセプト / ムード / スタイル探索 | ✅ | テキストの方がトーンを速く決められる |
| カメラとナラティブ構造の検証 | ✅ | 見た目を固定する前にタイムラインを通す |
| 抽象 VFX、Bロール、環境確立 | ✅ | 参照が制約になることもある |
| 固定 IP キャラクター連載 | ❌ | 顔の画像ロックが必須 |
| EC パック / ロゴ忠実度 | ❌ | 製品参照が必須 |
| 強い似姿のボイスオーバー | ⚪ | T2V でまずリップラインを試し、見た目ロック後に画像を追加 |
監督級純テキスト Prompt:五ブロック骨格
Seedance 2.5 はタイムライン絵コンテに最もよく反応します。純テキストでは、次の五ブロックを固定してください。
【シーン】環境 + 光 + 全体スタイル(1–2 文)
【ショット 1 | 0–Xs】ショットサイズ + 被写体アクション + カメラ移動
【ショット 2 | X–Ys】ショットサイズ + 被写体アクション + カメラ移動
【ショット 3 | Y–Zs】ショットサイズ + 被写体アクション + クローズ/フリーズ
【オーディオ】BGM / 環境音 / 短い台詞意図
【禁止】出現してはならないもの(文字化け字幕、余分なエキストラ、途中の衣装替えなど)
執筆の鉄則(テキストから動画専用)
- 形容詞より先にタイムライン:0–4 / 4–12 / 12–20 がなければ、美しい散文でも失敗する。
- セグメントごとに主カメラ移動は一つ:一つのビートでプッシュ + オービット + 手持ち揺れを重ねない。
- 被写体名詞は描けるものに:「テック製品」だけでなく「銀色の ANC イヤホン」と書く。
- 禁止は形容詞に勝る:ランダム字幕と余分な小道具を切る。
- オーディオは意図を書き、曲名全文は書かない:例「アップビートな電子 BGM、最後の 2 秒でフェード」。
ショットサイズ、カメラ、タイミング:コピー可能な三つの用語集
ショットサイズ
| 用語 | 用途 |
|---|---|
| ワイド / フル | 環境を確立 |
| ミディアム | アクションと関係 |
| クローズアップ | 質感、顔、製品ディテール |
| ミディアムクローズ | ボイスオーバー、売りポイント |
カメラ移動(Seedance で安定)
| 用語 | 意味 |
|---|---|
| ロック / スタティック | 移動なし;製品の上昇に良い |
| プッシュ / プル | 被写体へ近づく、または離れる |
| パン / ティルト | 水平または垂直のスイープ |
| フォロー | 被写体の動きを追う |
| オービット | 被写体の周りを弧状に回る |
| クレーン / ブーム | 垂直移動 |
尺スライスの提案
| 総尺 | 推奨構造 |
|---|---|
| 10–12s | 3+5+2 または 4+4+4—まず検証 |
| 16s | 4+6+6—EC/広告で一般的 |
| 20s | 4+8+8 または 5+8+7—イベントを詰めすぎない |
完全事例(純テキスト、すぐ実行可能)
事例 1:ムード Bロール コンセプト(14s · 16:9)
【シーン】雨に洗われた都市の屋上、水たまりにネオン、シネマティックなティールオレンジ調。
【ショット 1 | 0–4s】ワイド:スカイラインと水たまりの反射;ゆっくり横移動。
【ショット 2 | 4–10s】ミディアム:トレンチコートの人物がレールへ歩く、背をカメラに;フォロー。
【ショット 3 | 10–14s】クローズ:手がレールに、都市の灯りがソフト;スタティック後マイクロプッシュ。
【オーディオ】疎なピアノ + 遠い交通のベッド;台詞なし。
【禁止】身元が入れ替わるクリアな顔クローズアップ、画面内字幕、突然の晴天。
合格:ムードが統一;コート/衣装が安定;音声が絵を潰さない。
事例 2:製品広告フック(16s · 9:16)—T2V で構造を検証
【シーン】ミニマルな白スタジオ、ソフトボックス主光、製品広告スタイル。
【ショット 1 | 0–4s】ミディアム:ワイヤレスイヤホンが開いたケースから上昇;ロックカメラ;浅い被写界深度。
【ショット 2 | 4–10s】クローズアップ:イヤホンがゆっくり回転し金属を見せる;オービット移動。
【ショット 3 | 10–16s】ミディアムクローズ:耳に装着、その後ブランドロゴのフリーズゾーンへプッシュ。
【オーディオ】アップビートな電子 BGM、約 120 BPM 感、最後の 2 秒でフェード;台詞なし。
【禁止】文字化け字幕、余分な雑物、途中の製品変形。
次:構造が通ったら、製品画像 1–2 枚をアップロードして I2V で見た目をロック。それが標準の Seedance テキストから動画 → 画像から動画 リレーです。
事例 3:知識 VO 草稿(12s · 9:16)
【シーン】清潔な自宅デスク、自然な窓光、解説 VO スタイル。
【ショット 1 | 0–3s】ミディアムクローズ:タレントがカメラに微笑みうなずく;ロック。
【ショット 2 | 3–12s】ミディアムクローズ:タレントが「最初の AI 動画を作る三つのステップ。」と言う。リップシンク整合;軽いジェスチャー。
【オーディオ】明瞭な話し VO を主とし、非常に軽いベッド;競合する BGM なし。
【禁止】スクロール字幕、余分な人物、途中のメイク/ヘア変更。
注:T2V でその台詞のリップシンクが持つか試せる;固定の実顔には参照画像が必要。
四ステップ反復(純テキスト)
- 10–12s 骨格:シーン + 三つのタイムラインビート + ビートごとに一つの移動
- オーディオ意図を追加:カットポイント下のリズムを確認
- 禁止と素材語を追加:侵入と素材ドリフトを切る
- 16–20s に伸ばす:イベントが明確なときだけ;崩れたら分割—五つの変数を同時に変えない
失敗時の優先順位:イベント削減 > カメラ移動削減 > 台詞短縮 > その後参照画像を追加。
よくあるテキストから動画の失敗と修正
| 症状 | 想定原因 | 修正 |
|---|---|---|
| きれいだが物語がない | 形容詞のみ、タイムラインなし | 0–X / X–Y / Y–Z を追加 |
| 後半が崩れる | 20s に詰めすぎ | 12s を試すかクリップ分割 |
| カメラが暴れる | 一つのビートに複数移動 | セグメントごとに一つの移動 |
| 文字化け字幕 | Prompt が画面内テキストを要求 | 禁止し、字幕はポストで追加 |
| 製品/顔のドリフト | T2V に忠実度を要求 | I2V + テキスト絵コンテに切替 |
| 悪いリップシンク | 台詞が長すぎ/速すぎ | 約 8–12 音節/文字の行に短縮 |
| 期待した音声がない | オーディオ意図未記載 | BGM/VO/環境音を指定 |
テキストから動画 vs 画像から動画 vs テンプレート集:何を読む?
| あなたの目標 | 読むもの |
|---|---|
| 純テキスト絵コンテをマスター | 本稿(テキストから動画) |
| 顔/製品の見た目をロック | 「画像から動画完全ハンドブック」 |
| 完成シーン脚本をコピー | 「絵コンテ Prompt テンプレート集」 |
| 細かいカメラ制御 | 「カメラ移動完全ガイド」 |
| まず Seedance を理解 | 「Seedance とは?」 |
SEO と創作のヒント
- タイトル/カバーで「テキストから動画 / Prompt / 絵コンテ」を明示
- 本文で自然に Seedance テキストから動画、Seedance 2.5、AI テキストから動画、文字から動画生成、Seedance Prompt をカバー
- 画像から動画記事と相互リンクし、「T2V 検証 → I2V ロック」クラスターを形成
FAQ
Q: Seedance テキストから動画は常に画像から動画より劣るか?
A: いいえ。コンセプト、カメラ、ナラティブ検証では T2V の方が速い;アイデンティティとパック忠実度では I2V の方が安定。タスクで選び、「どちらが高級か」では選ばない。
Q: 純テキスト出力は商用に使えるか?
A: 広告草稿とムードフィルムには十分;肖像権、ブランドマーク、音楽権は依然適用。外観が重要な最終版は参照を追加すべき。
Q: Prompt はどのくらいの長さがよいか?
A: タイムラインビートの明確さが長さを決める。通常、構造化された 1.5–2 画面のテキストが、500 語の形容詞エッセイに勝る。散文の壁より絵コンテブロックを優先。
Q: Prompt は英語必須か?
A: Seedance は中国語の絵コンテ用語もよく扱う;英語のスタジオ習慣も機能する。言語の見せびらかしより構造が重要。
Q: T2V は AV 同期にどうつながるか?
A: オーディオブロックに BGM/VO/環境音の意図を書く;ビートヒットやリップには音声参照を追加(「AV 同期の実践」を参照)。
Q: これは Prompt テンプレート集と重複するか?
A: いいえ。テンプレートはコピー可能な脚本を提供;本稿はなぜその構造が機能するか、いつ純テキストで足りるか、失敗をどう直すかを教える。本稿を読んでからテンプレートを再利用。
結論:Seedance テキストから動画を絵コンテの下書き帳にする
「Seedance テキストから動画」「AI テキストから動画」「Seedance Prompt」の検索を改善するには、正しいメンタルモデルを教えることです。
- T2V = テキストでの監督意図、形容詞コンテストではない
- タイムライン + ショットサイズ + 単一移動 + オーディオ意図 + 禁止 が安定した五件セット
- 12s で検証し、その後 16–20s に伸ばす
- T2V が構造を検証し、I2V が見た目をロック—対立ではなくリレー
今日ケース 2 をコピーし、Seedance 2.5 で純テキスト 16s 縦型を実行;構造が通ってから製品画像を追加。Prompt が常に「カメラが読める」ものになったとき、あなたの Seedance テキストから動画ラインは本当にオンラインです。