AI Tools
マルチモーダル初級

Seedance 2.0

テキスト、画像、オーディオを動画に変換するByteDanceのマルチモーダル生成モデル

Seedance 2.0は、ByteDanceのSEED Labが2026年2月に公開したマルチモーダルAIビデオ生成モデルであり、テキスト、画像、オーディオ、ビデオという4つの入力を受け取り、オーディオとビデオを単一のアーキテクチャで同時に生成するシステムである。GPTがどのようなテキストでも自然な文章でつなぎ合わせるように、Seedance 2.0は単純なプロンプト1つで、画面内の物体の質感と照明、カメラの動きはもちろん、シーンに合ったBGMや効果音まで、一度の生成パス(シングルパス)で作り出す。参照入力として、最大3つのビデオクリップ、9枚の画像、3つのオーディオを同時に受け取ることができ、480p・720pのネイティブ解像度と1080pのアップスケールをサポートし、4秒から15秒までのクリップを24fpsで出力する。6つの画面比(16:9、9:16、4:3、3:4、21:9、1:1)をサポートし、横長、縦長、シネマスコープなど、さまざまなフォーマットに対応する。 従来のAIビデオ生成パイプラインでは、ビデオ生成モデルとオーディオ生成モデルを別々に運用し、後処理で同期する必要があった。この方式では、唇の動きとセリフのタイミングがずれたり、グラスが割れるシーンで音が0.5秒遅れて聞こえたりするなど、同期のずれが頻繁に発生した。Seedance 2.0は、統合されたマルチモーダルアーキテクチャ(unified multimodal architecture)により、ビデオとオーディオを1つの潜在空間(latent space)で同時にデコードするため、シーンの切り替え、物理的な衝突、背景のアンビエンスがフレーム単位で正確に一致する。このアプローチは、Artificial Analysis Video ArenaのリーダーボードでElo 1,272ポイントを獲得し、グローバル2位(2026年6月時点、1位はHappy Horse 1 Alibaba 1,355、3位はKling 3.0 1,250)にランクインし、その品質を証明した。また、実際の人物の顔が含まれる画像の入力をブロックしたり、C2PAウォーターマークを自動的に挿入したり、目に見えないウォーターマークを通じてAI生成物を追跡したりするなど、安全対策も組み込まれている。 活用面では、Seedance 2.0はDreaminaウェブプラットフォーム(dreamina.capcut.com)で無料のデイリークレジットを利用してすぐに使用でき、CapCutビデオエディターに統合されており、編集ワークフロー内でAIクリップを即座に挿入できる。APIを通じてプロダクションパイプラインに連携させると、たとえば、eコマースの製品ビデオをテキストプロンプトと製品写真1枚で5秒間のビデオを自動生成したり、教育コンテンツの作成時にスライド画像を入力して、ナレーション音声と同期された説明ビデオを大量に生成したりすることができる。2026年6月には、コストと遅延を削減したSeedance 2.0 Miniティアが追加され、大量生成のワークロードにも対応可能になった。

💻 必要なスペック

🧠RAM

該当なし(ローカルモデルの重みを非公開)

💾ストレージ

生成されたクリップの保存のみに必要な容量(5秒の720p MP4は約3〜5MB)

インストール

### 4-1. クイックスタート(Dreaminaウェブプラットフォーム)

```
1. https://dreamina.capcut.com/ にアクセス
2. ByteDance/TikTokアカウントでログイン
3. 「Video Generation」を選択 → プロンプトを入力 → Generate
```

### 4-2. API連携(例 — 非同期 submit-poll-download パターン)

```bash
# APIキーを取得後、ビデオ生成リクエスト(cURLの例)
curl -X POST https://api.dreamina.capcut.com/v1/video/generate \
  -H "Authorization: Bearer $DREAMINA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": "A golden retriever running on a beach at sunset",
    "duration": 5,
    "resolution": "720p",
    "aspect_ratio": "16:9",
    "audio": true
  }'

# 生成完了後、結果をポーリング
curl https://api.dreamina.capcut.com/v1/video/status/{task_id} \
  -H "Authorization: Bearer $DREAMINA_API_KEY"
```

### 4-3. CapCutとの統合

```
CapCutアプリ/ウェブ → AI Video機能 → Seedance 2.0モデルを選択 → プロンプトを入力
(CapCut Proのサブスクリプションで、月間の生成クォータが追加で提供されます)
```

🧬 バイオ活用シナリオ

🔬

製品プロモーション動画の自動生成

製品写真1枚とテキストの説明を入力すると、5〜10秒のプロモーションクリップ(BGM付き)を自動生成。eコマースの販売者が数百個のSKUの動画をまとめて作成する際に、撮影コストを削減

🧬

教育/チュートリアルコンテンツ

料理のレシピ、フィットネスの動作、製品の組み立て手順をテキストで記述すると、各ステップの視覚的なシーンと同期された効果音を含む短いクリップシーケンスを生成

💊

ソーシャルメディアのショート動画制作

9:16の縦型フォーマットで、TikTok/Instagram Reels用のコンテンツをプロンプトだけで生成。キャラクターの一貫性機能を活用することで、シリーズを作成する際に同じキャラクターを維持できる

📄 公式ドキュメント

📝 アップデートノート

まだアップデートノートはありません。

🧪 関連「生命のコード」

関連する「生命のコード」記事はまだありません。