## 情報源
- URL: https://www.youtube.com/watch?v=I4VOfiICGxs
- チャンネル: AI大学【AI&ChatGPT最新情報】
- 投稿日: 2026-08-14(当日)
- 尺: 21分59秒 / 再生102回・高評価6
- スコア: 70/100(関連性15・鮮度25・信頼性12・深度18)
- 解析経路: NotebookLM は RPC code=9 で2回失敗 → 日本語自動字幕(yt-dlp)全文からの直接解析

## 主要な発見

### 1. Seedance 2.5 (ByteDance Seed / 2026-08 一般公開)
- 解像度は 480p / 720p のみ。16:9〜9:16 の各種比率に対応
- **1回の生成で30秒の音声付き動画**を生成でき、さらに延長も可能
- 参照素材は **画像30枚 / 動画10本 / 音声10本** まで同時投入して一貫性を保持
- 「何秒から何秒はこの展開・このカメラワーク」と**秒単位でプロンプト制御**できる
- 背景差し替え・カメラワーク変更などの編集機能を搭載
- ツール: Dreamina AI (dreamina.capcut.com) / CapCut / fal / Runway
- 弱み: **コストが最も高い**(Dreamina 月額2300円プランでも数本で枯渇)/ 日本語の会話・画面表示のミスが多い / 参照音楽にアレンジが混入 / 最大720pのため2K・4K不可

### 2. MiniMax H3 (MiniMax / 2026-07下旬)
- 画像・動画・音声を統合理解する**マルチモーダル**動画生成モデル
- 最大 **2K解像度**・4〜15秒。会話/歌声/効果音/環境音/BGM を含められる
- 既存動画に対し**文章で修正指示を出して編集**できる
- 動画内の文字・字幕・ロゴ・ブランド名の表示能力が高い
- **このクラス初のオープンウェイトモデル** → PCスペック次第でローカル実行可能
- ツール: Hailuo AI (hailuoai.video) / MiniMax 開発者API / fal / Runway
- 性能は Seedance 2.0 に匹敵。**4モデル中で最もコストパフォーマンスが良い**
- 特に得意: 音声ファイル+人物画像を組み合わせた**高精度リップシンク**動画

### 3. FLUX 3 Video (Black Forest Labs / 2026-07下旬)
- 画像生成で有名な FLUX シリーズ**初の動画生成モデル**
- 最大 **20秒・1080p**、複数言語の会話に対応した音声付き動画を一気に生成
- 低コスト・高速でアイデア出しできる**ドラフトモード**を搭載
- 今後 2K/4K 対応と**オープンウェイト版**を公開予定
- ツール: BFL API プレイグラウンド (dashboard.bfl.ai) / fal / Runway
- **arena.ai のベンチマークで text-to-video ランキング2位**(Seedance 2.0 より上)
- 特に得意: 1本の動画内で英語・日本語・中国語など**複数言語の正確な発音とリップシンク**
- 弱み: コスト高め / 漢字の読み方を間違えることがある

### 4. Gemini Omni Flash (Google / 2026-05)
- テキスト・画像・動画を自由に組み合わせて音声付き動画を生成
- **世界知識を活用**するため解説動画の生成が得意
- **物理現象の理解力が高い**(水の流れ・身体の動きが自然)
- 既存動画のカメラアングル・スタイル・細部まで編集変更可能
- 生成した全動画に **SynthID 電子透かし**が埋め込まれる
- ツール: **Google Flow は無料ユーザーも利用可**(labs.google/fx/ja/tools/flow)/ Gemini アプリ有料版 / Google系ツール / API経由で fal・Runway
- 2大ベンチマークの text-to-video・動画編集ランキング**全部門で上位**
- Google DeepMind の開発者が「**動画版 Nano Banana**」と評したほど既存動画の編集能力が突出
- **4モデル中で唯一無料で試せる**
- 弱み: 日本語発音のミス / 動きの速い動画で破綻が増える

## 横断的な洞察
- **4モデル全てが日本語の発音・画面表示で不安定**。日本語セリフ/テロップは AI 生成に任せず、後工程で TTS・テロップ差し替えする前提で設計するのが現実的
- 選択の軸は明快: **無料で試すなら Gemini Omni Flash / コスパなら MiniMax H3 / 長尺高解像度なら FLUX 3 Video / 機能の万能性なら Seedance 2.5**
- オープンウェイト提供が MiniMax H3(提供済)・FLUX 3 Video(予定)と続いており、**ローカル動画生成が現実解になりつつある**
- 2026-07末からリリースラッシュが継続(LTX 2.5 等)。ベンチマークは arena.ai/leaderboard で追える

## アクションアイテム
- Google Flow の無料枠で Gemini Omni Flash を試す(唯一の無料・既存動画編集が最強)
- コスト検証は Hailuo AI (MiniMax H3) から。オープンウェイトなのでローカル推論の検証対象にもなる
- 日本語ナレーション込みの動画パイプラインは「映像=生成AI / 音声=別TTS」の二段構成を前提にする
- gokou_timeline の AI キーワードに Seedance 2.5 / MiniMax H3 / FLUX 3 Video / Gemini Omni Flash を登録済み