Gemini Veo 3.1
Googleの動画生成モデルの上位版。映像と一緒に音声も生成でき、4Kまでの書き出しに対応します。
4秒/6秒/8秒/720p/1080p/4K
使いたいモデルが決まっている場合に、そのモデルでできることと、扱えるサービスを調べるためのページです。
最終更新 2026-08-08 / PRを含みます
モデル解説
作れる長さ、解像度、縦横比、参照できる画像の枚数、気をつけることをまとめています。
Googleの動画生成モデルの上位版。映像と一緒に音声も生成でき、4Kまでの書き出しに対応します。
4秒/6秒/8秒/720p/1080p/4K
Veo 3.1のひとつ前の版。音声の同時生成には対応しますが、解像度と参照画像の扱いは3.1より控えめです。
4秒/6秒/8秒/720p
文章でのやりとりを通じて動画を直したり作ったりできる、Googleのマルチモーダルモデル。音声も同時に生成します。
3秒〜10秒/720p
Kuaishou(快手)
Klingの最新版。音声の生成と、最初のコマ・最後のコマの指定に対応します。速度と品質で3つのモードを選べます。
3秒〜15秒/720p
Kuaishou(快手)
参照する動画の動きを、自分のキャラクターに移すためのモデル。画像と動画の両方を渡して使います。
画像の向きに合わせる場合は10秒、動画の向きに合わせる場合は30秒/公式に記載なし
Kuaishou(快手)
コマとコマの間をつなぐ動きを作るモデル。既存の動画を作り替える使い方にも対応します。
3秒〜15秒/720p
ByteDance
ByteDanceの動画生成モデル。音声の同時生成に加え、口の動きを声に合わせる処理にも対応します。
4秒〜15秒/1080pまで
ByteDance
Seedanceの高速・低コスト版。最初のコマと最後のコマを指定できます。
5秒/10秒/1080p
PixVerse(Motiv AI)
PixVerseの新しい版。音声の同時生成と、場面のつなぎ(トランジション)に対応します。
1秒〜15秒/1080pまで
PixVerse(Motiv AI)
動きの自然さ、カメラワークの指定、効果(VFX)、場面のつなぎ、動画の延長に対応した版です。
5秒/8秒/720p/1080p
MiniMax
MiniMaxの新世代モデル。2Kの解像度に対応し、被写体を参照画像でそろえられます。以前のHailuo系モデルの後継にあたります。
5秒〜15秒/2K
Vidu
音声の同時生成に対応したViduの最新版。参照画像から映像を作る使い方が得意です。半額で使えるTurboの区分があります。
1秒〜16秒/720p/1080p
Alibaba
動きの表現と再現性を高めたWanの最新版です。
5秒/480p/720p
xAI
xAIの動画生成モデル(v1.5)。参照画像を多く使え、作った動画を延長できます。
1秒〜15秒/1080pまで
Black Forest Labs
画像生成で知られるBlack Forest Labsの動画モデル。音声の同時生成に対応し、20秒までの長さを作れます。
5秒〜20秒/720p/1080p
Alibaba
Alibabaの動画生成モデル。文章からの生成と参照画像からの生成に加え、動画の編集にも対応します。
3秒〜15秒/720p/1080p
Runway
表現性の高い映像づくりに向くモデル。画像から動画への生成に絞られています。
5秒/10秒/720p
fal(sync-3)
動画の口の動きを、音声に合わせるためのモデルです。映像を新しく作るものではありません。複数の話者を区別できます。
元の動画に合わせる/元の動画に合わせる
ByteDance
できあがった動画の画質と解像度を上げるためのモデルです。映像を新しく作るものではありません。
元の動画に従う(最長30秒)/元の動画より高くする
逆引き
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
この系統のモデル解説
生成モデルは入れ替わりが速く、数か月で提供が終わるものも、新しく加わるものもあります。ここに載せているのは確認した時点の内容です。特定のモデルを目当てに契約する場合は、申し込み前に公式サイトで現在の対応状況をご確認ください。