DocsAI モデル動画モデル

動画モデル

Klipse では、映像制作の目的に応じてさまざまなビデオ生成モデルを選べます。モデルごとに開始・終了フレーム、参照画像、ビデオ入力、生成の長さ、画面比率、解像度とオーディオの扱い方が異なるため、求める制作方法に合ったモデルを選ぶことが大切です。

どのような違いがありますか?

ビデオモデルは仕上がりの品質だけが違うのではなく、映像の作り方そのものが異なります。プロンプトだけで生成することも、開始・終了フレームでシーンを制御することも、参照画像や既存のビデオを入力として使うこともできます。

プロンプト中心でさまざまな比率の映像を作りたいです。

長さと比率を幅広く自分で設定しながら映像を生成する作業

Seedance 2.0 Series

最初のシーンと最後のシーンを自分で決めたいです。

開始フレームと終了フレームを使ってシーン転換の方向を制御

Kling 2.6 / 3.0 · Veo 3.1

参照画像や既存のビデオを積極的に活用したいです。

画像・ビデオの入力を組み合わせて、映像制作にさまざまな参考資料を渡す

Kling Omni · Gemini Omni Flash

映像と一緒にオーディオもプロンプトで作りたいです。

音声の On/Off を個別に切り替えるのではなく、プロンプトをもとに映像のオーディオを自動生成

Veo 3.1 Series · Gemini Omni Flash

モデルを一覧で比較する

Klipse のビデオノードで対応している主な入力方式と生成オプションを比較してみてください。

モデル特化の方向開始終了参照ビデオ入力長さ比率解像度オーディオ
Seedance 2.0 Mini高速で軽い生成----4~15秒6種類480p, 720p対応
Seedance 2.0 Fast高速な繰り返し生成----4~15秒6種類480p, 720p対応
Seedance 2.0高解像度の汎用生成----4~15秒6種類480p~4K対応
Kling 2.6開始・終了フレームの制御OO--5~15秒Start 基準720p, 1080p対応
Kling 3.0フレーム制御 + 高解像度OO--3~15秒Start 基準720p~4K対応
Kling Omniマルチ入力ベースの生成O-OO3~15秒9:16, 16:9, 1:1720p~4K対応
Gemini Omni Flash画像・ビデオ参照 + 自動オーディオO-OO10秒9:16, 16:9現在提供されている情報はありませんプロンプトベースで自動
Veo 3.1 Proフレーム・参照ベース + 自動オーディオOOO-4~8秒9:16, 16:9720p, 1080pプロンプトベースで自動
Veo 3.1 Fast高速なフレーム・参照ベースの生成OOO-4~8秒9:16, 16:9720p, 1080pプロンプトベースで自動
Veo 3.1 Liteシンプルな開始・終了フレーム生成OO--4~8秒9:16, 16:9720p, 1080pプロンプトベースで自動

Seedance 2.0 Series

開始・終了フレームや参照画像を使わず、プロンプトを中心に映像を生成し、長さと比率を幅広く自分で設定する作業に適しています。

4~15秒9:1616:91:121:94:33:4

Seedance 2.0 Mini

480p・720p に対応する軽い構成。素早くテストしたり、低い解像度のラフ案を作ったりするときに活用しやすいです。

Seedance 2.0 Fast

480p・720p に対応。繰り返し生成と素早い制作の流れに活用しやすいオプションです。

Seedance 2.0

480p から 4K まで対応しており、同じ生成方式でより高い出力解像度が必要なときに適しています。

Kling 2.6 / Kling 3.0

映像の最初のシーンと最後のシーンを画像で直接指定する作業に特化した構成です。どちらのモデルも画面比率を個別に選ばず、開始フレーム画像の比率に従います。

Kling 2.6

開始と終了のシーンを決めた映像

5~15秒の長さと 720p・1080p に対応します。開始・終了フレームを使ってシーン変化の方向を設計するときに適しています。

5~15秒
Kling 3.0

フレーム制御 + 最大 4K

3~15秒の長さと最大 4K に対応します。開始・終了シーンの制御と高い出力解像度の両方が必要なときに適しています。

3~15秒4K

Kling Omni

開始フレームだけでなく、参照画像や既存のビデオも入力として使えるため、複数のメディアを参考にする映像生成に特化しています。

マルチ入力ベースの映像生成

開始画像、参照画像、ビデオ入力を組み合わせて使えるため、1 枚の画像より多くの制作情報をモデルに渡す必要がある場合に適しています。

Video Input3~15秒9:16 / 16:9 / 1:1最大 4K

Gemini Omni Flash

開始フレーム、参照画像、ビデオ入力を組み合わせて活用しながら、プロンプトをもとにオーディオまで自動生成する映像制作に適しています。

マルチ入力 + 自動オーディオ

10 秒の映像として生成され、9:16 と 16:9 の比率に対応します。音声は個別の On/Off ではなく、入力したプロンプトをもとに自動生成されます。

Video Input10秒9:16 / 16:9Audio Auto

Veo 3.1 Series

開始・終了フレームを指定し、プロンプトをもとにオーディオまで一緒に生成する作業に適しています。Pro と Fast は参照画像も使え、Lite はよりシンプルな入力構成になっています。

Veo 3.1 Pro

フレーム + 参照画像 + 自動オーディオ

開始・終了フレームと参照画像を組み合わせて使う映像制作に適しています。

Veo 3.1 Fast

高速なフレーム・参照ベースの生成

Pro と同じ入力構成を使いながら、素早い繰り返し制作を考えるときに選びやすい構成です。

Veo 3.1 Lite

シンプルな開始・終了フレーム生成

参照画像を使わず、開始・終了フレームとプロンプトを中心に映像を作るときに適しています。

共通: 4~8秒 · 9:16 / 16:9 · 720p / 1080p · プロンプトベースのオーディオ自動生成

作業目的別のおすすめ

縦・横・正方形などさまざまな比率が必要です。

6 種類の比率に対応しており、コンテンツのチャンネルごとにさまざまな画面構成が必要なとき

Seedance 2.0 Series

最初のシーンから特定の最後のシーンへ変化させたいです。

開始フレームと終了フレームを明確に指定する必要があるとき

Kling 2.6 / 3.0

画像と既存の映像の両方を参考にさせたいです。

参照画像とビデオ入力を組み合わせて活用する必要があるとき

Kling Omni · Gemini Omni Flash

映像に合った音声まで一度に作りたいです。

プロンプトをもとに映像とオーディオを一緒に構成したいとき

Veo 3.1 · Gemini Omni Flash

最大 4K の解像度が必要です。

高い出力解像度が必要な最終成果物

Seedance 2.0 · Kling 3.0 · Kling Omni

最大 15 秒の比較的長いクリップが必要です。

1 回の生成で最大 15 秒の映像クリップを作りたいとき

Seedance · Kling Series

ビデオノードでモデルを選ぶ

実際の映像生成は Node Canvas のビデオノードで行います。モデルを選ぶと、そのモデルが対応する入力スロットと長さ、比率、解像度、音声のオプションが自動で切り替わります。

ビデオノードと AI Models の役割

ビデオノードでは実際の入力の接続と生成方法を案内し、AI Models・ビデオモデルではモデルごとの特化領域と選択基準を比較します。

よくある質問

どのモデルが一番よいですか?

1 つのモデルがすべての作業に最適というわけではありません。必要な入力方式、映像の長さ、画面比率、解像度、オーディオの生成方式を基準に選ぶことをおすすめします。

開始フレームと終了フレームの両方を使うにはどのモデルを選べばよいですか?

Kling 2.6、Kling 3.0、Veo 3.1 Pro、Veo 3.1 Fast、Veo 3.1 Lite が開始・終了フレームに対応しています。

参照画像とビデオを一緒に使えますか?

Kling Omni と Gemini Omni Flash では、参照画像とビデオ入力を一緒に使用できます。

4K に対応しているモデルはどれですか?

現在の Klipse では、Seedance 2.0、Kling 3.0、Kling Omni が最大 4K の解像度に対応しています。

映像と一緒に音声を自動で作れますか?

Gemini Omni Flash と Veo 3.1 系列は、プロンプトをもとにオーディオを自動生成します。