動画モデル
動画モデル
Nodaro で実行できるすべての動画モデルと、それぞれの機能とクレジット料金の一覧です。
Nodaro では 62 個の動画モデルを実行できます。各行のリンク先ページで、モデルの設定、クレジット料金、プロンプトのコツを確認できます。
MiniMax
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Hailuo 02 I2V Pro | MiniMax | 画像から動画、テキストから動画 | 143 | Hailuo 02 Pro は、フォトリアルな動きに優れ、クリップの長さは 5 秒固定です。終了フレームに対応しています。 |
| minimax-h3 | MiniMax | 画像から動画、テキストから動画 | 230 から | MiniMax Hailuo 3 はプレミアムなマルチモーダルのティアで、最初と最後のフレームに加えて画像/動画/オーディオのリファレンスを使え、ネイティブオーディオに対応し、2K(デフォルト)または 768P で出力し、長さは 4〜15 秒で料金は秒単位です。 |
| Hailuo 2.3 Pro | MiniMax | 画像から動画 | 130 から | Hailuo 2.3 Pro は、768P と 1080P の解像度に対応した新しい Hailuo です。 |
| Hailuo 2.3 Standard | MiniMax | 画像から動画 | 75 から | Hailuo 2.3 のより安価なティアで、基本的な品質は良好です。 |
| Hailuo 02 Standard | MiniMax | 画像から動画、テキストから動画 | 75 から | Hailuo 02 Standard は、終了フレームに対応した経済的な選択肢です。 |
Google
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| VEO 3.1 Quality | Google | 画像から動画、テキストから動画 | 930 から | Google の VEO 3.1 Quality で、プレミアムなシネマティック動画を作ります。クリップは 4/6/8 秒で、終了フレームを任意で指定でき、ネイティブオーディオに対応しています。リファレンスから動画を作るモードはありません(Fast と Lite のみにあります)。料金は長さに関係なく、1 回の生成ごとに一律です。 |
| VEO 3.1 Fast | Google | 画像から動画、テキストから動画 | 150 から | VEO 3.1 Fast は VEO 3.1 の安価なティアで、オーディオ付きの 4/6/8 秒のクリップを作ります。ほとんどの用途でバランスの良い選択です。料金は長さに関係なく、1 回の生成ごとに一律です。 |
| VEO 3.1 Lite | Google | 画像から動画、テキストから動画 | 75 から | VEO 3.1 Lite は、大量生成に向く、最もコスト効率の良い VEO のティアです。オーディオ付きの 4/6/8 秒のクリップを作り、最初と最後のフレームに対応しています。 |
| Gemini Omni | Google | 画像から動画、テキストから動画 | 230 から | ネイティブオーディオ付きの Google のマルチモーダル動画モデルで、テキストや画像から動画を作れるほか、動画の編集もできます。 |
| Gemini Omni Flash | Google | 画像から動画、テキストから動画 | 160 から | Google の Gemini Omni Flash は、より高速で安価な Omni のティアで、ネイティブオーディオ付きのマルチモーダル動画モデルとして、テキストや画像から動画を作れるほか、動画の編集もできます。 |
| VEO Extend | Google | 動画の延長 | 190 から | 既存の VEO 3.1 のクリップを、さらに 1 セグメント分延長します。 |
| VEO 1080p Upscale | Google | 動画のアップスケール | 20 | VEO の出力を 1080p にアップスケールします。 |
| VEO 4K Upscale | Google | 動画のアップスケール | 380 | VEO の出力を 4K にアップスケールします。 |
Kuaishou
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Kling 2.6 | Kuaishou | 画像から動画、テキストから動画 | 138 から | 画像から動画を生成する Kling 2.6 で、動きのリアルさに優れています。長さは 5 秒または 10 秒で、ネイティブオーディオを任意で付けられます。 |
| Kling 2.5 Turbo Pro | Kuaishou | 画像から動画、テキストから動画 | 110 から | より高速な Kling で、低コストで良好な品質が得られます。終了フレームに対応しています。 |
| Kling 3.0 | Kuaishou | 画像から動画、テキストから動画 | 270 から | プレミアムな Kling 3.0 で、長さは 3〜15 秒の間で変えられ、ネイティブオーディオに対応し、720P/1080P で出力します。 |
| Kling 2.1 Master | Kuaishou | 画像から動画 | 400 から | 画像から動画を生成する Master ティアのモデルで、シネマティックな品質に優れています。 |
| Kling 3 Omni | Kuaishou | 画像から動画 | 250 から | Kling 3 Omni は 3〜15 秒、720p/1080p に対応し、終了フレームとリファレンス画像を使えるほか、ネイティブオーディオにも対応しています。 |
| Kling 2.6 Motion Transfer | Kuaishou | モーション転送 | 80 から | 元になる動画の動きを、静止画の被写体に転送します。ベースは Kling 2.6 です。 |
| Kling 3.0 Motion Transfer | Kuaishou | モーション転送 | 150 から | Kling 3.0 によるプレミアムなモーション転送です。 |
| Kling Avatar Standard | Kuaishou | リップシンク | 280 | 静止画のポートレートを、元になるオーディオに合わせてリップシンクします。品質は標準です。 |
| Kling Avatar Pro | Kuaishou | リップシンク | 560 | プレミアムなリップシンクで、口の形とタイミングがより正確です。 |
xAI
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Grok Imagine (I2V) | xAI | 画像から動画 | 50 から | 画像から動画を生成する Grok のモデルで、スタイライズされた動きを作ります。長さは最大 15 秒です。 |
| Grok Imagine Video 1.5 | xAI | 画像から動画 | 295 から | 画像から動画を生成する Grok Imagine 1.5 で、1〜15 秒、480p/720p に対応し、料金は秒単位です。入力画像が必要です。 |
Bytedance
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Seedance 2 | Bytedance | 画像から動画、テキストから動画 | 230 から | Seedance 2 は、ネイティブオーディオ付きのプレミアムなティアです。料金は解像度ごとの秒単位です。 |
| Seedance 2 Fast | Bytedance | 画像から動画、テキストから動画 | 180 から | Seedance 2 の、より安価で高速なティアです。 |
| Seedance 2 Mini | Bytedance | 画像から動画、テキストから動画 | 120 から | Seedance 2 の低価格なティアで、480p/720p のみに対応し、料金は解像度ごとの秒単位です。 |
| Seedance 2.5 | Bytedance | 画像から動画、テキストから動画 | 340 から | Seedance 2.5 は、1 ショットで最大 30 秒を生成でき、ネイティブオーディオと幅広いマルチモーダルのリファレンスに対応しています。解像度は 480p/720p/1080p です。 |
| Bytedance Lite I2V | Bytedance | 画像から動画、テキストから動画 | 57 | 終了フレームに対応した、Bytedance の最も安価な動画ティアです。 |
| Bytedance Pro I2V | Bytedance | 画像から動画、テキストから動画 | 175 | Bytedance の Pro 動画ティアで、品質がより高くなります。 |
| Bytedance Pro Fast I2V | Bytedance | 画像から動画 | 90 | Bytedance Pro の、より高速なバリアントです。 |
| Seedance 2 Extend | Bytedance | 動画の延長 | 260 から | どんな動画でも延長でき、オーディオを含めて続きを生成し、トリミングしてつなぎ合わせて、継ぎ目のない 1 本のクリップにします。 |
| OmniHuman 1.5 | Bytedance | リップシンク | 1020 から | 静止画とオーディオから、プロンプトで演出できるプレミアムな話すアバターを作ります。720p または 1080p で、長さは最大 60 秒です。人物、ペット、アニメに対応しています。 |
Alibaba
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Wan 3.0 | Alibaba | 画像から動画、テキストから動画 | 160 から | Wan 3.0 はマルチモーダルなモデルで、最初と最後のフレーム、または画像/動画/オーディオのリファレンスを使え、ネイティブオーディオに対応し、480p/720p/1080p で 2〜30 秒の動画を作ります。 |
| Wan 3.0 Prime | Alibaba | 画像から動画、テキストから動画 | 250 から | Wan 3.0 Prime は Alibaba による Wan 3.0 の高速なティアで、マルチモーダルな入力と 2〜30 秒の範囲は同じまま、秒単位の料金が高い分、より早く仕上がります。 |
| Wan 2.6 I2V | Alibaba | 画像から動画 | 175 から | 画像から動画を生成する Wan 2.6 で、720p/1080p で 5/10/15 秒の動画を作ります。 |
| Wan 2.2 Turbo | Alibaba | 画像から動画、テキストから動画 | 100 から | 安価で高速な Wan turbo で、長さは 5 秒です。1 つの ID で、画像から動画とテキストから動画の両方に対応します。 |
| Wan 2.6 | Alibaba | 動画から動画、テキストから動画 | 175 から | Wan 2.6 は、1 つの ID でテキストから動画と動画から動画の両方に対応します。 |
| Wan Flash V2V | Alibaba | 動画から動画 | 100 | 動画から動画を生成する Wan の、より高速なバリアントです。 |
| Wan 2.7 VideoEdit | Alibaba | 動画から動画 | 320 | ガイド付きの動画編集で、リファレンス画像、オーディオの制御、プロンプトの拡張を任意で使えます。 |
| Wan 2.7 I2V | Alibaba | 画像から動画 | 188 | 画像から動画を生成する Wan 2.7 で、720p/1080p で 2〜15 秒の動画を作り、開始フレームと終了フレームに対応しています。 |
| Wan 2.7 T2V | Alibaba | テキストから動画 | 188 | テキストから動画を生成する Wan 2.7 で、720p/1080p で 2〜15 秒の動画を作ります。 |
Lightricks
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| LTX 2.3 Pro | Lightricks | 画像から動画、テキストから動画 | 40 から | Lightricks の LTX 2.3 Pro は、テキスト/画像/オーディオから最大 4K、6/8/10 秒の動画を作り、終了フレームまでの補間にも対応しています。 |
| LTX 2.3 Fast | Lightricks | 画像から動画、テキストから動画 | 180 から | Lightricks の LTX 2.3 Fast は、テキストや画像から 1080p で最大 20 秒の動画を作ります(2K と 4K では 6/8/10 秒)。オーディオの入力と延長には対応していません。 |
HappyHorse
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| HappyHorse 1.1 | HappyHorse | テキストから動画 | 282 | テキストから動画を生成する HappyHorse 1.1 で、720p/1080p で 3〜15 秒の動画を作り、21:9 や 9:21 を含む 9 種類のアスペクト比に対応しています。料金は秒単位です。 |
| HappyHorse 1.1 I2V | HappyHorse | 画像から動画 | 282 | 画像から動画を生成する HappyHorse 1.1 で、720p/1080p で 3〜15 秒の動画を作り、アスペクト比は入力画像から決まり、料金は秒単位です。 |
| HappyHorse 1.1 Ref2V | HappyHorse | 画像から動画 | 282 | リファレンスから動画を生成する HappyHorse 1.1 で、1〜9 枚のリファレンス画像を使って 720p/1080p で 3〜15 秒の動画を作り、料金は秒単位です。 |
| HappyHorse Edit | HappyHorse | 動画から動画 | 350 | HappyHorse の動画編集モデルで、動画から動画への変換を行い、最大 60 秒の動画を入力して 720p/1080p で出力します。 |
Runway
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Runway Gen-3 | Runway | 画像から動画、テキストから動画 | 30 | Runway Gen-3 です。720p/1080p で 5/10 秒の動画を作ります。 |
| Runway Aleph V2V | Runway | 動画から動画 | 350 | Runway Aleph で、動画から動画への変換を行います。 |
| Runway Extend | Runway | 動画の延長 | 320 | Runway の動画を、さらに 1 クリップ分延長します。 |
InfiniTalk
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| InfiniTalk | InfiniTalk | リップシンク | 110 から | 静止画から、オーディオに合わせて話すトーキングヘッドを作ります。解像度は 480p または 720p です。 |
Sync
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Sync Lipsync v3 | Sync | リップシンク | 1000 から | 既存の映像を吹き替え、唇の動きを新しいオーディオトラックに合わせ直します。動画を入力し、1 秒ごとに課金されます。 |
Volcengine
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Volcengine Lip Sync | Volcengine | リップシンク | 300 から | 動画から動画への AI 吹き替えで、唇の動きを新しいボーカルトラックに合わせ直します。ベーシックモードでは複数話者に対応します(シーン検出と話者の識別)。動画を入力し、1 秒ごとに課金されます。 |
Nodaro
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|
| Video Analysis (Fast) | Nodaro | 動画分析 | 181 から | 動画を分析して構造化されたショットリスト(シーン、カメラ、オーディオ)にする、高速でエコノミーなティアです。長さの区分ごとに課金されます。 |
| Video Analysis (Fast — legacy) | Nodaro | 動画分析 | 205 から | 高速ティアの旧分析モデルです(2026 年 7 月から 2026 年 7 月 29 日まで高速ティアを担っていました)。このモデルを直接指定した保存済みの設定が引き続き動作し、その識別子のまま料金が計算されるように残してあり、新しい高速ティアの実行には現在の高速モデルが使われます。 |
| Video Analysis (Pro) | Nodaro | 動画分析 | 217 から | 動画を分析して構造化されたショットリスト(シーン、カメラ、オーディオ)にする、より忠実度の高いデフォルトのティアです。長さの区分ごとに課金されます。 |
| Video Analysis (Mixed) | Nodaro | 動画分析 | 270 から | 最も高度な分析ティアで、複数の分析エンジンの結果を 1 つにまとめ、網羅性と正確さを最大限に高めます。長さの区分ごとに課金されます。 |
| Video Analysis (Smart) | Nodaro | 動画分析 | 414 から | 最も正確な分析で、動画の骨組みのネイティブな読み取りに補助的な分析を複数回組み合わせるハイブリッド処理を行い、統合した結果を毎回精査して、ショットの境界を見つけ、外見から出演者を特定します。ショットリストを再生成に使う場合に最適です。長さの区分ごとに課金されます。 |
| AI Audit | Nodaro | 動画の監査 | 215 から | 接続された分析結果と照らし合わせてクリップを見直し、動画で確認した修正を、安全策を設けて適用し、何を変更したかを明示したレポートを返します。長さの区分ごとに課金されます。 |
| AI Audit (with analysis run) | Nodaro | 動画の監査 | 396 から | AI Audit と同じ動画で確認する監査ですが、分析結果が接続されていない場合は先に高速な分析を自動で実行し、そのうえで安全策を設けて修正を適用し、変更内容を明示したレポートを返します。長さの区分ごとに課金されます。 |
最終更新