Video Models
T2V / I2V、参照画像、音声、リップシンクなど、動画制作に必要な機能を同じ基準で比較します。
| モデル | プロバイダ | T2V | I2V | 参照画像* | 音声 | リップシンク | 最大長 | 解像度 | 概算コスト/秒 |
|---|---|---|---|---|---|---|---|---|---|
| Kling 3.0 V3 Standard | kuaishou | ○ | ○ | ○ | ○ | ○ | 15s | 720p | $0.0840/s |
| Kling 3.0 V3 Pro | kuaishou | ○ | ○ | ○ | ○ | ○ | 15s | 1080p | $0.1120/s |
| Seedance 2.0 | bytedance | ○ | ○ | ○ | ○ | ○ | 15s | 480p, 720p, 1080p, 4k | $0.3034/s |
| Veo 3.1 | ○ | ○ | ○ | ○ | ○ | 8s | 720p, 1080p, 4k | $0.2000/s | |
| Veo 3.1 Lite | ○ | ○ | ○ | ○ | — | 8s | 720p, 1080p | $0.0300/s |
kuaishou · kling
Kuaishou の最新 I2V モデル Standard 版。720p 出力。コスト効率と品質のバランス。
kuaishou · kling
Kuaishou の最新高品質 I2V モデル Pro 版。1080p 出力。720p 比較には Standard を使用。
bytedance · seedance
ByteDance のネイティブ音声対応動画生成モデル。カメラ制御と物理演算に強い。
google · veo
Google の最新動画生成モデル。物理・人体動作の自然さに強い。
google · veo
Veo 3.1 のコスト効率版。Lite で十分な品質が出れば圧倒的に安い。
* 参照画像は任意の補助入力(スタイル・キャラクター・被写体の維持)。I2V は必須の入力画像(変換元)です。