project
Wan2.7-Video - Alitongyiが発表したAI動画作成モデル
Wan2.7-Videoは、アリババ傘下のTongyi Labが開発したAI動画作成モデルで、テキスト、画像、動画、音声など、あらゆる形式の入力に対応しています。このモデルは従来の動画生成の制約を打ち破り、写真編集のように動画のローカル編集を可能にします。
WAN2.7ビデオとは何ですか?
Wan2.7-Videoは、アリババ傘下のTongyi Labが開発したAI動画制作モデルで、テキスト、画像、動画、音声など、あらゆる形式の入力に対応しています。従来の制作における制約を打破し、部分編集、セリフやアクションの調整、カメラワークの再現、ストーリーの継続など、「写真編集のような動画編集」を可能にする、完全な制作プロセスを実現します。Wan2.7-Videoは、5人の主要キャラクターとマルチグリッドのストーリーボードを制御でき、「ドラマコア」を用いてプロ仕様のストーリーボード作成、40種類以上の表情、映画のようなカメラワークを実現することで、プロレベルの動画制作への参入障壁を大幅に低減します。
Wan2.7-Videoの主な機能
-
正確なローカル編集ユーザーは、コマンドを使用して要素を追加または削除したり、オブジェクトを置き換えたり、属性を変更したりすることで、ビデオフレームに対して局所的な調整を行うことができ、編集された照明や素材は元のビデオに自然に統合されます。
-
環境スタイルの変化キャラクターの動きはそのままに、背景の季節をワンクリックで切り替えたり、フェルトウールやサイバーパンクといった多様なアートスタイルに画像を変換したりできるシステムです。
-
撮影方法の変更最初からやり直す必要はありません。ユーザーはコマンドを与えるだけで、キャラクターのセリフを調整したり、口の動きや感情を合わせたり、動作を変更したり、カメラアングルやショットの種類を変更したりできます。
-
プロット継続制御最初と最後のフレームを継続機能と組み合わせることで、このモデルはビデオのダイナミクスの自然な連続性を維持しながら画面構造を正確に制御することができ、それによってストーリーのシームレスな接続と拡張を実現します。
-
クリエイティブなクイックレプリケーションこのシステムは、元のビデオのモーションシーケンス、カメラワーク、またはスタイル効果を保持し、それらを新しいシーンに適用することをサポートしており、ダイナミックなクリエイティブアイデアをワンクリックで迅速に再利用できます。
-
マルチエージェントの役割制御最大5人までの被写体について、画像、動画、音声の参照データをアップロードでき、キャラクターの外見と固有の声を正確に固定し、複数のショット間で特徴の一貫性を高く保つことができます。
-
ストーリーボードコントロールマルチグリッド参照画像を利用することで、ユーザーはストーリーの方向性、カメラアングル、キャラクター設定を正確に制御し、ストーリーボードレベルでの精密な実行を実現できます。
-
インテリジェントなスクリプト生成プロの脚本を深く学習することで、このモデルはユーザーのたった一つの創造的なアイデアに基づいて、劇的で論理的に一貫性のあるストーリーボードを自動的に生成することができる。
-
シネマティックスタイルコントロールシーンの中核となる要素に基づいて、対応する照明、撮影、および色彩パラメータを直接生成し、数千もの映画的なスタイルを自由に組み合わせることを可能にし、複数のレンズ間で一貫性を維持します。
-
プロのカメラ操作このシステムは、ヒッチコックズームやライジングリベレーションといった複雑な合成カメラ技術を正確に実行できる。
-
繊細な表情と声40種類以上の細分化された表情表現をサポートし、正確な線と鮮やかで自然な音を生成し、オーディオビジュアル同期技術によって高品質なプロフェッショナルなパフォーマンスを実現します。
Wan2.7-Videoの使い方
- アリババクラウドの100の改良Alibaba Cloud Bailianにアクセスしてモデルプラザに入り、Wanシリーズのモデルを選択してAPIを呼び出すか、Web上で体験してください。
- 万郷公式サイト同義万祥の公式サイトにアクセスすると、制作用の素材を直接アップロードできる視覚的なインターフェースが提供されます。
- 使用方法テキスト、画像、動画、音声といったあらゆる形式の入力に対応し、自然言語コマンドによって画面構造、プロットの方向、局所的な詳細、時間的な変化を制御することで、生成、編集、複製、継続といった制作プロセス全体を実現します。
Wan2.7-Videoの主要情報と使用要件
-
開発チームアリババ同義研究所
-
製品ポジショニング生成、編集、複製、継続、再構成といった全プロセスを網羅するAIビデオ制作スイート。
-
入力モードテキスト、画像、動画、音声を含む、あらゆるモーダル入力に対応しています。
-
メインコントロール最大5人の被写体をサポートし、顔の特徴や固有の声をロックすることで、複数のカメラ間で一貫性を保つことができます。
-
中核となる能力正確なローカル編集、プロット/セリフ/カメラ位置の変更、モーションカメラの動きの再現、プロットの継続、ストーリーボードパネルの制御。
-
パフォーマンス能力40種類以上の細分化された表情、正確な対話生成、自然なサウンド、そして音声と映像の同期をサポートします。
-
カメラの動きのサポート数十種類の基本的なカメラワーク(プッシュ、プル、パン、チルトなど)と、複合的なカメラワーク(ヒッチコックズーム、ライジングリビール、その他の映画的手法)。
-
アクセスチャネルAlibaba Cloud Bailian または Wanxiang 公式ウェブサイト
-
操作方法自然言語によるコマンド制御。プログラミングの知識は不要です。
WAN2.7-Videoの主な利点
-
マルチモーダル入力融合テキスト、画像、動画、音声入力のあらゆる組み合わせに対応しており、画面構成、ストーリー展開、細部、時間的変化などを包括的に制御できます。
-
プロセス全体の作成を網羅動画制作から部分的な編集、クリエイティブな複製、ストーリーの継続、キャラクターの再構築まで、クリエイティブプロセス全体を網羅する包括的なツールセットを提供し、複数のプラットフォームを切り替える必要性を排除します。
-
正確なローカル編集従来の再生成モードを打破し、コマンドレベルでの要素の追加・削除、オブジェクトの置換、属性の変更をサポートします。編集エリアの照明や素材は元の動画と自然に統合されるため、動画編集が写真編集と同じくらい簡単になります。
-
撮影の筋書きはコントロール可能最初からやり直すことなく、コマンドを使ってキャラクターのセリフを調整したり(口の動きや音色を自動的に一致させたり)、アクションを変更したり、カメラアングルやショットの種類を変更したりできるため、柔軟な二次創作が可能になります。
-
複数被験者の一貫性最大5人の被写体の外見と声を固定できるため、同じキャラクターが複数のショットで非常に一貫した特徴を持ち、各キャラクターが独自の声の演技を持つことが保証されます。
Wan2.7-Videoと類似の競合製品との比較
| 比較対象寸法 | Wan2.7-Video | Runway Gen-4 | クアイショウ クリン 2.6 |
|---|---|---|---|
| 開発者 | アリ・トンイ研究室 | 滑走路(アメリカ) | 快手大型模型チーム |
| オープンソース | Apache 2.0 オープンソース | クローズドソースのサブスクリプションモデル | クローズドソース(国内版/国際版) |
| 動画の長さ | 最大15秒 | 最大持続時間:16秒(第3世代) | 最大3分(延長可能) |
| 中核的な利点 | 全工程を制御可能な制作(編集/複製/継続) | プロフェッショナルなツールチェーンと精密モーションコントロール | モーションコントロールと超長時間ビデオ生成 |
| 役割の一貫性 | 最大5つの被写体をロックでき、複数のレンズ間で一貫した外観と音声が得られます。 | キャラクターの一貫性機能、複数のカメラに対応 | 性格特性はよく維持されている。 |
| モーションコントロール | 40種類以上の表情に対応し、動作参照と再現をサポートします。 | モーションブラシ動きの軌道を正確に制御する | 最強3~30秒の動画でダンスや武道を正確に再現 |
| 動画編集 | 最強部分的な追加、削除、変更、およびダイアログの変更をサポートします。 | Magic Tools(グリーンスクリーン、復元、再描画) | 基本的な編集機能 |
| 生産コスト | 最低(高速版:約0.01~0.02ドル/秒) | 高い(約0.25~0.50ドル/秒、月額12~28ドル) | 中級(プロ向け:約0.48~0.95ドル/秒) |
| テキスト生成 | 読みやすいテキストの生成をサポートします | サポート | テキスト生成をサポート |
| ストーリーボードコントロール | マルチグリッドストーリーボード劇の核心がストーリーボードを左右する | ディレクターモード | ストーリーボードの操作が制限される |
| 適用可能なシナリオ | 映画やテレビ番組のプロ仕様のプレビジュアライゼーション、複数キャラクターが登場するストーリーライン、および広告の反復制作。 | ハリウッドレベルのコマーシャル、ファッションショートフィルム、プロフェッショナルな映画ポストプロダクション | 短い動画の動きの複製、長い動画の生成 |
WAN2.7ビデオのアプリケーションシナリオ
-
映画およびテレビコンテンツ制作低予算のインディペンデント映画、短編映画、アニメーションの制作においては、ストーリーボードを通して脚本を素早く視覚化したり、正式な撮影前にダイナミックなプリプロダクションやショットテストに活用したりすることができる。
-
ショートビデオとソーシャルメディアクリエイターは、ストーリーライン、衣装、特殊効果といった要素を盛り込んだ短い動画を素早く作成でき、人気のカメラワークや複数キャラクターによるストーリーテリングの再現をサポートし、Douyin、Kuaishou、Instagramなどのプラットフォームのコンテンツニーズに対応できます。
-
広告およびeコマースマーケティング製品紹介ビデオを迅速に生成・反復できる機能。部分的な編集に対応し、製品要素の置き換え、カメラ位置の調整、マルチアングル仮想モデル表示、ナレーションの提供などが可能。
-
教育・研修分野教育デモンストレーションビデオの作成、歴史的場面の復元、実験プロセスの視覚化が可能であり、プロット継続機能を通じて、一貫性のある知識説明のシーケンスを構築できる。
-
音楽とエンターテイメントミュージックビデオの制作プロセスでは、特定の様式化されたビジュアル(フェルトウールやサイバーパンクなど)を実現し、ダンスの動きを再現し、カメラワークの参考情報を提供し、複数のカメラアングルにわたってバーチャルシンガーの一貫したパフォーマンスを保証します。