project
Keling O1 - Keling AI初の統合型マルチモーダル動画生成モデル
Keling O1(Keling Video O1 Model)は、Keling AIが開発した世界初の統合型マルチモーダル動画生成モデルです。このモデルは、革新的なマルチモーダル視覚言語(MVL)アーキテクチャを通じて、動画の生成、編集、理解をシームレスに統合します。
Keling O1とは何ですか?
Keling O1(Keling Video O1 Model)は、Keling AIが開発した世界初の統合型マルチモーダル動画生成モデルです。革新的なマルチモーダル視覚言語(MVL)アーキテクチャにより、動画の生成、編集、理解をシームレスに統合しています。画像、動画、テキストなどのマルチモーダル入力に対応し、多様なクリエイティブ編集を可能にするとともに、動画の一貫性という課題を解決し、多彩なクリエイティブな組み合わせを提供します。ユーザーはシンプルな対話を通じて正確な動画コンテンツを生成し、無限の創造的可能性を探求できます。
Keling O1モデルの最新アップグレードでは、720pモードが追加され、3~10秒のフリーナレーションに対応することで、制作におけるコントロール性と自由度が向上しました。
Keling O1の主な機能
-
万能エンジンKeling O1は、世界初の統合型マルチモーダルビデオモデルであり、複数のツールを切り替えることなく、ビデオの生成、編集、修正といった制作プロセス全体をワンストップで完了できます。
-
全能の命令画像、動画、テキストなど、マルチモーダルな入力に対応しています。高度な意味理解により、ユーザーは簡単な会話を通して動画コンテンツを容易に作成・編集できます。
-
総合的な参考資料複数の視点から被写体を構成し、複数の被写体を自由に組み合わせることで、映像の一貫性の問題が解決され、カメラの動きに関わらず、映像の正確性と一貫性が保たれる。
-
スーパーコンビネーション被写体の追加と背景の変更を同時に行うなど、さまざまなスキルを組み合わせて使用することをサポートし、複数の創造的なバリエーションを一度に生成し、無限の創造的可能性を探求することを可能にします。
-
リズムをコントロールする3秒から10秒までの動画に対応しており、ユーザーは動画のテンポを自由にコントロールできます。
-
720pモードを追加しましたオリジナルの1080pコア機能は維持しつつ、軽量なコンテンツ制作に適した新しい720pモードが追加され、必要な機材も削減されました。
-
自由な物語の長さ最初と最後のフレームは3~10秒の自由なナレーションに対応しており、固定の長さ制限を打破します。クリエイターは動画の開始と終了の長さを自由に設定できるため、創作の柔軟性が向上します。
Keling O1の技術原理
-
新世代ビデオモデル従来のビデオモデルにおける機能的な断片化から脱却し、マルチモーダルな理解のためにマルチモーダル・トランスフォーマーとマルチモーダル・ロング・コンテキストを統合した、新たな生成基盤が構築される。
-
マルチモーダル視覚言語(MVL)MVLをインタラクション媒体として導入することで、Transformerを介してテキストの意味論とマルチモーダル信号の深い統合を実現し、単一の入力ボックス内で複数のタスクを柔軟かつシームレスに統合することを可能にします。
-
知的な推論能力MVL入力に基づき、本モデルは正確なマルチモーダル参照と非常に柔軟なインタラクティブ編集を実現し、長文のコンテキストや時間的な物語をサポートします。思考連鎖技術と組み合わせることで、本モデルは常識的な推論能力と事象推論能力を備え、動画生成において優れた性能を発揮します。
Keling O1のパフォーマンス
-
画像参照タスク:画像参照タスクにおいて、このモデルは247%という総合勝率を達成し、総合結果と複数のサブディメンションの両方において優れた性能を示した。Google Veo 3.1の「Ingredients to Video」と比較すると、Video O1モデルは画像参照タスクにおいて大幅に優れた性能を発揮します。
-
指示翻訳タスク:指示変換タスクにおいて、このモデルは全体的な勝敗率230%を達成し、全体的な結果と複数のサブディメンションの両方で優れたパフォーマンスを示した。Runway Alphと比較すると、このモデルは命令変換タスクにおいても大幅に優れた性能を発揮する。
Keling O1の使い方
- アクセスプラットフォームKelingの公式サイトまたはKelingアプリにアクセスして、ユーザーアカウントの登録とログインを完了してください。
- モデルを選択プラットフォーム上でビデオO1モデルを選択してください。
- 資料をアップロードする必要に応じて、参考画像、動画クリップ、テキストによる説明、その他の資料をアップロードしてください。
- 入力コマンドマルチモーダル指示入力エリアを使用して、作成指示を入力してください。
- ビデオを生成するこのモデルは、提供された素材と指示に基づいて動画を生成します。動画の長さは、3~10秒など、指定可能です。
- 編集と調整モデルに搭載されている編集機能(動画コンテンツの追加、削除、変更、撮影タイプ/視点の切り替えなど)を使用してください。
- プレビューとエクスポート生成された動画をプレビューして、要件を満たしていることを確認してください。問題がなければ、動画をローカルデバイスにエクスポートしてください。
Keling O1の応用事例
- ソーシャルメディアコンテンツの作成ユーザーは、TikTokやInstagramなどのソーシャルメディアプラットフォームに適した短い動画を素早く作成し、個人的な共有やブランドマーケティングに活用できます。
- オンライン教育とトレーニング教育者は、インタラクティブなビデオコースや研修教材を作成することで、遠隔学習の魅力と効果を高めることができる。
- 広告およびマーケティングビデオ企業やマーケティングチームは、製品プロモーションやブランド構築のために、魅力的な広告動画を作成する際にモデルを活用しています。
- 映画およびビデオ制作映画制作者やビデオ編集者は、ストーリーボードの作成、コンセプトの検証、アニメーション効果の作成など、プリプロダクションの段階でモデルを使用します。
- 企業プロモーションおよびデモンストレーション企業は、企業紹介、製品デモンストレーション、イベントレポートなどに使用するために、高品質のプロモーションビデオやデモンストレーションビデオを制作し、それによって企業イメージを高めている。