Amazon Nova - テキスト、画像、動画の生成を網羅する、Amazonの新しい大規模モデルシリーズ。
Amazon Novaは、Amazon Web Services(AWS)が提供する次世代AI基盤モデル群であり、業界最高水準のパフォーマンスとコスト効率を実現します。このファミリーには、テキスト処理に特化したAmazon Nova Microと、マルチモーダルアプリケーション向けのAmazon Novaが含まれます。
Amazon Novaとは何ですか?
Amazon Novaは、Amazon Web Services(AWS)が提供する次世代AI基盤モデル群であり、業界をリードするパフォーマンスとコスト効率を実現します。このファミリーには、Amazon Nova Micro(テキスト処理用)、Amazon Nova LiteおよびAmazon Nova Pro(マルチモーダル)、Amazon Nova Premier、Amazon Nova Canvas(画像生成用)、Amazon Nova Reel(動画生成用)が含まれます。これらのモデルは、テキスト、画像、動画コンテンツを理解および生成でき、200以上の言語をサポートし、カスタマーサービス、コンテンツ作成、言語翻訳など、さまざまなアプリケーションシナリオに対応します。Amazon NovaはAmazon Bedrock上に構築されているため、特定のビジネスニーズに合わせてモデルをカスタマイズおよび改良し、タスクのパフォーマンスと効率を向上させることができます。
Amazon Novaのモデルシリーズと主な特徴
Amazon Nova Micro純粋なテキストモデル、128KBのコンテキストウィンドウ、最低のレイテンシ、最速の応答速度。
- テキスト処理これは、テキスト入力の処理とテキスト出力の生成に重点を置いています。
- 低遅延応答応答時間が速い。
- 低コスト高性能な言語理解、翻訳、推論、コード補完、ブレインストーミング、数学的問題解決を、コストを落として実現します。
- 高速生成生成速度は毎秒200タグを超えます。
- 多言語対応200以上の言語に対応しています。
- 微調整サポートテキスト入力による微調整に対応しています。
Amazon Nova Lite30万のコンテキストウィンドウを備えた低コストのマルチモーダルモデルで、画像、動画、テキスト入力を高速に処理できます。
- マルチモーダル処理画像、動画、テキスト入力を高速処理します。
- 幅広いタスクへの適応性幅広いインタラクティブなアプリケーションや大量処理アプリケーションに適しており、特にコストが重要な要素となるシナリオに最適です。
- 多言語対応200以上の言語に対応しています。
- 微調整サポートテキスト、画像、動画入力の微調整をサポートします。
Amazon Nova Proマルチモーダルモデル、30万のコンテキストウィンドウ、精度、速度、コストのバランスを取り、動画の理解とクリエイティブな素材の生成が可能。
- マルチモーダルモデル精度、速度、コストの最適なバランスを提供します。
- タスクの幅動画要約、質問応答、数学的推論、ソフトウェア開発、複数ステップのワークフローを実行するAIエージェントなど、さまざまなタスクに適しています。
- 業界トップクラスのスピードとコスト効率テキストおよび画像認識のベンチマークテストにおいて、非常に優れた性能を発揮した。
- 多言語対応200以上の言語に対応しています。
- 微調整サポートテキスト、画像、動画入力の微調整をサポートします。
Amazon Nova PremierマルチモーダルAIモデルは、複雑な推論タスクを実行する。
- 複数の入力を処理するテキスト、画像、動画(音声を除く)の入力に対応しており、文書間の理解、視覚分析、動画の要約、または複数のモードの組み合わせを含むワークフローに適しています。
- 長時間のコンテキスト処理最大100万トークンのコンテキスト長をサポートしているため、非常に長いドキュメントや大規模なコードベースも処理できます。
- 深い文脈理解状況を深く理解する必要のある複雑な業務を処理する能力に長けている。
- 複数段階の計画と実行複数のツールやデータソースにわたって、複数段階の計画を実行し、タスクを正確に実行することができます。
- 複数エージェント間の協調を調整するこれは、ワークフロー全体を調整する監視エージェントとして機能し、複雑なタスクをサブタスクに分解して異なるサブエージェントに割り当て、その後、結果を統合して最終的な応答を形成することができます。
- 教師の模範としてAmazon Bedrockのモデル蒸留機能を使用すると、機能を小型モデル(Nova Pro、Lite、Microなど)に移行して、より小型で高速かつコスト効率の高いモデルを作成できます。
Amazon Nova Canvas画像生成と編集をサポートし、配色やレイアウトの制御機能を提供する画像生成モデル。さらに、追跡可能な透かしや有害コンテンツの生成を制限するためのコンテンツモデレーションといったセキュリティ制御機能を内蔵している。
- 画像生成テキストや画像プロンプトからプロ品質の画像を作成します。
- 編集機能使いやすい機能を備えており、テキスト入力による画像編集や、配色やレイアウトの調整が可能です。
- AIの安全かつ責任ある利用安全かつ責任あるAI利用のための組み込みサポート。
Amazon Nova Reelキーワードまたはオプションの参照画像に基づいて動画を生成できる動画生成モデル。6秒この動画機能を使うと、ユーザーはカメラの動きを調整して、パンニング、360度回転、ズームなどの効果を加えた動画を作成できます。
- ビデオ生成テキストと画像から高品質な動画を作成します。
- 自然言語プロンプト自然言語による指示で、カメラの動きの制御を含め、視覚的なスタイルやリズムをコントロールできます。
- AIの安全かつ責任ある利用安全かつ責任あるAI利用のための組み込みサポート。
Amazon Novaの技術的原則
- ディープラーニングとニューラルネットワークディープラーニングアーキテクチャ、特にTransformerモデルに基づいたディープラーニングモデルであり、シーケンスデータの処理に優れ、言語翻訳、テキスト要約、質問応答システムなどのタスクで広く使用されています。
- マルチモーダル学習Amazon Nova LiteやAmazon Nova Proといったマルチモーダルモデルは、テキスト、画像、動画など、さまざまな種類のデータ入力を処理し、理解することができます。これらのモデルの目標は、異なるモダリティ間の関係性を学習し、統合することです。
- 事前学習と微調整このモデルはまず、言語処理や画像認識といった基本的なタスクを学習するために、大規模なデータセットを用いて事前学習されます。その後、さらに微調整を行うことで、特定のアプリケーションシナリオや顧客データに合わせてモデルを最適化します。
- 検索拡張生成(RAG)RAG技術を情報検索・生成手法と組み合わせることで、より正確な情報と応答を提供できます。
- 自然言語理解(NLU)自然言語理解(NLU)技術を用いて、意図認識、感情分析、固有表現認識などを含む自然言語入力の解析と理解を行う。
Amazon Novaプロジェクトの住所
- プロジェクト公式サイト:aws.amazon.com/cn/ai/generative-ai/nova
Amazon Novaのアプリケーションシナリオ
- カスタマーサービスとサポートAmazon Nova ProまたはAmazon Nova Liteは、顧客からの問い合わせに対応し、自動化された顧客サポートと回答を提供します。
- コンテンツの作成と編集Amazon Nova CanvasとAmazon Nova Reelは、広告、ソーシャルメディア、デジタルマーケティング向けの画像および動画コンテンツを生成または編集します。
- 言語翻訳とローカライズAmazon Nova MicroまたはAmazon Nova Liteは、企業がコンテンツをローカライズする際に役立つ言語翻訳ツールとして利用できます。
- データ分析と洞察Amazon Nova Proは、動画、グラフ、文書を分析し、意思決定を支援するための重要な情報と洞察を抽出します。
- ソフトウェア開発とコード生成Amazon Nova Microは、コード補完やデバッグなど、ソフトウェア開発を支援します。