project
Granite 3.1 - IBMの新しい言語モデル
Granite 3.1は、IBMの次世代言語モデルであり、強力なパフォーマンスと拡張されたコンテキスト処理機能を誇ります。Granite 3.1モデルファミリーには、4つの異なるサイズと2つのアーキテクチャ(高密度2Bモデルと8Bパラメトリックモデル)が含まれています。
Granite 3.1とは何ですか?
Granite 3.1 は IBM の次世代言語モデルで、強力なパフォーマンスと拡張されたコンテキスト処理機能を誇ります。Granite 3.1 モデルファミリーには、4 つの異なるサイズと 2 つのアーキテクチャがあります。合計 12 兆トークンを使用してトレーニングされた、密な 2B および 8B パラメータモデルと、合計 10 兆トークンを使用してトレーニングされた、それぞれ 400M および 800M の活性化パラメータを持つ疎な 1B および 3B MoE モデルであるエキスパートハイブリッド MoE モデルです。Granite 3.1 は、最大 128K トークンのコンテキスト長をサポートし、複雑なテキストやタスクを処理できます。Granite 3.1 では、12 言語をカバーする新しい埋め込みモデルが導入され、多言語サポートが強化されています。Granite Guardian 3.1 モデルは、関数呼び出しの錯覚検出機能を備えており、ツール呼び出しの制御と可視性を向上させます。
Granite 3.1の主な特徴
- 拡張コンテキストウィンドウコンテキストウィンドウが128Kトークンに拡張されたことで、モデルはより大きな入力を処理し、より長い連続したやり取りを実行し、各出力により多くの情報を組み込むことができるようになりました。
- まったく新しい埋め込みモデル検索に最適化された新しいGranite Embeddingモデルシリーズをご紹介します。これらのモデルは、30Mから278Mまでのさまざまなパラメータサイズを提供し、12種類の言語に対応した多言語サポートも提供します。
- 関数呼び出し錯覚検出Guardian 3.1では、8Bモデルと2Bモデルにおけるツール呼び出しの錯覚を検出する機能が追加され、ツール呼び出しを行うエージェントに対する制御と監視が強化されました。
Granite 3.1の技術的原理
- 大規模言語モデル(LLM)大規模な言語モデルの構築に基づき、深層学習と自然言語処理技術を用いて訓練を行い、自然言語テキストを理解・生成する。
- トランスフォーマーアーキテクチャテキスト内の長距離依存関係を捉えるには、トランスフォーマーアーキテクチャを使用します。
- コンテキストウィンドウコンテキストウィンドウを12万8千トークンに拡張することで、モデルはより多くの情報を同時に考慮し、より長いテキストを処理し、より複雑なタスクを実行できるようになります。
- 多言語対応訓練済みのモデルは複数の言語を認識・理解することができ、12種類の言語でのテキスト処理をサポートします。
Granite 3.1プロジェクトの住所
- プロジェクト公式サイト:ibm-granite-3-1
- GitHubリポジトリ:https://github.com/ibm-granite/granite-3.1
- ハギングフェイスモデルライブラリ:https://huggingface.co/collections/ibm-granite/granite-31
Granite 3.1の応用事例
- 顧客サービス自動化チャットボットやバーチャルアシスタントを構築して、顧客からの問い合わせやサポートサービスを自動化し、応答速度と効率性を向上させる。
- コンテンツの作成と編集これは、記事、レポート、マーケティング資料などのテキストコンテンツの作成、編集、最適化をコンテンツ制作者に支援します。
- エンタープライズ検索とナレッジマネジメントセマンティック検索とベクトル検索技術に基づき、企業の内部知識検索システムを改善し、従業員が必要な情報を迅速に見つけられるように支援する。
- 言語翻訳とローカライズ多国籍企業向けの翻訳サービスおよびローカリゼーションプロジェクト。
- リスク管理とコンプライアンスチェック金融および法律分野では、大量の文書を分析・理解し、コンプライアンスとリスク管理を確保するのに役立ちます。