AB
AiBoss
project

Command A+ - Cohere Labsのオープンソースマルチモーダル大規模モデル

Command A+は、Cohere Labsが開発したオープンソースのマルチモーダル大規模モデルです。ハイブリッドエキスパートアーキテクチャを採用し、パラメータ総数は218バイトですが、活性化パラメータはわずか25バイトで、強力なパフォーマンスと推論効率のバランスが取れています。このモデルは、128Kの超長尺シーケンスをサポートしています。

Command A+とは何ですか?

Command A+は、Cohere Labsが開発したオープンソースのマルチモーダル大規模モデルです。合計218バイトのパラメータとわずか25バイトのアクティベーションパラメータを持つハイブリッドエキスパートアーキテクチャを採用し、強力なパフォーマンスと推論効率のバランスを実現しています。このモデルは、128Kバイトのコンテキストと48言語をサポートし、視覚理解、エージェントタスク実行、複雑な推論、機械翻訳機能をネイティブに統合しています。3つの量子化レベルを提供し、プライベート展開にはB200量子化シート1枚またはH100量子化シート2枚のみが必要です。このモデルは商用利用が可能で、さらに開発を進めることができるため、エンタープライズレベルのエージェントアプリケーション、検索結果の強化生成、マルチモーダルAIアプリケーションの理想的な基盤モデルとなります。

Command A+の主な機能

  • マルチモーダルエージェントツール呼び出しと複数ステップのエージェントタスクをネイティブにサポートし、ツールの使用と自律実行において最高のパフォーマンスを発揮します。
  • 視覚入力画像とテキストを組み合わせた入力をサポートし、画像とテキストの理解および生成を実現します。
  • 推論と翻訳組み込みの推論チェーンと、中国語、英語、フランス語を含む48言語に対応した世界最高水準の翻訳機能を搭載。
  • 長時間のコンテキスト処理入力コンテキストは128K、出力長は64Kで、長文のRAGや複雑なワークフローに適しています。
  • 効率的な展開プライベート環境での導入には、B200 GPU 1基またはH100 GPU 2基のみが必要で、コマンドA推論よりもレイテンシが30%低くなります。

Command A+の技術的原則

  • 教育省建築合計218B個のパラメータとわずか25B個の活性化パラメータを持つハイブリッドエキスパートアーキテクチャを採用し、パフォーマンスと推論効率のバランスを取っています。
  • 統一重量視覚、推論、翻訳、エージェント機能を単一のモデル重みに統合することで、複数のモデルを組み合わせる必要性を排除します。
  • RAGネイティブ最適化これは、Cohere Embed v3およびRerank 3.5と統合された検索強化生成スタックを形成し、ネイティブの引用追跡をサポートし、一般的なモデルよりも錯覚率が大幅に低い。

Command A+ の使い方

  • ダウンロード重量Hugging Face CLIツールを使用して、BF16、FP8、またはW4A4量子化バージョンのモデルファイルをローカルマシンにダウンロードします。
  • 変圧器の積載Hugging Face Transformersライブラリのパイプラインインターフェースを使用して、グラフテキスト推論用のモデルを直接ロードします。
  • vLLMの展開vLLMをインストールした後、サービスを開始するためのモデルパスを指定すると、APIエンドポイントがOpenAI互換形式で自動的に公開されます。
  • SGLangの導入SGLangをインストールしたら、推論サービスを開始してください。このサービスは、外部呼び出し用のOpenAI互換APIも提供します。
  • Dockerが実行中です依存関係を手動で設定する必要なく、ワンクリックでコンテナ化されたサービスを起動するために、Dockerコマンドを実行します。
  • API呼び出しローカルサービスに標準的なチャット完了リクエストを送信し、メッセージ本文にテキストや画像のURLを含めることで推論をトリガーできます。

Command A+の主な利点

  • 企業レベルの効率性スループットは前世代と比較して110%向上し、レイテンシは30%削減されています。大規模な本番環境への導入を想定して設計されています。
  • 極めて低い導入ハードルW4A4量子化は、プライベート展開の場合、B200が1台、またはH100が2台あれば十分です。
  • データ主権ローカル展開と主要なクラウドプラットフォームをサポートし、金融、医療、その他の分野におけるコンプライアンス要件を満たします。
  • オープンソースに友好的Apache 2.0ライセンスに基づき、完全なオープン権限、コード、チューニングツールが提供され、商用利用も制限されません。

Command A+のプロジェクトアドレス

  • プロジェクト公式サイト:https://cohere.com/blog/command-a-plus
  • ハギングフェイスモデルライブラリ:https://huggingface.co/CohereLabs/command-a-plus-05-2026-bf16

Command A+と類似競合製品との比較

寸法 Command A+ OpenAI GPT-4o
開発者 Cohere Labs OpenAI
オープンソースライセンス Apache 2.0(完全商用) クローズドソース/独自API
モデルアーキテクチャ MoE(218B / 25B) 密度が高い(非公開)
マルチモーダル機能 ビジュアル+テキスト+ツール 視覚情報+音声情報+テキスト情報
コンテキストウィンドウ 128K入力 / 64K出力 128K
プライベート展開 1×B200または2×H100 API呼び出しのみ
API価格(100万トークンあたり) $2.50 / $10.00 $2.50 / $10.00
在来のRAG生態系 (埋め込み+再ランキング+生成) 自作必須
ネイティブエージェントツール呼び出し
エンタープライズグレードのRAGスタック 端から端まで
定量的サポート BF16 / FP8 / W4A4 適用できない

Command A+の応用シナリオ

  • エンタープライズナレッジベースに関するQ&A128KバイトのコンテキストとネイティブのRAG機能に基づいて、文書全体にわたるインテリジェントな質問応答を可能にし、正確な引用追跡機能も備えています。
  • 多言語翻訳とローカライズ48言語に対応しており、越境EC、国際会議の同時通訳、多言語コンテンツ制作などに適しています。
  • ビジュアルエージェントオートメーション画像認識とツール活用を組み合わせることで、請求書の認識、請求書の入力、レポートの解析といった一連の自動化されたワークフローを実現します。
  • 法令遵守に基づく産業民営化の展開金融機関、医療機関、政府機関は、データ主権と規制遵守の要件を満たすために、オンプレミス環境またはプライベートクラウド環境にシステムを導入することができる。
  • 高スループットのインテリジェントな顧客サービスMoEアーキテクチャの高いスループットと低遅延という特性を活用することで、大規模な同時対話とリアルタイム検索による応答強化をサポートします。