AB
AiBoss
project

MAI-DS-R1 - マイクロソフトのオープンソースAIモデルであり、DeepSeek R1の改良版である。

MAI-DS-R1は、DeepSeek R1をベースにMicrosoftが開発したAIモデルです。MAI-DS-R1はトレーニング後に最適化されており、センシティブなトピックに関するプロンプトの99.3%に対応できます。これはオリジナルバージョンと比較して2倍の改善であり、有害コンテンツのリスクを50%削減します。MAI...

MAI-DS-R1とは何ですか?

MAI-DS-R1は、DeepSeek R1をベースにMicrosoftが開発したAIモデルです。ポストトレーニングによって最適化されたMAI-DS-R1は、機密性の高いトピックに関するプロンプトの99.3%に対応し、オリジナル版の2倍の精度を実現するとともに、有害コンテンツのリスクを50%削減します。MAI-DS-R1はDeepSeek R1と同等の推論能力を維持し、多言語対応も可能で、国際機関、多国籍企業、教育機関などの多言語環境に適しています。MAI-DS-R1はオープンソースであり、研究者や開発者が利用できます。

MAI-DS-R1の主な機能

  • デリケートな話題への効率的な対応機密性の高い質問の99.3%に対応可能で、初代DeepSeek R1を大幅に上回る性能を発揮します。
  • 低リスクセキュリティ評価の結果、有害コンテンツのリスクは50%削減された。
  • 推論能力DeepSeek R1と同じ推論能力を備えているため、複雑な論理問題や知識ベースの問題に適しています。
  • 多言語対応複数の言語に対応し、様々な言語環境に適応します。

MAI-DS-R1の技術原理

  • トレーニング後本研究では、ポストトレーニング技術を用いてオリジナルのDeepSeek R1モデルを最適化しました。ポストトレーニングとは、事前トレーニング後に特定のデータセットと戦略を用いてモデルを微調整し、特定のタスクにおけるパフォーマンスを向上させる手法です。Microsoftは、ポストトレーニングに約35万件のブロック対象トピックの例を使用し、様々なセンシティブなトピックを網羅しました。MAI-DS-R1は、これらのトピックに対してより効果的に対応する方法を学習し、有害なコンテンツの生成を回避しました。
  • データ拡張トレーニング後の段階で、マイクロソフトはTulu3 SFTデータセットから11万件のセキュリティ違反事例を追加しました。これには、機密性の高いトピックに関する事例も含まれています。これらの事例には、CoCoNot、WildJailbreak、WildGuardMixなどのコンテンツが含まれており、モデルが潜在的に有害なコンテンツをより適切に識別し、処理するのに役立ちました。
  • 多言語翻訳学習後の段階では、さまざまな言語環境のニーズに対応するため、問題が複数の言語に翻訳されます。これにより、モデルの多言語対応能力が向上し、異なる文化的背景を持つ問題をより深く理解できるようになります。
  • セキュリティ評価マイクロソフトは、HarmBenchデータセットを使用してMAI-DS-R1の包括的なセキュリティ評価を実施し、モデルによって生成される有害なコンテンツを検出するとともに、出力が倫理的および法的基準に準拠していることを確認しました。

MAI-DS-R1プロジェクトの住所

MAI-DS-R1の応用シナリオ

  • 学術研究これは、研究者が機密性の高いトピックに関する多面的な情報を迅速に入手・整理するのに役立ち、学術論文の執筆を支援し、より包括的な議論の内容を提供する。
  • コンテンツモデレーションソーシャルメディアやニュースプラットフォームで使用されるこのシステムは、有害または不適切な情報を効果的に識別してフィルタリングし、コンテンツの健全性と安全性を確保します。
  • 多言語対応のカスタマーサービス多国籍企業や国際機関向けに多言語サポートを提供し、様々な言語でのユーザーからの問い合わせに迅速に対応することで、顧客サービスの効率性とユーザーエクスペリエンスを向上させます。
  • 教育指導教育機関においては、教師の授業を支援し、学生に多言語による学術指導や問題解決の機会を提供し、知識の普及を促進する。
  • 政策協議政府機関や政策研究機関に対し、デリケートな社会問題を分析し、より合理的な政策策定を支援するためのデータ支援および世論分析を提供する。