AB
AiBoss
project

openPangu 2.0 - Huawei のオープンソース Pangu 大型モデルのアップグレード バージョン

openPangu 2.0は、HuaweiのオープンソースPangu大型モデルのメジャーアップグレードであり、最大505BパラメータのProバージョンと92BパラメータのFlashバージョンを提供します。すべてのモデルは、512Kの超ロングコンテキスト、Ascendを使用したネイティブ深度チューニング、および...

openPangu 2.0とは何ですか?

openPangu 2.0は、ファーウェイのオープンソース大規模モデルであるPanguのメジャーアップグレード版で、最大505BパラメータのProバージョンと92BパラメータのFlashバージョンを提供します。このモデルは、512Kの超ロングコンテキストを統一的に備え、AscendおよびKirinチップ向けにネイティブに最適化されています。モデル構造、重み、技術レポート、推論コード、事前学習コード、事後学習コード、および学習演算子は、6月30日から順次、サプライチェーン全体で公開されます。

openPangu 2.0の主な機能

  • デュアルバージョンマトリックスPro版は極めて高いパフォーマンスを実現するように設計されている一方、Flash版は軽量な導入を前提として設計されています。
  • 512K 極めて長いコンテキストこれは、非常に長いテキストの理解、複雑なコードの分析、およびアプリケーション間のエージェントの相互作用を統一的にサポートします。
  • Ascendネイティブ最適化シングルカードの推論スループットは、業界の主流であるオープンソースモデルの2倍であり、レイテンシも低くなっています。
  • HarmonyOSエージェントの適応タスクはより迅速かつ正確に完了し、トークン消費量とリソース使用量は大幅に削減されます。
  • 端面挿入モデルこのモデルは、合計300億個のパラメータと20億個の活性化関数を持つKirinアフィニティモデルであり、携帯電話やIoTデバイス上でのローカル推論をサポートしています。

openPangu 2.0の技術原理

  • DSA+SWA独立型階層型ハイブリッドアーキテクチャ業界で初めて独立した階層型ハイブリッドアーキテクチャを採用した本アーキテクチャは、動的スパースアテンション(DSA)とスライディングウィンドウアテンション(SWA)を別々に展開することで、超スパースなアテンションメカニズムを実現します。512Kバイトの長文コンテキストを理解する能力を維持しながら、階層型計算によって冗長なアテンションオーバーヘッドを大幅に削減し、超長文シーケンス推論における計算電力消費を非線形的に減少させます。
  • 極めて疎なアクティベーションとエキスパートルーティング28:1のスパース性比率を採用したProバージョンは、合計505B個のパラメータを持ちながら、推論に必要なメモリはわずか18Bです。専門家による最適化されたルーティングと精密な計算割り当てにより、このモデルはトレーニング段階と推論段階の両方において、ある一定レベルを超える一貫性を実現しています。 99%これにより、従来のMoEモデルでよく見られる学習データと推論データの分布のずれの問題が回避され、推論コストとメモリ使用量が大幅に削減されます。
  • Ascendネイティブフルスタック最適化アルゴリズムアーキテクチャからトレーニング、推論に至るまで、Ascendチップに完全に最適化されています。トレーニング面では、スーパーノードアフィニティ最適化が実装されており、トレーニング効率が30%向上し、512Kの長シーケンスのトレーニングにおけるスループットが向上しています。 50%推論側では、mHC、Muon、ModAttnなどの高精度なネイティブ演算子を統合することで、業界主流のオープンソースモデルの2倍のシングルカードスループットを実現し、高スループットと低レイテンシのバランスを保っています。
  • 末端側の定量的剪定と専門家による再利用オンデバイスモデルは、Kirinチップ専用のネイティブ量子化プルーニング処理を受け、推論速度が50%向上し、メモリ使用量が20%削減されます。エキスパート再利用損失メカニズムが導入され、エキスパート切り替え頻度が50%削減されます。アクティブ化されたエキスパート予測技術と組み合わせることで、オンデバイスモデルのスループットが5倍に向上し、携帯電話やIoTデバイス上での高性能なローカル推論が可能になります。

openPangu 2.0 の使い方

モデルの重み、推論コード、およびトレーニングコードは、6月30日から公式サイトからダウンロードして使用できます。

openPangu 2.0の主な利点

  • ネイティブコンピューティング親和性AscendおよびKirinチップとの互換性が高く、追加の変換なしでハードウェアの性能を最大限に引き出すことができます。
  • 極めて疎な状態28:1という疎な比率により推論負荷が大幅に軽減され、より小さな活性化パラメータで大規模なモデルを処理できるようになります。
  • 極めて長いコンテキスト統合512KBのコンテキストウィンドウは、長文ドキュメント、複数ターンにわたる対話、複雑なエージェントタスクをカバーします。
  • トレーニングパイプラインは完全にオープンですこれは業界でも数少ない、完全なオープンソースの事前学習および事後学習コードソースの一つであり、二次開発の敷居を低くする。
  • エンドツークラウドのコラボレーションによるカバレッジクラウド側のAscendとエッジ側のKylinを組み合わせたデュアルアーキテクチャにより、データセンターからモバイルデバイスまで、あらゆるシナリオでの展開が可能になります。

openPangu 2.0と類似の競合製品との比較

寸法 openPangu 2.0 Pro DeepSeek-V3
パラメータの総数 505B 671B
活性化パラメータ 18B(疎比率 28:1) 37B(疎密度比約18:1)
コンテキストの長さ 512K 極めて長いコンテキスト 128K コンテキスト
建築革新 業界初となる、DSA+SWAに依存しない階層型ハイブリッドアーキテクチャで、超スパースなアテンション機構を搭載。 従来のMoEアーキテクチャ、FP8混合精度トレーニング
ハードウェア親和性 Ascend/Kirinチップのネイティブなディープチューニング、トレーニングプッシュの一貫性99%以上。 汎用NVIDIA GPU向けに最適化されているため、国内のコンピューティング能力に合わせて調整する必要がある。
オープンソースレベル 6月30日より、7つの主要コンポーネント(事前学習、事後学習コード、オペレーターを含む)からなるシステム全体がオープンソース化されます。 モデルの重み、推論コード、および技術レポートはオープンソースですが、トレーニングコードは完全なオープンソースではありません。

openPangu 2.0の応用シナリオ

  • エンタープライズ知識ベース512Kコンテキスト処理を用いて、超長文の法律契約書、研究論文、財務報告書を詳細に分析する。
  • HarmonyOS インテリジェントエージェントHarmonyOSエコシステム内にアプリケーション間スケジューリングエージェントを構築し、デバイスの自動制御とマルチモーダルなインタラクションを実現する。
  • アセンド・クラウド・リーズニングAscendクラスタをベースとした費用対効果の高い大規模モデルAPIサービスを導入することで、国内コンピューティング能力の推論コストを削減します。
  • エンドサイドプライバシーコンピューティング30B入力モデルを通じて、モバイルデバイス上でのローカル文書処理とオフラインスマートアシスタントを可能にします。
  • 垂直産業向けカスタマイズオープンソースのトレーニングコードを活用することで、製造業、医療、行政などの分野向けに特化したモデルを迅速に微調整できます。