AB
AiBoss
project

Qwen 3.8-Max - Alibaba Cloud Qwenチームが発表した、フラッグシップとなる大規模モデル。

Qwen 3.8-Maxは、Alibaba Cloud Qwenチームが発表したフラッグシップ大規模モデルであり、総パラメータ数は2.4兆個です。Qwen 3.5アーキテクチャの拡張版であり、Qwenファミリーの中で現時点で最も強力なモデルとして、初めてオープンソース化されました。

Qwen 3.8-Maxとは何ですか?

Qwen 3.8-Maxは、Alibaba Cloud Qwenチームが発表したフラッグシップ大規模モデルで、パラメータ総数は2.4兆個、Qwen 3.5アーキテクチャの拡張版です。Qwenファミリーの中でこれまでで最も強力なモデルであり、重み付け機能を備えたMaxレベルモデルとして初めてオープンソース化されました。このモデルは、プログラミング、事務作業、科学研究、長期タスクにおいて包括的なアップグレードを実現し、Qianwen AIプラットフォームAPIを介した呼び出しをサポート、OpenAIおよびAnthropicプロトコルと互換性があり、Claude Code、Codex、Qoderなどの主流のインテリジェントエージェントフレームワークにシームレスに統合できます。

Qwen 3.8-Maxの主な機能

  • 長距離自動プログラミング10日以内に自律的なプログラミングをサポートし、自己進化型ハーネスの構築、要件収集、課題の割り当て、コード生成、および自己修復の完了を可能にします。
  • 紙の複製とそれを超える論文の実験を独自に再現した後、18の改善案を4回の自己進化サイクルでテストした結果、AIME24において元の方法よりも2.7ポイントの改善が得られた。
  • 競技実務24時間以内に、このソリューションは独自に構築され、改良が重ねられ、精度は0.60から0.853に向上し、人間のチームの87%を上回る結果となった。
  • オフィスの効率性を向上させる本書は、弁護士が1時間で1,284の条項を特定したり、デザイナーが8ページのインタラクティブなプロトタイプを一度に作成したりするなど、数百もの高価値な専門的シナリオを網羅している。
  • 定量的戦略開発たった一文の説明から始まり、約330のサブエージェントがスケジュールされ、約6,000回のバックテストが完了し、エンドツーエンドのETFローテーション戦略が実現されます。
  • 独立したチップ設計約500回の相互作用を経て、暗号アクセラレータのネットリストにおけるゲート数は8,298個から678個に最適化され、面積は81%削減され、時間的閉鎖が達成された。

Qwen 3.8-Maxの技術的原理

  • アーキテクチャ拡張これはQwen 3.5アーキテクチャをベースとした拡張機能であり、合計2.4兆個のパラメータと950億個のアクティブパラメータを備え、アーキテクチャの継承を維持しながら規模の飛躍的な向上を実現しています。
  • 実世界の強化学習システムRL環境の数とトレーニング計算能力を同時に拡張することで、汎用的な機能を強化し、3つの主要な結合課題に対処します。タスク、ワークスペース、ハーネスの3つの次元にわたる分離により、環境の数が自然に結合された形で増加できるようにします。実行ベースの検証、テキストとレンダリング後の視覚出力のルーブリック評価、およびエージェンシーチェックを統合して内部化する統一報酬システムを構築し、タスク固有の検証器の矛盾を解消します。タスク、難易度、ワークスペース、ハーネスにわたって各バッチのバランスの取れた分布を再構築するオンラインデータイコライザーを構築し、勾配の分散を減らし、トレーニング計算能力の安定的かつ継続的な拡張をサポートします。
  • 自己進化フィードバックループこのモデルは、実行・フィードバック・反復という適応的なメカニズムを通じて最適化を進め、数百から数千もの相互作用を通して、非常に一貫性のある体系的な戦略を維持します。浅い構文の微調整ではなく、シミュレーション、合成、レイアウトといったフィードバックループを利用して、アルゴリズムレベルのデータパス再構築を実現します。
  • 動的なワークフローオーケストレーションプログラミングを通じてタスク計画を推進し、オーケストレーションロジックを再現可能なプログラムに定着させ、単一リンクの一貫性のある開発から大規模な並列探索への柔軟な切り替えをサポートし、複雑なタスクの逐次的な進行を、単一の対話内で大規模に実行可能な自動化されたクローズドループに変換します。

Qwen 3.8-Max の使い方

  • Qianwen AIプラットフォームの呼び出しアカウントを登録してAPIキーを取得し、OpenAIまたはAnthropicプロトコルに対応したインターフェースを介してモデルを直接呼び出してください。
  • 推論の深さを調整する:合格 reasoning_effort パラメータ設定 xhigh(デフォルト、詳細分析)medium(残高)または low(効率的な推論)必要に応じてコストとパフォーマンスを管理する。
  • 統合型インテリジェントエージェントフレームワークAPIキーとベースURLを設定すると、Claude Code、Codex、Qoder CLI、Qwen Code、OpenClawなどの主要なプログラミングアシスタントやエージェントフレームワークにアクセスできるようになります。
  • オープンソースの重み付け展開来週から、ローカル環境への展開および二次開発のために、Hugging FaceまたはModelScopeからモデルの重みをダウンロードします。

Qwen 3.8-Maxの主な利点

  • 超長距離自律実行それは数日から数十日間連続して集中することができ、実行・フィードバック・反復という閉じたループを通して自己進化し、その過程全体を通して人間の介入を必要としない。
  • 実世界での強化学習トレーニングこれは、拡張環境の数とトレーニング用コンピューティング能力を組み合わせたものであり、QwenWork、Claude Code、Codex、OpenClaw、Hermesなどのハーネスに対して、バランスの取れた継続的な改善を示しています。
  • エンドツーエンドの配信機能動的なワークフローを通じてオーケストレーションロジックを再現可能な手順に定着させることで、従来は数週間かけて順次実行する必要があった複雑なタスクを、自動化されたクローズドループに圧縮し、単一の会話の中で大規模に実行することが可能になります。

Qwen 3.8-Maxのプロジェクトアドレス

  • プロジェクト公式サイト:https://qwen.ai/blog?id=qwen3.8

Qwen 3.8-Maxと類似の競合製品との比較

寸法 Qwen 3.8-Max GPT 5.6 Sol
紙の複製 PaperBenchスコアは93.0で、独立した複製後、元のテキストを超えた自己進化を示している。 PaperBench 90.5ポイント
ソフトウェアエンジニアリング SWE-bench Pro 67.7ポイント、FrontierSWE 73.5ポイント SWE-bench Proスコア:64.6;FrontierSWEスコア:公式データなし。
端末エンコーディング ターミナルベンチ2.1 86.6ポイント ターミナルベンチ2.1 88.8ポイント
総務部 CoWorkBench 74.8ポイント、JobBench 53.4ポイント CoWorkBench 71.5ポイント、JobBench 45.4ポイント
マルチモーダル推論 MMMU-Pro 82.3点、BabyVision 82.0点 MMMU-Pro 83.0ポイント、BabyVision 65.5ポイント
視覚的インテリジェントエージェント OSWorld-Verified 86.1ポイント、AndroidWorld 85.3ポイント OSWorld-Verified 83.2ポイント、AndroidWorld 77.6ポイント
動画の理解 VideoMME 90.4点、MLVU 90.8点 VideoMME 89.5点、MLVU 87.6点
長期ミッション 365日間のeコマースシミュレーションの結果、4.16倍の収益が得られ、チップ設計は500回の最適化を経て完成しました。 同様の長距離自律飛行ミッションに関する公開データは存在しない。

Qwen 3.8-Maxのアプリケーションシナリオ

  • 法令遵守レビュー1回のセッションで数百もの文書を読み込み、1時間以内に数千もの関連条項をハイライト表示し、法務チームの約1週間分の業務を代替できる。
  • UI/UXプロトタイピングデジタルバンキングアプリ向けの高精細なインタラクティブプロトタイプ(8ページ)を一度に生成し、手作業による修正の必要性を排除します。
  • レストランのメニュー開発数百もの食材データに基づいて、食材コスト率を33.8%に抑えながら、26品からなる完全なメニューを一度に生成できる。
  • 構造工学モデリング30階建てのオフィスビルの耐震構造モデルは、たった1枚の図面だけでブラウザ上で再構築でき、図面にカーソルを合わせることで主要な指標をリアルタイムで確認できる。
  • リハビリテーション医学の可視化2次元の紙の評価用紙を、自由に回転可能な、層ごとにインタラクティブな3次元プレゼンテーションに変換することで、患者はリハビリテーションの過程を理解しやすくなります。