project
Qwen3.6-Max-Preview - Ali Tongyiが発表した次世代フラッグシップモデル
Qwen3.6-Max-Previewは、アリババ傘下の同義千文チームがリリースした次世代フラッグシップ大規模モデルの早期プレビュー版です。Qwen3.6-Plusと比較して、このモデルはエージェントプログラミング、世界知識、指示遵守という3つの主要な側面で大幅な改善を実現しています。
Qwen3.6-Max-Previewとは何ですか?
Qwen3.6-Max-Previewは、アリババ同義千文チームがリリースした次世代フラッグシップモデルの早期プレビュー版です。Qwen3.6-Plusと比較して、エージェントプログラミング、世界知識、命令準拠の3つの側面で大幅な改善を実現し、SWE-bench Pro、Terminal-Bench 2.0、SciCodeを含む6つのプログラミングベンチマークテストで最高スコアを達成しました。ユーザーは、Qwen Studioを通じてオンラインで体験するか、Alibaba Cloud Bailian APIを介して呼び出すことができます。
Qwen3.6-Max-Previewの主な機能
-
インテリジェントエージェントプログラミングSWE-bench Pro、Terminal-Bench 2.0、SkillsBenchを含む6つのプログラミングベンチマークで最高スコアを達成し、コード生成、ターミナル操作、および長期コードタスクをサポートしています。
-
世界知識の向上大学院レベルの知識クイズ(SuperGPQA)と中国語の知識(QwenChineseBench)のスキルが大幅に向上しました。
-
指示遵守の最適化実際のシナリオでは、`ToolcallFormatIFBench`形式に従うことで、より優れたパフォーマンスが得られます。
-
記憶連鎖の保持:サポート
preserve_thinkingこの機能により、複数ターンにわたる対話中に以前の思考プロセスを保持できるため、複雑なインテリジェントエージェントのタスクに適しています。 -
プロトコルの互換性このAPIはOpenAI(チャットの完了/応答)およびAnthropicのインターフェース仕様と互換性があり、既存のワークフローへのシームレスな統合を容易にします。
Qwen3.6-Max-Preview の使い方
- オンライン体験Qwen Studioにアクセスし、Qwen3.6-Max-Previewモデルを選択して、対話を開始してください。
- API呼び出し
- APIキーを取得するには、アリババクラウド百連の公式サイトにアクセスしてください。
- お電話の際は、機種名をご記入ください。
qwen3.6-max-preview。 - OpenAI標準プロトコル(チャットの完了/応答)とAnthropic APIインターフェースをサポートしており、既存のワークフローにおけるモデル名を直接置き換えることが可能です。
Qwen3.6-Max-Previewの主要情報と使用要件
-
製品ポジショニング:アリ・トンイー・チエンウェンの次世代フラッグシップモデルの早期プレビュー版。Qwen3.6-Plusに続くアップグレード版。
-
コア機能強化インテリジェントエージェントのプログラミング能力は大幅に向上し、世界に関する知識や指示に従う際の性能も向上した。
-
パフォーマンスこのソフトウェアは、SWE-bench Pro、Terminal-Bench 2.0、SkillsBench、QwenClawBench、QwenWebBench、およびSciCodeという6つのプログラミングベンチマークで最高スコアを獲得しました。
-
ステータスの説明現在プレビュー版であり、モデルは積極的に改良が続けられています。今後のバージョンでは、さらに最適化が図られていく予定です。
Qwen3.6-Max-Previewの主な利点
-
インテリジェントエージェントプログラミングのリーディングカンパニーSWE-bench Pro、Terminal-Bench 2.0、SkillsBenchを含む6つのプログラミングベンチマークで最高スコアを達成し、コード生成機能とターミナル操作機能は前機種を大幅に上回った。
-
世界知識の向上大学院レベルの知識に関する質疑応答(SuperGPQA)と中国語の知識に関する知識(QwenChineseBench)の性能が大幅に向上し、知識の信頼性も向上しました。
-
指示がより正確に実行される実世界のシナリオにおいて、(ToolcallFormatIFBench)ツール呼び出しフォーマットに従う能力が向上し、複雑なタスクの実行がより安定します。
-
競技者たちは好成績を収めた複数のベンチマークにおいて、Claude 4.5 OpusやGLM 5.1といった主流の最先端モデルを凌駕する性能を発揮する。
-
優れた環境適合性このAPIはOpenAIおよびAnthropicプロトコルと互換性があり、以下の機能をサポートしています。
preserve_thinkingこの機能により、既存のエージェントワークフローへのシームレスな統合が可能になります。
Qwen3.6-Max-Previewと類似の競合製品との比較
| 比較対象寸法 | Qwen3.6-Max-Preview | Claude 4.5 Opus | GLM 5.1 |
|---|---|---|---|
| SWE-bench Pro(プロジェクトコード) | 57.3 | 50.9 | 58.4 |
| Terminal-Bench 2.0(端末プログラミング) | 65.4 | 59.3 | 63.5 |
| SkillsBench(エージェントのスキル) | 55.6 | 45.3 | 53.1 |
| SciCode(研究コード) | 47.0 | 49.5 | — |
| NL2Repo(長距離コード) | 42.9 | 43.2 | 42.7 |
| QwenWebBench(フロントエンド開発) | 1532 | — | 1558 |
| SuperGPQA(大学院レベルの知識) | 73.9 | 70.6 | — |
| QwenChineseBench(中国語の知識) | 84.0 | 69.0 | — |
| ToolcallFormatIFBench(指示に従いました) | 86.1 | 84.2 | 60.1 |
| GDPval-AA(実世界ミッション) | 51.0 | 48.0 | 52.0 |
Qwen3.6-Max-Previewのアプリケーションシナリオ
-
ソフトウェア開発コード生成、デバッグ、ターミナル操作、リポジトリレベルの長期プログラミングタスクをサポートし、フルスタック開発プロセスに対応します。
-
科学計算これは、研究指向のコード作成とデータ分析を支援し、科学研究の自動化の効率を向上させます。
-
フロントエンド構築ウェブデザイン、ウェブアプリケーション、ゲーム、SVG、データビジュアライゼーション、アニメーション、3Dコンテンツを生成します。
-
インテリジェントエージェントオートメーションこのモデルは、複雑な現実世界のタスクを実行でき、ツール呼び出しを通じて複数のワークフローを接続することができます。
-
知識に関するQ&Aこのモデルは、中国語分野における大学院レベルの専門知識に基づく回答と、詳細な知識サービスを提供します。