AB
AiBoss
project

Qwen3.6-Max-Preview - Ali Tongyiが発表した次世代フラッグシップモデル

Qwen3.6-Max-Previewは、アリババ傘下の同義千文チームがリリースした次世代フラッグシップ大規模モデルの早期プレビュー版です。Qwen3.6-Plusと比較して、このモデルはエージェントプログラミング、世界知識、指示遵守という3つの主要な側面で大幅な改善を実現しています。

Qwen3.6-Max-Previewとは何ですか?

Qwen3.6-Max-Previewは、アリババ同義千文チームがリリースした次世代フラッグシップモデルの早期プレビュー版です。Qwen3.6-Plusと比較して、エージェントプログラミング、世界知識、命令準拠の3つの側面で大幅な改善を実現し、SWE-bench Pro、Terminal-Bench 2.0、SciCodeを含む6つのプログラミングベンチマークテストで最高スコアを達成しました。ユーザーは、Qwen Studioを通じてオンラインで体験するか、Alibaba Cloud Bailian APIを介して呼び出すことができます。

Qwen3.6-Max-Previewの主な機能

  • インテリジェントエージェントプログラミングSWE-bench Pro、Terminal-Bench 2.0、SkillsBenchを含む6つのプログラミングベンチマークで最高スコアを達成し、コード生成、ターミナル操作、および長期コードタスクをサポートしています。
  • 世界知識の向上大学院レベルの知識クイズ(SuperGPQA)と中国語の知識(QwenChineseBench)のスキルが大幅に向上しました。
  • 指示遵守の最適化実際のシナリオでは、`ToolcallFormatIFBench`形式に従うことで、より優れたパフォーマンスが得られます。
  • 記憶連鎖の保持:サポート preserve_thinking この機能により、複数ターンにわたる対話中に以前の思考プロセスを保持できるため、複雑なインテリジェントエージェントのタスクに適しています。
  • プロトコルの互換性このAPIはOpenAI(チャットの完了/応答)およびAnthropicのインターフェース仕様と互換性があり、既存のワークフローへのシームレスな統合を容易にします。

Qwen3.6-Max-Preview の使い方

  • オンライン体験Qwen Studioにアクセスし、Qwen3.6-Max-Previewモデルを選択して、対話を開始してください。
  • API呼び出し
    • APIキーを取得するには、アリババクラウド百連の公式サイトにアクセスしてください。
    • お電話の際は、機種名をご記入ください。 qwen3.6-max-preview
    • OpenAI標準プロトコル(チャットの完了/応答)とAnthropic APIインターフェースをサポートしており、既存のワークフローにおけるモデル名を直接置き換えることが可能です。

Qwen3.6-Max-Previewの主要情報と使用要件

  • 製品ポジショニング:アリ・トンイー・チエンウェンの次世代フラッグシップモデルの早期プレビュー版。Qwen3.6-Plusに続くアップグレード版。
  • コア機能強化インテリジェントエージェントのプログラミング能力は大幅に向上し、世界に関する知識や指示に従う際の性能も向上した。
  • パフォーマンスこのソフトウェアは、SWE-bench Pro、Terminal-Bench 2.0、SkillsBench、QwenClawBench、QwenWebBench、およびSciCodeという6つのプログラミングベンチマークで最高スコアを獲得しました。
  • ステータスの説明現在プレビュー版であり、モデルは積極的に改良が続けられています。今後のバージョンでは、さらに最適化が図られていく予定です。

Qwen3.6-Max-Previewの主な利点

  • インテリジェントエージェントプログラミングのリーディングカンパニーSWE-bench Pro、Terminal-Bench 2.0、SkillsBenchを含む6つのプログラミングベンチマークで最高スコアを達成し、コード生成機能とターミナル操作機能は前機種を大幅に上回った。
  • 世界知識の向上大学院レベルの知識に関する質疑応答(SuperGPQA)と中国語の知識に関する知識(QwenChineseBench)の性能が大幅に向上し、知識の信頼性も向上しました。
  • 指示がより正確に実行される実世界のシナリオにおいて、(ToolcallFormatIFBench)ツール呼び出しフォーマットに従う能力が向上し、複雑なタスクの実行がより安定します。
  • 競技者たちは好成績を収めた複数のベンチマークにおいて、Claude 4.5 OpusやGLM 5.1といった主流の最先端モデルを凌駕する性能を発揮する。
  • 優れた環境適合性このAPIはOpenAIおよびAnthropicプロトコルと互換性があり、以下の機能をサポートしています。 preserve_thinking この機能により、既存のエージェントワークフローへのシームレスな統合が可能になります。

Qwen3.6-Max-Previewと類似の競合製品との比較

比較対象寸法 Qwen3.6-Max-Preview Claude 4.5 Opus GLM 5.1
SWE-bench Pro(プロジェクトコード) 57.3 50.9 58.4
Terminal-Bench 2.0(端末プログラミング) 65.4 59.3 63.5
SkillsBench(エージェントのスキル) 55.6 45.3 53.1
SciCode(研究コード) 47.0 49.5
NL2Repo(長距離コード) 42.9 43.2 42.7
QwenWebBench(フロントエンド開発) 1532 1558
SuperGPQA(大学院レベルの知識) 73.9 70.6
QwenChineseBench(中国語の知識) 84.0 69.0
ToolcallFormatIFBench(指示に従いました) 86.1 84.2 60.1
GDPval-AA(実世界ミッション) 51.0 48.0 52.0

Qwen3.6-Max-Previewのアプリケーションシナリオ

  • ソフトウェア開発コード生成、デバッグ、ターミナル操作、リポジトリレベルの長期プログラミングタスクをサポートし、フルスタック開発プロセスに対応します。
  • 科学計算これは、研究指向のコード作成とデータ分析を支援し、科学研究の自動化の効率を向上させます。
  • フロントエンド構築ウェブデザイン、ウェブアプリケーション、ゲーム、SVG、データビジュアライゼーション、アニメーション、3Dコンテンツを生成します。
  • インテリジェントエージェントオートメーションこのモデルは、複雑な現実世界のタスクを実行でき、ツール呼び出しを通じて複数のワークフローを接続することができます。
  • 知識に関するQ&Aこのモデルは、中国語分野における大学院レベルの専門知識に基づく回答と、詳細な知識サービスを提供します。