project
Qwen3.5-Maxプレビュー - Ali Tongyiが発表した新世代フラッグシップモデル
Qwen3.5-Max-Previewは、アリ・トンイー・チエンウェンチームが発表した主力大規模モデルのプレビュー版です。このモデルは、LMARaena評価プラットフォームにおいて1464点を獲得し、世界トップ5、中国国内では1位にランクインしました。また、基礎能力評価では世界第6位にランクインしています。
Qwen3.5-Max-Previewとは何ですか?
Qwen3.5-Max-Previewは、アリババの同義千文チームがリリースした主力大規模モデルのプレビュー版です。このモデルはLMARaena評価プラットフォームで1464点を獲得し、世界トップ5、中国国内では1位、基礎能力評価では世界6位にランクインしました。前モデルと比較すると、創作、数学的推論、文章理解において大幅な改善が見られ、数学能力は世界トップ5入りを果たしました。このモデルは今後もクローズドソースの主力製品として、Qwen3.5シリーズの技術ロードマップに沿って開発が進められ、大規模モデルコンテストにおけるアリババの継続的な競争力を示すものとなるでしょう。
Qwen3.5-Max-Previewの主な機能
-
数学的推論その数学能力は世界トップ5にランクインしており、前機種と比較して49ポイント向上しているため、複雑な数学的計算や論理的導出を処理できる。
-
クリエイティブライティングクリエイティブライティングスキルが57ポイント向上し、質の高い文学作品、マーケティング資料、クリエイティブコピーライティングコンテンツの作成が可能になった。
-
テキスト理解全体的な文章理解度は45ポイント向上し、長文の意味や文脈上の関係性を正確に把握できるようになった。
-
専門家レベルのテキスト処理Arena Expertランキングでトップ10にランクインしており、専門分野における詳細なテキスト分析と生成能力を備えています。
-
プログラミングスキルコーディングベンチマークにおいて優れた性能を発揮し、コード生成、デバッグ、技術文書作成をサポートします。
-
長文処理非常に長いコンテキストウィンドウを持つ複雑なクエリを処理できる、より長いクエリタスクをサポートします。
-
指示に従いました指示追従機能が大幅に強化され、複雑なユーザー指示を正確に理解し実行できるようになりました。
-
複数回の対話マルチターン機能は、文脈の一貫性を維持しながら、スムーズなマルチターン操作をサポートします。
Qwen3.5-Max-Previewの主要情報と使用要件
-
リリース時間2026年3月20日
-
モデルの位置特定アリババの最新フラッグシッププレビュー版である「通義千文」は、中核技術スタッフの林俊陽氏が退社した後、アリババが発売した初のオリジナル大型モデルとなる。
-
評価結果LMARaenaプラットフォームで1464点を獲得したアリババ千文は、世界の大型モデルラボ上位5位にランクインし、中国国内では1位となった。また、基本能力評価(スタイルコントロールなし)では1470点を獲得し、世界6位、中国国内1位となった。
-
建築に関する憶測総パラメータ数3970億、アクティベーションパラメータ数170億というQwen3.5-Plusシリーズの設計を参考に、MoE(ハイブリッドエキスパート)アーキテクチャを採用する可能性がある。
-
現在の状況このモデルは現在プレビュー段階であり、正式版はまだリリースされていません。
Qwen3.5-Max-Previewの主な利点
-
中国をリードするLMArenaは中国で1位にランクインし、アリババ傘下の千文研究所は世界トップ5に入る大規模モデルラボとなった。
-
能力の飛躍創造的な文章作成能力は57ポイント、数学的推論能力は49ポイント、そして総合的な文章理解能力は45ポイント向上し、複数の側面において包括的な能力向上を示した。
-
数学その数学的能力は世界トップ5にランクインし、複雑な論理的推論と計算において卓越した能力を発揮する。
-
専門家レベルのパフォーマンスこのモデルはArena Expertのリーダーボードでトップ10にランクインしており、GPT-5.2やClaude Sonnet 4.5といった主流のモデルを凌駕している。
-
バランスが良く、汎用性が高いプログラミング、長文処理、指示の追跡、複数ターン対話など、10以上のサブシナリオにおいて優れた性能を発揮します。
Qwen3.5-Max-Preview の使い方
このモデルは現在プレビュー段階であり、具体的な利用チャネルはまだ発表されていません。
Qwen3.5-Max-Previewと類似の競合製品との比較
| 比較対象寸法 | Qwen3.5-Max-Preview | Claude Opus 4.6 | GPT-5.4 High | Gemini 3.1 Pro |
|---|---|---|---|---|
| LMArena 合計スコア | 1464ポイント(世界第5位) | 1502ポイント(1位) | 1486ポイント(4位) | 1494ポイント(2位) |
| 基本的な能力ランキング | 1470ポイント(世界第6位) | 1499ポイント(1位) | 1476ポイント(5位) | 1489ポイント(3位) |
| アリーナ専門家ランキング | 1498ポイント(10位) | 1506ポイント(6位) | 1508ポイント(5位) | 1501ポイント(8位) |
| 数学的能力 | 世界トップ5 | リードする | リードする | リードする |
| クリエイティブライティング能力向上 | +57ポイント(前世代比) | – | – | – |
| モデルの特性 | 非公開プレビュー版 | 非公開ソース | 非公開ソース | 非公開ソース |
| 提携研究所 | アリババの1000の質問 | Anthropic | OpenAI |
Qwen3.5-Max-Previewのアプリケーションシナリオ
-
クリエイティブライティングこのモデルは、高品質な文学作品、マーケティング資料、クリエイティブなコピーライティングコンテンツを生成でき、その能力は前モデルよりも57ポイント向上している。
-
数学的推論このモデルは複雑な数学的計算や論理的導出を処理でき、その数学的能力は世界トップ5に入っている。
-
プログラミング開発自動コード生成、プログラムのデバッグと最適化、および技術文書の作成をサポートします。
-
健康管理医学文献の詳細な分析、補助的な診断提案、および専門的な健康相談サービスに適しています。
-
法律および政治問題このモデルは、契約条項の審査、法律および政策の解釈、政府関連文書の処理を完了できる。