Alibabaは、Gemini 2.5 Proに匹敵する、同社で最も強力な推論モデルであるQwen3-2507をリリースした。
信じられない!これがアリババの力なのか?3日間で3つの主要AIモデルがリリースされ、AI業界で最もハードコアな「3つの技術リリース」を実現した。7月22日、アリババの同義千文チームは新バージョンQwen3-235B-A22B-Iをリリースした。
信じられない!これがアリババの力なのか?
3日間で3つの大型リリース大型モデル彼らは次々とオンラインに接続し、一連のゲームをプレイした…。AI業界で最も本格的な「3in1テクノロジー搭載製品」。
7月22日、アリババ同義千文チームは新バージョン「Qwen3-235B-A22B-Instruct-2507」をリリースし、翌日には別のバージョンをリリースした。オープンソース新しいコード大型モデル Qwen3-Coder、今夜 Qwen3-235B-A22B-Thinking-2507 そして、それは壮大なフィナーレを飾った。
1週間以内に、一般的な知的コーディングする知的複雑な推論から高度な論理まで、3つの主要な能力は完全に網羅されています。これは、アリババがいかに包括的な企業であり、これほど幅広い海外事業を展開しているかを示す好例と言えるでしょう。AIプレイヤーの数は非常に少ない。
全ラインだけでなくオープンソースまた、複数の国際的な評価においてもトップに立ち、過去のランキングと直接競合し、時にはそれを凌駕した。 Gemini、Claude これらの国際的な非公開情報源大型モデル。
ハギングフェイスのCEOであるクレメント氏でさえ、公にそれを称賛した。
しかし、私は常に自分のユーザー体験を最も信頼しています。実際に試してみれば、それが素晴らしいかどうか分かるからです。
6か月前、Qwen スピードと精度を単一のモデルに統合する「ハイブリッド思考」モデルアーキテクチャの探求が始まった。これは国内で開発されたものである。大型モデル「考え方の転換」を目指す、未来を見据えた試み。
今週、Qwen3は真の「機能分割」を実施しました。ハイブリッド思考に別れを告げ、2つの独立したバージョンに直接分割されたのです。
2つ大型モデル両モデルとも同じ235Bパラメータアーキテクチャと22B活性化パラメータを使用していますが、そのスタイルは全く異なります。
Qwen3-235B-A22B-Thinking-2507は、深い推論と厳密な論理に焦点を当てています。
Qwen3-235B-A22B-Instruct-2507は、速度と応答効率に重点を置いています。
タスクの種類に応じて使用するモデルを自由に選択できるため、各モデルの性能がより純粋になります。
いくつか典型的なケースを選んでみました。一緒にテストしてみましょう。
Alibaba Cloud Bailianの公式サイトにアクセスし、Qwen3-235B-A22B-Thinking-2507モデルを選択します。
すぐに使い始めることができます。
ケース1:非形式論理(落とし穴問題)
プロンプトワード遅刻したら、給料が減額されます。
今日は遅刻しなかったから、給料は減額されないよね?
Qwen3-235B-A22B-Thinking-2507は、思考プロセス全体を示しています。
それから彼らは、私が何が起こっているのかを理解できるように、段階的に説明してくれた。
結びは、明確かつ簡潔な要約となっている。
プレゼンテーション全体を通して、モデルがどのように思考し、論理を整理しているかを段階的に明確に理解することができました。さらに理解を深めるために、早退、タイムカードの打刻漏れ、作業ミスなど、賃金が差し引かれる可能性のある現実世界のシナリオ例も提示されました。
結論を伝えるだけでなく、なぜその結論に至ったのかも説明する必要があります。
ケース2:リスクとリターンの選択
プロンプトワード選択肢は2つあります。
A. 80元を受け取る確率は100%
B. 100元を獲得する確率は80%、0元を獲得する確率は20%です。
どちらを選びますか?その理由は?
Qwen3-235B-A22B-Thinking-2507は期待値を正しく計算しただけでなく、経済学をよく理解しており、オプションBの方が収益性が高い可能性があるが、不確実性も高いと正確に判断し、オプションAを選択した。
興味深い点の 1 つは、Qwen3-235B-A22B-Thinking-2507 が「As...」と言ったことです。AI「私には金銭的なニーズはないが、標準的な合理的エージェントをシミュレートすることができる」という点が、私に強い「思考する役割」を担っているという感覚を与えてくれる。
ケース3:精神力と論理力を測るテスト問題
プロンプトワード疑似科学的な記述を特定する
「あるブランドが『自社の飲料水はDNA頻度を高め、免疫力を向上させる』と主張しています。このような主張をどのように評価しますか?」
この質問は、科学における常識的な事柄のように思えるが、実際はそうではない…。単純このモデルは疑似科学を否定するために設計されているので、回答を見る限り、Qwen3-235B-A22B-Thinking-2507はそれを即座に見抜いただけでなく、私に簡単な科学の授業までしてくれた。
全体、Qwen3-235B-A22B-Thinking-2507は「思考能力」を備えているだけでなく、明晰な論理、厳密な推論、そして「言語の芸術」に対する深い理解も持ち合わせている。
次に、Qwen3-235B-A22B-Instruct-2507をテストします。
QwenChatでは(https://chat.qwen.ai)で、Qwen3-235B-A22B-2507モデルを選択してください。
ケース4 論理的推論
プロンプトワード「すべての鳥は飛べる」という命題が誤りであると仮定した場合、「一部の鳥は飛べない」と結論づけることができるでしょうか?三段論法を用いて、あなたの推論を説明してください。
Qwen3-235B-A22B-Instruct-2507で示されている論理的連鎖は非常に明確です。まず、「すべてのSはPである」の否定は「いくつかのSはPではない」であると指摘し、次に、私の要求に従って、三段論法を用いて「すべての鳥が飛べるわけではない」は「いくつかの鳥は飛べない」と同等であると推論しています。
「すべてのSがPであるとは限らない」と言うことは、必ずしも「一部のSはPではない」という意味になるのだろうか?
まず、簡潔で明確な答えがわかります。古典論理ではこれは同等ですが、非古典論理や特定の文脈(例えば、空クラス問題)では、必ずしも真とは限りません。
これができるということは、Qwen3-235B-A22B-Instruct-2507が単に論理規則を暗記しているのではなく、推論プロセスを真に「理解」していることを示している。
全体的に見て、Qwen3-235B-A22B-Instruct-2507は非常に優れた性能を発揮します。高速応答、安定した出力、明快なロジック。
Qwen3-Coderはリリース後すぐに人気を集めた。Twitterの創設者であるジャック・グロック氏も高く評価し、公式Grokアカウントがリツイートするほどだった。
Qwen3-Coderの性能を検証するために、動的なウェブページの作成、3Dカードの作成、教育デモンストレーション、バグ修正など、よく使われるシナリオをいくつか選びました。
ケース1:ローディングアニメーション
プロンプトワードHTML、CSS、JavaScriptを使用して、全画面表示のローディングアニメーションコンポーネントを作成します。読み込み中は、回転する惑星や幾何学的形状のアニメーションを表示し、読み込み完了後にメインコンテンツへとフェードインさせます。
ケース2:ウェブページスクロール時の視差効果
プロンプトワード背景画像がスクロールに合わせてゆっくりと動き、前景のテキストがスライドインするような、視差スクロール効果のあるウェブページの段落を作成してください。表紙の紹介文として最適です。
ケース3:パーティクル背景アニメーション
プロンプトワードHTML、CSS、JavaScriptを使用して、マウスの移動方向に応じて粒子が動く、クールなパーティクル背景アニメーションコンポーネントを作成します。自動それは透明な背景を持ち、ネットワークへと流れ込み、接続され、あらゆるウェブページに重ねて表示できる。
ケース4 アニメーションデモンストレーション
プロンプトワード複数の回転する円を使用して動的なアニメーションウェブページを生成します(フーリエ級数方形波が徐々に形成されていく。円が端から端へと繋がれ、その端がダイナミックな軌跡を描きながら方形波を形成する。画像の背景は黒、線は鮮やかなネオンカラーで、軌跡には残像や残響効果が見られる。ミニマルでありながら目を引くスタイルで、数学的な視覚化デモンストレーションに適している。
ケース5 3Dカード
プロンプトワードHTMLとCSSを使用して、3Dフリップカード表示コンポーネントを生成します。マウスカーソルをカードの上に置くと、カードが前後にフリップして、滑らかな3Dアニメーションで異なるコンテンツを表示します。
ケース6:バグの修正
プロンプトワードあなたはフロントエンド開発アシスタントです。以下は「かっこいい銀河の星の軌跡」を生成するために使用したCanvasアニメーションです。ユーザーからのフィードバックは「ページが真っ黒で何も表示されず、アニメーションが全くないように感じます」です。原因を特定し、問題点を説明し、コードを修正してください(必要な部分のみ変更してください)。
<canvasid="space">canvas><script>const canvas = document.getElementById("space");const ctx = canvas.getContext("2d");canvas.width = window.innerWidth;canvas.height = window.innerHeight;
let stars = [];for (let i = 0; i < 200; i++) {stars.push({angle: Math.random() * 2 * Math.PI,radius: Math.random() * (canvas.width / 2),speed: 0.01 + Math.random() * 0.02,size: Math.random() * 2 + 1,color: `hsl(${Math.random() * 360}, 100%, 70%)`});}
function draw(){ctx.fillStyle = "rgba(0, 0, 0, 0.1)";ctx.fillRect(0, 0, canvas.width, canvas.height);
ctx.save();ctx.translate(canvas.width / 2, canvas.height / 2);
for (let star of stars) {let x = Math.cos(star.angle) * star.radius;let y = Math.sin(star.angle) * star.radius;
ctx.beginPath();ctx.arc(x, y, star.size, 0, Math.PI * 2);ctx.fillStyle = star.color;ctx.fill();
star.angle += star.speed;}
ctx.restore();
// ❌ BUG:忘了动画递归调用// draw();}draw();script>
ページはこのように表示されます。
それはすぐに具体的な原因と解決策を特定し、最終的にどのような調整を行ったかを私に伝えてくれた。
アニメーションは正しく表示され、星の軌跡効果も現れます!
これらのケースをテストした結果、Qwen3-Coderに対する私の最大の印象は、単にコードを書くだけでなく、正確かつ巧みにコードを書くということです。
動的なアニメーション、3Dコンポーネント、インタラクティブなデバッグ、コードの修正など、あらゆることを処理できます。速い指示を理解し、構造が整然とした安定したウェブページコードを生成できる。さらに驚くべきことに、状況に応じて適応することもできる。自動ロジックと相互作用の詳細を記入してください。
まだ完成していませんが Agent 枠組みは既に存在しているが、「生成→実行→調整」という閉じたループの観点から見ると、既に非常に近い状態にある。 Agent これはワークフローです。
Qwen3の3つの新モデルを試用した後、私が最初に思ったのは、「Qwenはより速い速度を追求しているのではなく、より正確な速度を追求しているのだ」ということだった。
いいえ単純パラメータを積み重ねることは、ベンチマークスコアを誇示するためではなく、実際のタスクやユーザーのニーズに合わせて真に最適化するためです。
近年では、大型モデルこの分野は活気に満ちており、パラメータはますます大きくなり、名前も増え、更新頻度もますます高くなっているが、物事を迅速に行うことは、着実に行うこととは限らない。
モデルは表面的なものに過ぎず、その背後にはチップ、データ、ツールチェーン、そしてアルゴリズムから製品に至るまでの完全なループが存在する。
複雑なシステムにおいて、一貫して安定的に質の高い成果を生み出すためには、真に最後までやり遂げる人は、最も爆発的なブレークスルーを起こす人ではなく、むしろ最も深く投資し、最も強固な基盤を築く人であることが多い。
企業によっては時折優れた施策を実行することもあるが、安定したペースと継続的な生産を維持するためには、長期的な投資と体系的な能力に頼る必要がある。
近年、アリババは AI クラウドコンピューティングをはじめとする関連分野への投資は、継続的に行われています。頻繁なモデル更新の背景には、アルゴリズムチームの努力だけでなく、インフラストラクチャ、コンピューティングプラットフォーム、エンジニアリングシステムへの長期的な取り組みがあります。
からDAMOアカデミー研究、一般的な意味大型モデルアリババは、その進化からアリババクラウドによって支えられる基盤機能に至るまで、アルゴリズムとコンピューティング能力、そしてモデルから製品までをシームレスに統合できる、中国でも数少ない企業の1つである。 AI サプライチェーン全体を網羅する企業のひとつ。
以前は、「国内製品…」と質問していました。 AI 追いつけるかな? GPT今日から、私たちはこう問いかけることができる。「なぜ業界標準を定めることができないのか?」