Qwen3Guard - Alitongyiが発表したセキュリティ保護モデル
Qwen3Guardは、セキュリティ保護のために特別に設計されたQwenファミリー初のガードレールモデルで、Alibaba Tongyiチームによって発表されました。堅牢なQwen3アーキテクチャに基づいて構築されています。このモデルは、セキュリティ分類タスク向けに特別に微調整されており、効率的な処理を可能にします。
Qwen3Guardは、セキュリティ保護のために特別に設計されたQwenファミリー初のガードレールモデルで、Alibaba Tongyiチームによって発表されました。堅牢なQwen3アーキテクチャに基づいて構築されています。このモデルは、セキュリティ分類タスク向けに特別に微調整されており、効率的な処理を可能にします。
Qwen3-Maxは、Qwenチームが開発した大規模マルチスケール言語モデルで、事前学習には1Tを超えるパラメータと36Tトークンが使用されています。Qwen3-Maxは現在、Qwenシリーズの中で最大かつ最も強力なモデルであり、卓越した性能を備えています。
Qwen3-VLは、アリババ同義が発表したQwenシリーズの中で最も強力なビジュアル言語モデルであり、優れたマルチモーダル機能を備えています。このモデルは、プレーンテキスト、画像、動画を理解でき、長文コンテキスト、空間認識、コード生成などの機能をサポートしています。
Qwen3-LiveTranslateは、Ali Tongyiチームが開発した多言語リアルタイム音声・動画同時通訳モデルで、大規模な言語モデルに基づいています。このモデルは18言語と複数の方言の翻訳をサポートし、リップシンクと組み合わせることができる視覚強化技術を備えています。
Wan2.5は、アリババの最新のマルチモーダル生成モデルであり、プレビュー版(Wan2.5-Preview)には、テキストからビデオへの変換、画像からビデオへの変換、テキストから画像への変換、画像編集という4つの主要機能が含まれています。
MiroFlow v0.2は、MiroMindが開発したオープンソースの研究エージェントフレームワークです。あらゆる大規模言語モデル(LLM)をOpenAIのディープラーニング機能レベルまでアップグレードすることができ、複雑なツール使用タスクを確実に完了させることに重点を置いています。
LucaVirusは、Alibaba Cloud LucaGroupが開発した、ウイルスに特化した統合型核酸・タンパク質言語モデルです。254億個のヌクレオチドおよびアミノ酸タグで学習されており、既知のほぼすべてのウイルスを網羅しています。このモデルは学習が可能で、…
Audio2Faceは、NVIDIAが開発したAI顔アニメーション生成モデルで、音声入力からリアルな顔アニメーションを生成できます。このモデルは、音声の音素とイントネーションを分析してキャラクターの唇の動きと表情を制御し、正確な顔アニメーションを実現します。
CWM(Code World Model)は、Metaがオープンソース化した320億個のパラメータを持つコードワールドモデルです。コード生成にワールドモデルを体系的に導入した世界初の言語モデルであり、コード生成と理解をサポートします。
Neovate Codeは、Ant Groupが開発したオープンソースのインテリジェントプログラミングアシスタントで、開発効率の向上に重点を置いています。このツールはコードベースを深く理解し、既存のコーディング慣習に従い、コード生成、バグ修正、リファクタリングなどのタスクを正確に実行します。
Vidu Q2は、Shengshu Technologyが発表した新世代の画像生成ビデオモデルであり、AIビデオ生成技術において「ビデオ生成」から「演技生成」への飛躍を実現し、「リアルさ」を追求するAIビデオ開発の新時代を切り開きます。Vidu Q2は、…
AudioFlyは、iFlytekが開発したテキストから音声効果を生成するためのオープンソースAIモデルです。このモデルは潜在拡散モデルアーキテクチャを採用し、10億個のパラメータを持ち、AudioSet、AudioCaps、TUTなどの多数のオープンデータセットに加え、独自の内部データも活用しています。
SimpleFoldは、Appleが開発したタンパク質フォールディング予測のための軽量AIモデルです。フローマッチング技術に基づいており、多重配列アライメント(MSA)などの複雑なモジュールを省略し、ランダムノイズから直接タンパク質フォールディング予測を生成します。
FLM-Audioは、北京人工知能研究院、スピンマトリックス、シンガポールの南洋理工大学が共同で発表したネイティブ全二重音声対話モデルです。中国語と英語の両方をサポートしています。ネイティブ全二重アーキテクチャを採用しており、…
Spark Chemistry-X1-13Bは、iFlytekがオープンソース化した大規模な化学言語モデルです。iFlytek Spark X1-0420モデルをベースに、様々な化学タスクデータセットで微調整されており、複雑な化学問題を解決する優れた能力を発揮します。
GDPvalは、OpenAIが立ち上げた新しい評価フレームワークで、現実世界の経済価値タスクにおけるAIモデルのパフォーマンスを測定します。GDPvalは、米国のGDPに最も貢献している9つの産業から44の職業を選択し、1320のタスクを設計します。
Hunyuan3D-Omniは、TencentのHunyuan3Dチームが提案した3Dアセット生成フレームワークです。様々な制御信号を通して高精度な3Dモデル生成を実現します。Hunyuan3D 2.1アーキテクチャをベースに、統一された制御プログラミングを導入しています。
Hunyuan 3D-Partは、Tencentが開発した3Dジェネレーティブモデルで、P3-SAMとX-Partで構成されています。高精度で制御可能なコンポーネントベースの3D生成を初めて実現し、50種類以上のコンポーネントの自動生成をサポートしています。ユーザーはまずHunyuan 3D 2.5または3.0を使用して生成できます...
StableAvatarは、復旦大学、マイクロソフトリサーチアジアなどが開発した、音声駆動型の革新的な仮想アバター動画生成モデルです。このモデルは、エンドツーエンドの動画拡散トランスフォーマーと、タイムステップ対応の音声アダプタ、ネイティブ音声などを組み合わせて利用しています。
CoF(Chain-of-Frames)は、DeepMindが提唱した新しい概念であり、言語モデルにおける「Chain-of-Thought」(CoT)に類似している。
Manzanoは、Appleが開発した新しいマルチモーダル大規模言語モデル(LLM)で、画像理解と画像生成を同時に実現できます。このモデルは、ハイブリッドビジョントークナイザーを使用して画像を変換します。
KAT-Dev-32Bは、Kuaishou Kwaipilotチームがリリースしたオープンソースのインテリジェント大規模モデルで、32億個のパラメータを誇ります。SWE-Bench Verifiedベンチマークテストでは62.4%の解率を達成し、5位にランクインしました。このモデルは、...
KAT-Coderは、Kuaishou傘下のKwaipilotチームがリリースしたクローズドソースの主力コード生成モデルであり、強力なプログラミング機能を備えています。機能開発、欠陥分析、単体テスト生成などのタスクを効率的に完了でき、複数のプログラミング言語をサポートしています。
JoySafetyはJD.comのオープンソース大規模モデルセキュリティフレームワークであり、企業に成熟した信頼性の高い無料の大規模モデルセキュリティ保護ソリューションを提供します。このモデルは、BERT、FastText、Transformerなどの様々なアトミック機能モジュールに基づいています。