YouClaw - Chat2DBチームが開発したAIエージェントのデスクトップクライアント。
YouClawは、Chat2DBチームが開発したミニマルなAIエージェントデスクトップクライアントで、AIパーソナルアシスタントとして位置づけられています。このツールは学習曲線がゼロであることを重視しており、環境設定やコーディングは不要です。ダウンロードしてQRコードをスキャンするだけで使用できます。YouClawは…をサポートしています。
YouClawは、Chat2DBチームが開発したミニマルなAIエージェントデスクトップクライアントで、AIパーソナルアシスタントとして位置づけられています。このツールは学習曲線がゼロであることを重視しており、環境設定やコーディングは不要です。ダウンロードしてQRコードをスキャンするだけで使用できます。YouClawは…をサポートしています。
Granite-4.0-1b-speech は、IBM が提供するオープンソースの 10 億パラメータの多言語音声モデルです。英語、フランス語、ドイツ語、スペイン語、ポルトガル語、日本語の音声認識に加え、英語との双方向翻訳にも対応しています。また、英語から日本語への翻訳もサポートしています。
Xiaomi MiMo-V2-Omniは、Xiaomiが発表したマルチモーダルエージェントの基本モデルであり、テキスト、画像、音声のモダリティを統合し、知覚、推論、実行機能をネイティブに備えている。
Xiaomi MiMo-V2-Proは、エージェント時代におけるXiaomiのフラッグシップ大型モデルであり、1兆を超えるパラメータ(420億のアクティベーションパラメータ)と、100万トークンの超ロングコンテキストをサポートしています。
Qianfan-OCRは、Baidu Qianfanが開発したエンドツーエンドのインテリジェント文書モデルです。4Bパラメータ視覚言語アーキテクチャに基づいており、文書解析、レイアウト分析、テキスト認識、意味理解を統合しています。
EdgeClawは、Facewall Intelligence、清華大学、OpenBMBが共同開発したオープンソースのAIエージェントフレームワークです。エッジクラウド連携、ローカル展開、セキュリティ、制御性を重視しています。このフレームワークは、公開情報におけるデータセキュリティを確保するために、3層構造のデータセキュリティプロトコル(S1/S2/S3)を先駆的に導入しました。
Xiaomi MiMo-V2-TTSは、Xiaomiがエージェント時代に向けて開発した大規模音声合成モデルです。独自開発のオーディオトークナイザーとマルチコードブックアーキテクチャに基づき、数億時間分の音声データを用いた事前学習と多次元強化学習を経て開発されました。
GPT-5.4 nanoは、OpenAIがリリースしたGPT-5.4の中で最も軽量かつ最速のバージョンであり、極めて高い速度とコストが求められる、シンプルで高スループットなタスク向けに設計されています。
GPT-5.4 miniは、OpenAIが開発した最も高性能な小型モデルであり、高スループットかつ低遅延のシナリオ向けに設計されています。前身のGPT-5 miniと比べて2倍以上の速度を誇り、プログラミング、推論、マルチモーダル理解、コンピュータ利用などのタスクにおいて卓越した性能を発揮します。
Midjourney V8は、Midjourneyの最新画像生成モデルであり、従来モデルより5倍高速で、単語認識とテキストレンダリングが大幅に改善され、2Kの高解像度出力に対応しています。
MindVLA-o1は、Li Autoが発表した次世代自動運転の基本モデルです。独自のマルチモーダルMoEアーキテクチャを採用し、視覚、言語、行動の3つのモダリティを統合しています。
MiniMax M2.7は、Xiyu Technologyが発表した新世代の自己進化型AIモデルです。エージェントハーネスを自律的に構築し、独自のトレーニングプロセスを最適化し、自己反復に参加できます。ソフトウェアエンジニアリングに優れており、SWE-Proモデルは…
Covo-Audioは、Tencentが開発したオープンソースの70億パラメータを持つエンドツーエンドの音声モデルで、連続音声入力を直接処理し、音声出力を生成することができます。その中核となるイノベーションには、階層的な3モード音声テキストインターリーブアーキテクチャ、インテリジェントな話者デコードなどが含まれます。
Leanstralは、Mistral AI初のオープンソースAIコードエージェントであり、リーン4定理の証明に特化して設計されています。このモデルは、合計120B個のパラメータと6B個の活性化パラメータを持つ疎なアーキテクチャを採用しており、形式証明の自動生成とコード検証が可能です。
NemoClawは、NVIDIAが提供するオープンソースのエンタープライズグレードAIエージェントフレームワークです。OpenClawのプラグインとして動作するNemoClawは、OpenShellランタイムを介してセキュリティサンドボックスとポリシーエンジンを提供し、AIエージェントを使用する企業のセキュリティ上の懸念に対応します。
Mistral Small 4は、Mistral AIが開発したオープンソースのマルチモーダル大規模モデルです。推論(Magistral)、マルチモーダル(Pixtral)、エージェントコーディング(Devstral)の機能を単一のアーキテクチャに統合した初のモデルであり、テキストをサポートしています。
AgentScope Javaは、Alibabaが提供するエンタープライズレベルのインテリジェントエージェント開発のためのオープンソースJavaフレームワークです。Java開発者は、このフレームワークを利用することで、実運用レベルのAIアプリケーションを容易に構築できます。このフレームワークは、最先端のReActパラダイムを採用しており、大規模モデルが自律的な推論能力を持つことを可能にします。
OpenMAICは、清華大学のチームが開発したオープンソースのマルチエージェントAI教室プラットフォームです。あらゆるトピックやドキュメントを、ワンクリックで没入型でインタラクティブなコースに変換できます。このプラットフォームは、音声講義を行うAI教師、議論のために挙手するAI生徒、リアルタイムのホワイトボード描画をサポートし、さらに…
Fun-CineForgeは、Tongyi Labsがオープンソース化した初の映画グレードのマルチモーダル吹き替えモデルです。CosyVoice3をベースに構築され、革新的な「時間的モダリティ」を導入することで、正確な音声と映像の同期を実現しています。このモデルは、モノローグ、ナレーション、対話、複数人シーンなどに対応しています。
GLM-5-Turbo(コードネーム:Pony-Alpha-2)は、Zhipu AIが開発した基盤モデルであり、OpenClaw(ロブスター)エージェントのシナリオ向けに高度に最適化されています。トレーニング段階から、このモデルはツールの呼び出し、複雑な命令の遵守、タイミング、および…に対応するように設計されています。
OpenJarvisは、スタンフォード大学のスケーリング・インテリジェンス・ラボが開発したオープンソースのローカルAIエージェントフレームワークです。その中核となるコンセプトは、AIの実行を完全にローカル化し、クラウドアクセスはオプションとすることです。このフレームワークは、統一された...
Paperclipは、複数のAIエージェント(OpenClaw、Claude、Cursorなど)を真の「サイバー企業」として組織化できるオープンソースのAIエージェントオーケストレーションプラットフォームです。このプラットフォームは、包括的なエンタープライズ管理アーキテクチャを提供します。
Clawithは、企業向けのオープンソースのハイブリッドマルチエージェントコラボレーションフレームワークであり、AIエージェントを単なるチャットツールではなく「デジタル従業員」として扱います。各エージェントは、永続的なID(soul.md)、長期記憶(memory.md)、および独立した...
Kairos 3.0-4Bは、DaXiao Roboticsが開発したオープンソースの具現化されたネイティブワールドモデルであり、「マルチモーダルな理解・生成・予測」という統合アーキテクチャを先駆的に採用しています。エンドサイドロボットボディ制御が可能な世界初の軽量4Bモデルとして、THORプラットフォーム上に実装されています。