AgentCanvas - VstormのオープンソースPydantic AI可視化ツール
AgentCanvasは、Vstormが提供するオープンソースのPydantic AI可視化ツールです。Logfireトラッキングと統合されたAIエージェントの実行時ログを自動的にインタラクティブなHTMLフローチャートレポートに変換し、各ステップを明確に表示します。
AgentCanvasは、Vstormが提供するオープンソースのPydantic AI可視化ツールです。Logfireトラッキングと統合されたAIエージェントの実行時ログを自動的にインタラクティブなHTMLフローチャートレポートに変換し、各ステップを明確に表示します。
ACE-Egoは、DaXiao Roboticsが香港中文大学のMMLabと共同開発した、オープンソースの脳ベースのマルチモルフィック身体操作(VLA)モデルです。このモデルは、6,000時間以上の人間の一人称視点ビデオを使用して事前学習されており、カメラ空間の動きと形態学的条件を組み込んでいます。
Image-to-LoRA-V2 (i2L-V2) は、Moda コミュニティが開発したオープンソースのトレーニング不要のスタイル変換ツールです。1~8 枚のスタイル画像をアップロードし、単一の推論で生画像モデルの LoRA ウェイトを予測できます。
Qwen-Robot Suiteは、物理世界における知能を実現するためにアリババ同義が開発した基盤となるモデルスイートです。これには、Qwen-RobotNav(ナビゲーション)、Qwen-RobotManip(操作)、Qwen-RobotWorld(世界モデル)などが含まれます。
turbovecは、Google ResearchのTurboQuantアルゴリズムのオープンソース実装です。Rustで記述され、Pythonバインディングも付属しており、RAGシナリオ向けの高性能ベクトルインデックスライブラリです。このツールは、データに依存しない量子化戦略を採用しています。
Seedance 2.0 Miniは、ByteDanceのVolcano Engineによって開発された、コスト効率が高く軽量なビデオ生成モデルです。コアとなるマルチモーダルリファレンス生成機能を維持しながら、生成コストを約50%削減し、Seedanceへの変換速度を向上させています。
OpenSquillaは、オープンソースで自己ホスト型のトークンベースの高効率マイクロカーネルAIエージェントランタイムであり、「同じ予算でより高い知能密度」を重視しています。最小限のマイクロカーネルアーキテクチャ(コアは約100行のコードのみ)を採用し、ローカルMLを活用しています。
Ponytailは、オープンソースのAIエージェントコード削減プラグインです。Claude Code、Codex、Cursorなど、10種類以上の主要なAIコーディングツールに、経験豊富で怠惰な開発者のミニマリスト的な思考を注入することで、エージェントにコード記述の簡素化を促します。
Gemini-SQL2は、Google Researchが開発した最新のAIモデルで、Gemini 3.1 Proをベースにしており、最高レベルのテキストからSQLへの変換機能を誇ります。このモデルは、BIRDベンチマークのシングルモデルトラックで80.04%の精度を達成しました。
GLM-5.2は、Zhipuが発表した次世代のオープンソース大規模モデルです。100万のコンテキストを持ち、MITライセンスの下でオープンソース化されています。エージェントコーディングと超長コンテキスト機能に重点を置いています。
PP-OCRv6は、Baidu PaddleOCRチームが発表した第6世代のオープンソースOCRモデルです。今回初めて、Tiny(1.5M)、Small(7.7M)、Medium(34.5M)の3つのモデルサイズを導入し、ブラウザからサーバーまでの全プロセスをカバーしています。
openPangu 2.0は、HuaweiのオープンソースPangu大型モデルのメジャーアップグレードであり、最大505BパラメータのProバージョンと92BパラメータのFlashバージョンを提供します。すべてのモデルは、512Kの超ロングコンテキスト、Ascendを使用したネイティブ深度チューニング、および...
SkillSpectorは、NVIDIAが提供するオープンソースのAIエージェントスキルセキュリティスキャンツールです。Claude Code、Codex CLI、Gemini CLIなどのプラットフォームにスキルをインストールする前に、脆弱性、悪意のあるパターン、セキュリティリスクを自動的に検出できます。
Kimi K2.7コードは、Moonshot AIがオープンソース化した新世代プログラミングモデルです。K2.6と比較して、長コンテキストプログラミングシナリオにおける命令遵守率と長時間実行タスクのパフォーマンスが大幅に向上し、過剰な思考を軽減します。
html-ppt-skillは、HTMLベースのAIプレゼンテーションスキルです。このツールは、ブラウザがネイティブにサポートするHTMLファイルの出力に対応しており、36種類のテーマ、31種類のレイアウト、47種類のアニメーション、15種類の完全なテンプレートが含まれています。(アジェンダ…)
SwarmFlowは、openJiuwenが開発したオープンソースのマルチエージェント制御型ワークフローオーケストレーションフレームワークです。オーケストレーションとインテリジェンスを分離し、協調プロセスはシステムによって安定的に実行され、推論と判断はエージェントによって処理されます。
EvoQualityは、ByteDanceと香港城市大学が共同で開発した、自己進化型のビジュアル言語モデルフレームワークであり、参照画像のない画像の品質評価に重点を置いています。
Hojo-ASR-V1は、スタートアップチームHojoが開発したオープンソースの自動音声認識モデルです。Whisper特徴抽出、Qwen3-Omni音声エンコーディング、Conformer適応、Qwen3-4B言語モデルデコーディングというアーキテクチャを採用しています。
HPC-Opsは、Tencent Hunyuan AI Infraチームが開発した、オープンソースの産業グレード高性能大規模モデル推論演算子ライブラリです。アテンション、MoE、GEMM、サンプリング、通信融合などのコアモジュールを網羅し、BF16/FP8および混合精度をネイティブにサポートしています。
HiDream-O1-Image-1.5は、Zhixiang Futureが開発した商用利用可能な画像生成モデルで、ネイティブのフルモーダルUiTアーキテクチャに基づいています。人工知能による生画像解析のリーダーボードにおいて、ELOスコア1265で世界第3位、中国国内第1位にランクインしています。
MiMo Codeは、Xiaomiの大規模モデル開発チームが開発したオープンソースの端末AIプログラミングアシスタントです。OpenCodeをベースにしており、MITライセンスで提供されています。MiMo Codeには、期間限定で無料提供されているMiMo-V2.5マルチモーダルモデルが含まれており、さらに…をサポートしています。
SpaceMindは、iFlytek社が開発したインテリジェントな宇宙エージェントアーキテクチャであり、宇宙をレベル2.5の能動的なインテリジェントエージェントへと進化させ、知覚、理解、記憶、意思決定、実行能力を備える。
DiffusionGemmaは、Google DeepMindが公開した実験的なオープンソースのテキスト拡散モデルです。このモデルは、Gemma 4アーキテクチャとGemini Diffusionの研究に基づいて構築されており、26B MoE設計を採用し、並列拡散を利用しています。
Khalaは、中央音楽学院と清華大学が共同開発したオープンソースのAI音楽モデルで、高忠実度な楽曲生成を目的としています。このモデルは64層の深層音響トークン階層を採用し、テキストによる説明や歌詞に基づいた楽曲生成をサポートしています。