OpenDeRisk - オープンソースのAIネイティブリスクインテリジェンス管理システム
OpenDeRiskは、アプリケーションシステムを24時間365日包括的に保護するAIネイティブのリスクインテリジェンス管理システムです。ディープリサーチRCAに基づき、システムの根本原因を迅速に特定し、さらに…
OpenDeRiskは、アプリケーションシステムを24時間365日包括的に保護するAIネイティブのリスクインテリジェンス管理システムです。ディープリサーチRCAに基づき、システムの根本原因を迅速に特定し、さらに…
MemUは、AIを活用した感情的なコミュニケーションを実現するためのオープンソースのAIメモリフレームワークです。MemUは、ユーザーとAI間のあらゆる会話を記憶し、重要なポイントを抽出し、知識グラフを構築することで、AIがユーザーを真に理解することを可能にします。
Chatermは、クラウド専門家やDevOpsエンジニア向けに設計された、オープンソースでインテリジェントかつ安全なAIエンドポイントツールです。AIエージェントをベースとしており、複雑なコマンドライン操作の代わりに自然言語を使用できます。Chatermは、個人の知識に基づいてアクセスを提供します。
AudioGenieは、Tencent AI Labが開発したマルチモーダル音声生成ツールです。動画、テキスト、画像など、複数のモーダル入力から、効果音、音声、音楽など、さまざまな音声出力を生成できます。このツールは、トレーニング不要のマルチエージェントアプローチを採用しています。
Qwen-Image-Editは、200億個のパラメータを持つQwen-Imageアーキテクチャに基づいて構築された、汎用性の高い画像編集モデルです。このモデルは、意味的編集機能と視覚的編集機能の両方を備えており、低レベルの視覚的編集(追加、削除など)を可能にします。
Open-Lovableは、Firecrawlチームによるオープンソースプロジェクトで、AI技術を用いてあらゆるウェブサイトを最新のReactアプリケーションに迅速にクローンします。ユーザーが対象ウェブサイトのURLを入力すると、Firecrawlがコンテンツをクロールします...
Klear-Reasonerは、KuaishouがQwen3-8B-Baseをベースに開発した推論モデルで、数学的推論能力とコード推論能力の向上に重点を置いています。このモデルは、ロング思考連鎖教師ありファインチューニング(long CoT SFT)と強化学習(RL)によって学習されます。
Nano Bananaは、Googleが開発したAI画像生成・編集モデルです。Gemini 2.5 Flash Image(コードネーム:Nano Banana)モデルは、顔の再現性が非常に高く、顔の特徴や表情を正確に再現します。
CombatVLAは、Taotian GroupのFuture Life Labチームが開発した高効率な視覚・言語・動作(VLA)モデルで、3DアクションRPG(ARPG)の戦闘ミッション向けに特別に設計されています。このモデルは3Bパラメータスケールに基づいており、...
NVIDIA Nemotron Nano 2は、NVIDIAが提供する高性能推論モデルで、パラメータ数は9バイトです。このモデルは、ハイブリッドMamba-Transformerアーキテクチャに基づいており、20兆トークンで事前学習済みで、128kのコンテキスト長をサポートしています。
DeepSeek V3.1は、DeepSeekがリリースした最新のAIモデルバージョンで、思考モードと非思考モードをシームレスに切り替えられるハイブリッド推論アーキテクチャを採用し、思考効率を大幅に向上させています。このモデルは、V3と比較していくつかのアップグレードが施されており、その中には…
AutoCodeBenchは、テンセント渾源が大規模プログラミングモデルのコーディング能力を評価するために特別に開発したベンチマークデータセットです。20種類のプログラミング言語に均等に分散された3920問で構成されています。このデータセットは、難易度、実用性、多様性に優れており、…
Seed-OSSは、ByteDanceのSeedチームがオープンソース化した大規模言語モデルシリーズで、長文テキスト処理、推論、インテリジェントエージェント機能に重点を置いています。このモデルには、Seed-OSS-36B-BaseやSeed-OSS-36B-Iなど、複数のバージョンが含まれています。
ToonComposerは、香港中文大学、テンセントPCG ARCラボ、北京大学の研究者らが共同開発した生成型AIツールです。スケッチを数秒でプロレベルのアニメーションに変換できます。ToonComposerは生成型ポストプロセス技術に基づいています。
Intern-S1-miniは、上海人工知能研究所が開発した軽量のオープンソース・マルチモーダル推論モデルです。Intern-S1と同じ技術を用いて構築されています。このモデルは、8ビットの密な言語モデル(Qwen3)と0.3ビットの視覚エンコーディングを統合しています。
Fun-ASRは、DingTalkとTongyi Labsの音声認識チームが共同開発した次世代音声認識モデルです。膨大な量の音声データで学習されており、インターネット、テクノロジー、インテリア、畜産など10以上の業界の専門用語を正確に認識できます。
Grok 2.5は、イーロン・マスク氏が設立したxAI社が開発したオープンソースの人工知能モデルです。Hugging Faceでダウンロード可能なモデルファイルは42個のファイルで構成され、合計サイズは約500GBです。実行には、それぞれ40GB以上の専用メモリを搭載した8つのGPUが必要です。
Prompt Optimizerは、AI出力の質を向上させるために、ユーザーが高品質なプロンプトを迅速に作成できるオープンソースのAIプロンプト最適化ツールです。ワンクリックでプロンプトを最適化でき、複数回の反復改善をサポートし、AI応答の精度を高めます。
ComoRAGは、華南理工大学未来技術研究所、WeChat AIチーム、およびその他の機関が共同で開発した、認知ヒューリスティック検索拡張生成(RAG)フレームワークです。特に、長文の物語テキストの理解と推論を目的として設計されています。
SlowFast-LLaVA-1.5(略称SF-LLaVA-1.5)は、長時間の動画理解のために特別に設計された高効率な動画言語モデルです。2ストリーム(SlowFast)メカニズムに基づいて、より多くの入力フレームを処理することと、フレームあたりのトークン数を削減することのバランスを取っています。
FutureXは、ByteDance、復旦大学、スタンフォード大学、プリンストン大学の研究チームが共同でリリースした、動的なリアルタイム評価ベンチマークであり、LLMエージェントの未来予測タスク向けに特別に設計されています。195のデータセットを評価するために半自動化されたパイプラインを使用しています。
AskXiaoBaiO4は、中国初の並列思考モデルであり、8つの思考経路を同時に起動し、最適な解決策を自動的に選択して、正確な回答を提供することができます。このモデルは、Long-CoT強化学習とプロセス報酬学習を統合しており、深い推論能力と質の高い思考能力を備えています。
XBai o4は、オープンソースの大規模言語モデルであり、「反射生成形式」で学習され、長尺のCoT強化学習と手続き型報酬学習を組み合わせています。複雑な推論において優れた性能を発揮し、中級モードではOpenAI-o3-miniを凌駕しています。
DeepCodeは、香港大学データインテリジェンス研究所が開発した、マルチエージェントシステムに基づくコード生成プラットフォームです。DeepCodeは、研究論文、自然言語による記述、その他のリソースを、さまざまなエンコーディング方式に対応した高品質で実用レベルのコードに変換できます。