RedOneは、Xiaohongshuがソーシャルネットワーキングサービス(SNS)分野向けに開発した初のカスタム大規模言語モデル(LLM)です。このモデルは3段階のトレーニング戦略を採用し、社会的・文化的知識を取り入れることでマルチタスク機能を強化し、プラットフォームの標準規格に準拠しています。
RedOneは、Xiaohongshuがソーシャルネットワーキングサービス(SNS)分野向けに開発した初のカスタム大規模言語モデル(LLM)です。このモデルは3段階のトレーニング戦略を採用し、社会的・文化的知識を取り入れることでマルチタスク機能を強化し、プラットフォームの標準規格に準拠しています。
Windows-MCPは、AIエージェントをWindowsシステムに統合するための軽量なオープンソースツールです。MCPサーバーとして、Windows-MCPは大規模言語モデル(LLM)がWindowsと直接やり取りすることを可能にし、ファイル閲覧、アプリケーションへのアクセスなどを実現します。
MCP Server Chartは、AntVチームが開発した可視化チャート生成ツールです。モデルコンテキストプロトコル(MCP)に基づいており、一般的な統計チャート(例:...)を含む25種類以上の可視化チャートをサポートしています。
OAgentsは、OPPO PersonalAI Labが開発したオープンソースの基盤エージェントフレームワークです。標準化された評価プロトコルとモジュール設計に基づき、エージェントフレームワークの研究を促進します。OAgentsは、実証的なシステム研究に基づいて主要なAI機能を分析します。
WorldVLAは、アリババDAMOアカデミーと浙江大学が共同開発した自己回帰型アクションワールドモデルです。このモデルは、視覚言語アクション(VLA)モデルとワールドモデルを単一のフレームワークに統合しています。このモデルは、アクションと画像処理に基づいています。
AnimaXは、北京航空航天大学が清華大学、香港大学などと共同で開発した高効率3Dアニメーション生成フレームワークです。ビデオ拡散モデルからのアクション事前情報とスケルトンベースのアニメーション構造を組み合わせています。このフレームワークは、ビデオからアニメーションを生成できます。
Ovis-U1は、アリババグループのOvisチームが開発したマルチモーダル統合モデルで、30億個のパラメータを誇ります。このモデルは、高度なアーキテクチャと協調的な統合に基づき、マルチモーダル理解、テキストから画像への変換、画像編集という3つのコア機能を統合しています。
Deep Video Discovery (DVD) は、Microsoft が提供する、長尺動画の理解と分析に特化したディープビデオ検出エージェントです。Deep Video Discovery は、大規模な言語処理に基づいて、長尺動画を複数の短いセグメントに分割します。
FairyGenは、ベイエリアの大学によって開発されたアニメーションストーリービデオ生成フレームワークです。手描きのキャラクタースケッチ1枚から、一貫性のあるストーリーと統一されたスタイルのアニメーションストーリービデオを生成することをサポートします。このフレームワークは、マルチモーダルな大規模言語モデル(...
OmniGen2は、北京人工知能研究院が開発したオープンソースのマルチモーダル生成モデルです。テキストプロンプトに基づいて高品質な画像を生成でき、背景や顔の特徴の変更など、指示に基づいた画像編集をサポートしています。OmniGen2は…
Qwen-TTSは、アリババ同義が開発した音声合成モデルで、自然で安定した高速なパフォーマンスが特徴です。テキストと音色パラメータに基づいて高品質な音声を出力でき、中国語、英語、北京語、上海語などの方言の合成に対応しています。
Speakerは、会議の録音の文字起こし、内容の要約、インテリジェントな質疑応答を自動化し、データのプライバシーを完全に保護する、無料のオープンソースAI会議アシスタントです。Speakerはインターネット接続なしで動作し、すべてのデータ処理はリモートで行われます。
Goedel-Prover-V2は、プリンストン大学、清華大学、NVIDIAなどの一流機関が共同開発したオープンソースの定理証明器です。Goedel-Prover-V2は、階層型データ合成、検証者主導の自己修正、モデル化などの手法を採用しています。
Decart AIチームが開発したMirageLSDは、世界初のライブストリーム拡散AIビデオモデルです。40ミリ秒という低遅延で無制限の長さのリアルタイムビデオ生成を可能にし、さらに…
ChatFlowは、ユーザーが設計した高品質なワークフローとAI生成機能を組み合わせた、オープンソースで使いやすいワークフローエンジンです。ChatFlowはビジュアルコンポーネントと自動実行をサポートしており、開発者がコードを迅速に生成するのに役立ちます。
Fogsightは、大規模言語モデル(LLM)によって駆動されるアニメーション生成エージェントです。ユーザーが抽象的な概念や単語を入力すると、高品質で鮮やかなアニメーションが生成されます。そのコア機能には、「概念を画像に変換する」機能が含まれており、入力されたトピックを…に変換します。
OpenBBは、個人および企業向けに強力な投資調査ツールを提供するオープンソースの金融プラットフォームです。このプラットフォームは、株式、オプション、暗号通貨、外国為替、マクロ経済、債券など、さまざまな金融データを統合し、Pythonをサポートしています。
OpenReasoning-Nemotronは、NVIDIAがオープンソース化した強力な大規模言語モデル(LLM)シリーズです。DeepSeek R1 0528モデルをベースに開発され、パラメータサイズは1.5B、7B、14B、32Bとなっています。
Seed-Xは、ByteDanceのSeedチームが開発したオープンソースの多言語翻訳モデルです。70億個のパラメータを持ち、28言語の双方向翻訳をサポートしています。Seed-Xは、高品質な多言語データの事前学習、指示の微調整、強化学習を組み合わせています。
JoyAgent-JDGenieは、JD.com初の本格的な軽量汎用マルチエージェント製品としてオープンソース化されました。エンドツーエンドのインテリジェントエージェントシステムとして、二次開発なしで直接使用でき、レポート生成、レポート作成
Qwen3-Coderは、アリババ同義千文チームが開発した強力なコード生成モデルです。480Bパラメータと35Bアクティベーションパラメータを備え、ネイティブ256Kトークンコンテキストをサポートし、1Mトークンまで拡張可能です。このモデルは、Agen...で使用されています。
Mureka V7は、Kunlun Techが開発した高度なAI音楽モデルで、強力な音楽制作能力を備えています。MusiCoT(Music Mind Chain)技術に基づき、まず音楽全体の構造を計画し、次に詳細を埋めていくことで、より優れた音楽を生成します。
HunyuanCustomは、TencentのHunyuanチームが開発した、マルチモーダルでカスタマイズ可能な動画生成フレームワークです。HunyuanCustomは、画像、音声、動画、テキストなど、さまざまな入力条件に対応しており、特定のテーマやシーンの動画を生成できます。
VoiceCanvasは、オープンソースの多言語音声合成プラットフォームです。AI技術をベースとし、高品質なテキスト読み上げサービスを提供し、50以上の言語をサポートするとともに、OpenAI TTS、AWS Polly、MiniMaxなどと連携しています。