AI Co-Scientistは、Googleが開発したマルチエージェントAIシステムです。仮想研究ロボットとして、研究テーマの選定、文献検索、実験計画など、研究者が様々な煩雑な研究作業を行う際に支援します。AI Co-Scientistは…
AI Co-Scientistは、Googleが開発したマルチエージェントAIシステムです。仮想研究ロボットとして、研究テーマの選定、文献検索、実験計画など、研究者が様々な煩雑な研究作業を行う際に支援します。AI Co-Scientistは…
北京協和医科大学病院と中国科学院自動化研究所が共同開発した、北京協和医科大学病院の台初AIモデルは、中国初の希少疾患に特化した大規模AIモデルであり、正式に臨床応用を開始しました。このモデルは、中国における希少疾患に関する長年の蓄積された知識と中国国民に関する知見に基づいています。
HiveChatは、中小規模チーム向けに設計されたAIチャットアプリケーションで、OpenAI、Claude、Gemini、Deepseekなど、さまざまな主要なAIモデルをサポートしています。HiveChatは、LaTeXおよびMarkdownのレンダリング、画像処理などの機能を備えています。
Ovis2は、アリババの国際チームが開発した新しいマルチモーダル言語モデルです。構造化埋め込みアライメントに基づいて、視覚モダリティとテキストモダリティの違いに対応します。Ovis2はOvisシリーズのアーキテクチャを継承し最適化することで、小規模モデルのパフォーマンスを向上させています。
AgentSocietyは、清華大学が大規模言語モデリング(LLM)に基づいて開発した社会シミュレーターです。人間のような知能を持つインテリジェントエージェントを構築することで、複雑な社会行動や現象をシミュレートします。社会学理論を組み合わせることで、インテリジェントエージェントに人間のような知能を与えています。
Sitcom-Crafterは、北京航空航天大学、香港中文大学、深圳大学、シドニー工科大学、中山大学などの大学が共同開発した3Dシーン人体動作生成システムです。ユーザーが提供する長尺シーンのガイダンスに基づいて動作します。
Migicianは、北京交通大学、華中科技大学、清華大学の研究チームが共同開発したマルチモーダル大規模言語モデル(MLLM)です。特に自由形式のマルチイメージグラウンディング(MIL)向けに設計されています。
ComfyUI-Copilotは、Alibaba International Digital Commerce Group(AIDC-AI)がComfyUIフレームワークに基づいて開発したAI搭載のインテリジェントアシスタントです。ComfyUI-Copilotは自然言語による対話を提供し、ノードベースのプッシュ通知をユーザーに提供します。
Auto-Deep-Researchは、香港大学のChao Huang教授の研究室が開発した、オープンソースの完全自動化されたパーソナルAIアシスタントであり、OpenAI Deep Researchのオープンソース代替として機能します。AutoAgentフレームワークに基づいて開発され、深層学習に重点を置いています。
OOMOLは、VSCodeをベースに構築された最新の統合開発環境(IDE)であり、ワークフロー自動化に特化して設計されています。ドラッグ&ドロップ式のグラフィカルインターフェースにより、ユーザーはプログラミングなしで複雑なワークフローを直感的に構築できます。
Evo 2は、Arc Research Institute、NVIDIA、スタンフォード大学、およびその他の機関の共同開発によって生まれたDNA言語モデルです。ゲノムモデリングと設計に使用され、生命のあらゆる分野を網羅しています。Evo 2は、StripedHyena 2アーキテクチャに基づいています。
Indic Parler-TTSは、Hugging FaceとAI4Bharatが共同開発した多言語テキスト音声合成(TTS)モデルで、特にインドの言語と英語の音声合成向けに設計されています。Indic Parler-TTSは、Parl...
GRUtopia 2.0は、上海人工知能研究所がリリースした汎用的な具現化型インテリジェントシミュレーションプラットフォームです。このプラットフォームはGRUtopia 1.0からの包括的なアップグレードであり、汎用的なモジュール型フレームワーク、...という3つの主要なイノベーションを特徴としています。
BioMedGPT-R1は、清華大学AI産業研究所(AIR)と北京清華分子生物技術有限公司が共同開発した、アップグレードされたオープンソースのマルチモーダル生物医学モデルです。BioMedGPT-R1はDeepSeek R1技術に基づいています。
SigLIP 2は、Google DeepMindが提案した高度な多言語ビジュアル言語モデルです。SigLIPのアップグレード版であり、画像とテキストのアライメントを改善しています。改良されたトレーニング方法とアーキテクチャにより、大幅に性能が向上しています。
AvatarGOは、南洋理工大学S-Lab、上海AIラボ、香港大学が共同開発した革新的なフレームワークです。テキスト入力からアニメーション可能な4D人間・物体インタラクションシーンを直接生成するために使用されます。これはゼロショット技術によって実現されています。
Moonlight-16B-A3Bは、Moonshot AIが開発した新しいMixture-of-Expert(MoE)モデルで、合計160億個のパラメータと30億個の活性化パラメータを備えています。このモデルは、最適化されたMuonオプティマイザを使用して学習されます。
FlashMLAは、DeepSeekが開発したオープンソースの高効率MLA(マルチヘッド線形アテンション)デコードカーネルで、NVIDIA HopperアーキテクチャGPU向けに最適化され、可変長シーケンスの処理に特化して設計されています。キーと値のペアを最適化し、...
MagicArticulateは、南洋理工大学とByteDance Seed Labsが開発したフレームワークで、静的な3Dモデルをアニメーション可能なアセットに自動的に変換します。MagicArticulateは自己回帰に基づいてスケルトンを生成し、スキニングウェイトを予測します。
TANGLEDは、上海科技大学、Deemos Technology、華中科技大学が共同開発した3D毛髪生成手法です。あらゆるスタイルと視点の画像から高品質な3D毛髪を生成することを可能にします。TANGLEDは3つのコア技術に基づいています。
Llasa TTSは、香港科技大学がLLaMAアーキテクチャに基づいて開発したオープンソースのテキスト音声合成(TTS)モデルです。高品質な音声合成とクローニングをサポートしています。Llasa TTSは、単層ベクトル量子化(VQ)コーデックと単一のTrに基づいています。
AingDeskは、ユーザーが数百ものAIモデルをパソコンに迅速に展開できるオープンソースのクライアントソフトウェアです。ワンクリック展開機能により、複雑なモデルのインストールプロセスが簡素化され、技術的な知識がないユーザーでも簡単に使い始めることができます。
LazyLLMは、開発者がマルチエージェント大規模言語モデルアプリケーションを迅速かつコスト効率よく構築できるよう支援するオープンソースのローコードプラットフォームです。合理化された開発プロセスにより、ワンクリックでのデプロイとクロスプラットフォーム運用をサポートし、AIアプリケーション開発の複雑さを軽減します。
Memobaseは、生成型人工知能(GenAI)アプリケーション向けに設計された、オープンソースのユーザープロファイルベースの長期記憶システムです。Memobaseは、仮想アシスタントや教育ツールなどのアプリケーションにユーザー記憶機能を提供し、AIの記憶を支援します。