IQuest-Coder-V1 - IQuestLabが発表した大規模なコードモデルシリーズ
IQuest-Coder-V1は、IQuestLabが開発した高度なAIモデルで、コード生成、理解、最適化に特化しています。7B、14B、40Bといった様々なパラメータスケールと、Instruct、Thinking、Loopといったバージョンを提供しています。
IQuest-Coder-V1は、IQuestLabが開発した高度なAIモデルで、コード生成、理解、最適化に特化しています。7B、14B、40Bといった様々なパラメータスケールと、Instruct、Thinking、Loopといったバージョンを提供しています。
RedInkは、小紅書(Xiaohongshu)向けのオープンソースのAI搭載コンテンツ作成ツールで、コンテンツ作成プロセスの簡素化に特化しています。ユーザーがテーマを入力すると、このツールは目を引くタイトル、高品質なテキスト、美しい画像を素早く生成し、「一文で完全なセットを生成…」を実現します。
mHC(Manifold-Constrained Hyper-Connections)は、DeepSeekチームが提唱した新しいニューラルネットワークアーキテクチャ設計手法であり、大規模トレーニングにおける従来のハイパーコネクション(HC)アーキテクチャの問題を解決します。
AutoMVは、M-A-P、北京郵電大学、南京大学NJU-LINK研究所、その他の機関によって開発された自動化されたマルチエージェントシステムです。楽曲を一貫性があり、リズムが揃ったミュージックビデオに変換する機能をサポートしています。このシステムは音楽情報を検出し…
HY-Motion 1.0(Hunyuan Motion 1.0)は、TencentのHunyuanチームが開発した、数十億パラメータを持つオープンソースのテキストから3Dモーションを生成するモデルです。拡散トランスフォーマー(DiT)アーキテクチャとストリームマッチングメカニズムに基づいており、必要なコードはわずか1行です。
Tencent-HY-MT1.5は、TencentのHunyuanプラットフォームのオープンソース翻訳モデルで、Tencent-HY-MT1.5-1.8BとTencent-HY-MT1.5-7Bの2つのバージョンがあります。このモデルは、33の国際言語と5つの少数言語/方言間の翻訳をサポートしており、…
Computer Use Previewは、Googleが提供するオープンソースのAI搭載ブラウザ自動化ツールです。Geminiモデルの視覚認識機能を基に、「スクリーンショット→分析→アクション」のプロセスを通じて、固定されたモデルに頼ることなく、ウェブページに対する人間の操作をシミュレートします。
PersonaLiveは、マカオ大学とGVC Labsが開発したオープンソースのリアルタイムデジタルヒューマンライブストリーミングツールです。このツールは、12GBのVRAMを搭載した一般消費者向けグラフィックカード1枚で動作し、無制限のポートレートアニメーション生成と低遅延のインタラクションを実現します。
Yume 1.5は、上海人工知能研究所や復旦大学などが開発したインタラクティブな世界生成モデルです。単一の画像やテキストプロンプトから、リアルで連続的、かつ探索可能な仮想世界を生成できます。
Step-DeepResearchは、Step-Leap Star Technologyが開発した32億パラメータの深層学習AIモデルです。複雑な研究タスクを単一の推論反復で完了し、専門的なレポートを生成できます。このモデルは、プランニング、深層探索、逆推論を活用したモノリシックアーキテクチャ設計を採用しています。
MAI-UIは、Tongyi Labsが開発した本格的なGUIインテリジェントエージェント基盤モデルであり、ユーザーインタラクション、ツール呼び出し、エッジクラウド連携という3つのコア機能を備えています。このフレームワークは、自律的に進化するデータパイプラインと大規模オンライン強化学習技術を活用しています。
Zhipu社の新世代大規模基盤モデルは、合計355バイトのパラメータと32バイトの活性化パラメータを誇ります。このモデルは、実世界プログラミング、長コンテキスト処理、推論能力、情報検索、記述能力、インテリジェントエージェントアプリケーションなどの分野で包括的な進歩を遂げています。
InstanceAssembleは、Xiaohongshuと復旦大学が共同開発した軽量レイアウトから画像生成へのフレームワークです。革新的な「インスタンスアセンブリアテンション」メカニズムにより、このフレームワークは、単純なレイアウトから複雑なレイアウトまで、また疎なレイアウトから密なレイアウトまで、高精度なレイアウト生成を実現します。
Zen Browserは、Firefoxカーネルをベースにしたオープンソースのブラウザで、効率的なデザインと強力な機能によってユーザーの生産性を向上させるように設計されています。Zen Browserは、縦型タブレイアウトとサイドバーにより、ワイドスクリーンディスプレイでのユーザーエクスペリエンスを最適化しています。
QwenLong-L1.5は、アリババ同義研究所が開発した大規模言語モデルで、長文推論に特化しています。Qwen3-30B-A3Bアーキテクチャをベースに、体系的な事後学習スキームによって長文推論能力を大幅に向上させています。
FrontierScienceは、OpenAIが立ち上げた科学AI能力評価ベンチマークであり、物理学、化学、生物学の分野における大規模モデルの専門家レベルの推論能力をテストするために特別に設計されています。これには2つのサブセットが含まれています。オリンピックトラック(競技レベルの短い質問100問)...
ML-Master 2.0は、上海交通大学人工知能学院、上海アルゴリズムイノベーション研究所、DeepTechのメンバーで構成されるSciMasterチームによって開発された、実世界の機械学習研究タスクのための自律型インテリジェントエージェントです。ML-Master 2.0は…
QuantiPhyは、スタンフォード大学のFei-Fei Li氏のチームが開発した、視覚言語モデル(VLM)の物理的推論能力を定量的に評価する初のベンチマークです。QuantiPhyは3300を超えるビデオテキストインスタンスを使用し、モデルに視覚情報に基づいた物理的推論を実行させます。
Infographicは、アリババのAntVフロントエンドチームがオープンソース化した次世代インフォグラフィックフレームワークです。G2ビジュアライゼーションエンジンとAnt Designをベースに、高品質で安定したインフォグラフィックを迅速に生成できます。
opcodeは、Claude Code向けに開発されたオープンソースのデスクトップグラフィカルインターフェースツールです。複雑なコマンドライン操作を直感的なビジュアル体験に変換することで、ユーザーエクスペリエンスを大幅に向上させます。
MedASRは、Googleが開発した医療分野に特化した音声認識モデルです。Conformerアーキテクチャに基づいており、10⁵百万個のパラメータを持っています。このモデルは、膨大な量の医療音声データ(約5000時間)で事前学習されており、…
TurboDiffusionは、清華大学、バイオニューメリカル・リサーチ、カリフォルニア大学バークレー校が共同開発した動画生成高速化フレームワークです。このフレームワークは、SageAttention、SLA(スパース線形アテンション)、rCM(タイムステップ蒸留)などの技術を利用しています。
Seed Prover 1.5は、ByteDanceのSeedチームが開発した次世代の形式的数学的推論モデルです。このモデルは、革新的なエージェント型プロバーアーキテクチャを採用し、大規模強化学習(エージェント型RL)によってトレーニングされています。
MiniMax M2.1は、MiniMaxが開発した多言語プログラミングAIモデルです。このモデルは、Rust、Java、Golangなど複数の言語の機能を体系的に向上させ、基盤層からアプリケーション層までの開発を網羅しています。