OpenStoryline - Xiaohongshuのオープンソース動画編集エージェント
OpenStorylineは、監督的な思考を備えたXiaohongshu初のオープンソース動画編集エージェントであり、素材の取得や脚本作成からレンダリング出力まで、自然言語による対話を通じて、全工程におけるインテリジェントな制作を可能にします。
OpenStorylineは、監督的な思考を備えたXiaohongshu初のオープンソース動画編集エージェントであり、素材の取得や脚本作成からレンダリング出力まで、自然言語による対話を通じて、全工程におけるインテリジェントな制作を可能にします。
Clawraは、OpenClawフレームワークをベースにしたオープンソースのAIバーチャルコンパニオンです。Clawraには、元K-POP練習生で、現在はサンフランシスコ市場でインターンをしているという、完全なペルソナが設定されています。
RynnBrainは、アリババDAMOアカデミーが発表したオープンソースの身体化されたインテリジェント脳モデルであり、ロボットが初めて時空間記憶と物理的な空間推論能力を持つことを可能にする。このモデルはQwen3-VLに基づいてトレーニングされ、独自開発のRynnScaleアーキテクチャを使用している。
Seedream 5.0は、ByteDanceの次世代AI画像生成モデルです。このモデルは初めてオンライン画像検索に対応し、抽象的なプロンプトをより正確に理解し、2K/4Kの高解像度画像を生成します。また、ブラシ編集機能も追加され、…
Qwen-Image-2.0は、アリババの同義千文プラットフォームが提供する新世代の画像生成モデルで、正確なテキストレンダリングとリアルで詳細なテクスチャという2つの主要機能を備えています。このモデルは、1,000トークンのコマンドを使用して、プロフェッショナルなインフォグラフィックやPPTプレゼンテーションなどを直接出力できます。
HY-1.8B-2Bitは、TencentがHunyuanを通じて発表した初の業界標準2ビットエッジサイド大規模モデルです。このモデルは1.8Bモデルをベースに、量子化認識トレーニング(QAT)を用いて圧縮されています。HY-1.8B-2Bitは、パラメータ数がわずか0.3B、サイズがわずか300MBという優れた性能を実現しています。
Riverflow 2.0は、Sourceful社が提供する、マーケティングおよびクリエイティブチーム向けに特別に設計された、プロダクショングレードの画像生成および編集モデルです。このモデルには、PROとFASTの2つのバージョンがあります。PROは最高の品質と一貫性を最優先し、テキストレンダリングに優れています。
PaperBananaは、北京大学とGoogle Cloud AI Researchが共同開発した、学術論文におけるAI研究者にとって時間と労力を要するデータ作成という課題を解決する、自動学術イラスト生成フレームワークです。このシステムは革新的なマルチエージェントアプローチを採用しています。
Nanobotは、香港大学データインテリジェンス研究所がオープンソース化した、超軽量のパーソナルAIアシスタントです。わずか約4,000行のコードで、OpenClawエージェントのコア機能を完全に再現しています。Nanobotは、ウェブ検索、ファイル操作など、様々な機能を備えています。
Seedance 2.0は、ByteDance傘下のJiDreamが発表した次世代AI動画生成モデルで、マルチモーダル参照と効率的な制作機能に重点を置いています。このモデルは、最初と最後のフレーム、ビデオクリップ、音声の包括的な参照をサポートし、カメラの動きのロジックを正確に再現します。
GPT-5.3-Codexは、OpenAの主力インテリジェントコーディングモデルであり、プログラミング能力と専門的な推論知識を組み合わせることで、処理速度を25%向上させ、トークン消費量を半減させています。
Claude Opus 4.6は、Anthropic社の主力AIモデルであり、Claude Opus 4.5のアップグレード版です。このモデルは、100万トークンという超長尺のコンテキストウィンドウを初めてサポートし、プログラミング、推論、複雑なタスク処理の分野をリードしています。
LingBot-VAは、AntLingbo Technologyがオープンソース化した、汎用ロボット制御のための世界初の因果的ビデオアクションワールドモデルです。このモデルは、ビデオワールドモデリングとポリシー学習を自己回帰フレームワークに統合し、ロボットが同時に予測することを可能にします。
Kilo CLI 1.0 は、Kilo Code が開発したオープンソースのコマンドラインツールで、エージェントエンジニアリング専用に設計されています。OpenCode をベースに構築されており、500 種類以上の AI モデルをサポートし、開発者は...
CL-benchは、テンセント渾源と復旦大学が共同で開発した、文脈学習能力を評価するベンチマークです。大規模な言語モデルが、新しい文脈情報から知識をリアルタイムで学習し、応用する能力を測定できます。
MiniCPM-o 4.5は、Wallfacerのオープンソース9Bパラメータフルモーダルフラッグシップモデルであり、SigLip2、Whisper、CosyVoice2、Qwen3-8Bを統合したエンドツーエンドアーキテクチャを採用しています。
Keling AI 3.0は、Kuaishouの次世代マルチモーダルAI制作モデルであり、「オールインワン」のネイティブ制作ワークフローを実現します。モデルのバージョンアップには、AIインテリジェントシーン制作、15秒の動画生成、多言語音声などをサポートするVideo 3.0の導入が含まれます。
ACE-Step 1.5は、ACE StudioとStepFunが共同開発したオープンソースの音楽生成モデルであり、民生用ハードウェア上で商用レベルの音楽生成を可能にします。このモデルはハイブリッドアーキテクチャを採用しており、言語モデルがプランナーとして機能し、ユーザーのプロンプトを組み込みます。
Xuanwu CLI (xw-cli) は、青茂知能が開発した国内開発の大規模モデル展開ツールで、オープンソース化されています。Huawei Ascend、Muxi、Suiyuanなどの国内チップ向けに高度に最適化されており、自動ハードウェア検出とインテリジェントエンジンスケジューリングにより、複雑な設定なしで大規模モデルを展開できます。
SoulX-FlashTalkは、Soul App傘下のAIチームがオープンソース化した、140億パラメータを持つ初のリアルタイムデジタル人間生成モデルであり、0.87秒というサブ秒単位の遅延と32fpsという高いフレームレートを実現しています。
Qwen3-Coder-Nextは、アリババのQwenチームが開発したオープンソースのプログラミング型インテリジェントエージェントモデルです。合計800億個のパラメータを持つハイブリッドエキスパート(MoE)アーキテクチャを採用していますが、各推論でアクティブになるのはわずか30億個であるため、GPUメモリと計算能力のコストを大幅に削減できます。
GLM-OCRは、Zhipu AIがオープンソース化した軽量マルチモーダルOCRモデルです。わずか0.9B個のパラメータで、OmniDocBench V1.5のリーダーボードで94.6のスコアを獲得し、トップに立ちました。
Thinkerは、UBTECHが開発したオープンソースの具現化されたインテリジェントな視覚言語モデルであり、特にロボットアプリケーション向けに設計されています。その4Bパラメータは、9つの権威あるベンチマークテストで世界最高ランクを獲得しました。
Happyとは? Happyは、ユーザーが携帯電話やウェブクライアントを介して、コンピュータ上で動作するClaude CodeまたはCodexをリモートで制御できるオープンソースツールです。リアルタイムのコード進捗状況の監視、音声操作、メッセージプッシュ通知などをサポートしています。