Star Office UI - エージェントのステータスをリアルタイムで更新する、オープンソースのAI可視化ダッシュボード。
Star Office UIは、AIアシスタントの作業状況をリアルタイムで視覚化できる、オープンソースのピクセルスタイルのAI搭載ビジュアルステータスダッシュボードです。Star Office UIは、6つのステータスをさまざまなオフィスエリアにマッピングでき、昨日の作業状況も表示できます。
Star Office UIは、AIアシスタントの作業状況をリアルタイムで視覚化できる、オープンソースのピクセルスタイルのAI搭載ビジュアルステータスダッシュボードです。Star Office UIは、6つのステータスをさまざまなオフィスエリアにマッピングでき、昨日の作業状況も表示できます。
AnyClawは、AIエージェント専用に設計されたオープンソースのスマートアダプターであり、エージェントインターネットと従来のインターネットをつなぐコネクタとして機能します。API、スクリプト、Web自動化ワークフローなど、従来のインターネットに散在するツールを統合できます。
Gemini 3.1 Flash Liveは、Googleの最新の高品質リアルタイム音声モデルで、自然で流暢な会話を実現するために設計されています。このモデルは、イントネーションの理解、推論能力、応答速度が大幅に向上しており、正確な認識が可能です。
Voxtral TTSは、Mistral AIが開発したオープンソースのテキスト音声合成モデルで、40億個のパラメータを持つアーキテクチャに基づき、9つの言語をサポートしています。このモデルは、90ミリ秒という超低遅延と、リアルタイム生成速度の6倍という驚異的な速度を誇り、わずか3~5秒の音声からテキストを生成できます。
MOCR(マルチモーダルOCR)は、華中科技大学と小紅書研究室が共同開発したマルチモーダル文書解析モデルです。わずか30億個のパラメータで、文書解析と画像再構成において画期的な性能を実現しています。
daVinci-MagiHumanは、上海イノベーション技術研究所のGAIR LabとSand.aiが共同開発したオープンソースの音声・映像共生成基盤モデルです。このモデルは、150億個のパラメータを持つシングルストリームTransformerアーキテクチャを採用し、テキスト、音声、映像を均一にモデル化します。
DataChefは、上海人工知能研究所と復旦大学が共同開発したオープンソースのAIデータレシピ生成モデルです。このモデルは、強化学習を通じて、データ選択、クリーニングなどを含む、大規模なモデル適応タスクのための完全なデータ処理パイプラインを自動的に生成します。
Lyria 3 Proは、Googleが開発したAI音楽生成モデルで、最大3分間の完全なオーディオトラックの作成をサポートしています。構造認識機能を備えており、イントロ、ヴァース、コーラス、ブリッジなどのアレンジ要素を正確に処理できます。
TurboQuantは、Google Researchが開発したベクトル量子化アルゴリズムで、大規模モデルのKVキャッシュを32ビットから3ビットに圧縮することができ、メモリ使用量を6分の1に削減し、推論速度を8倍に向上させ、精度を一切損なうことなく実現します。
OpenCLIは、あらゆるWebサイトやElectronデスクトップアプリケーションをコマンドラインインターフェースに変換するオープンソースのコマンドラインツールです。このツールはChromeブラウザ拡張機能を介してローカルデーモンに接続し、ログインしているユーザーのアカウント権限を再利用します。
MiniMax Office Skillsは、Xiyu Technologyが開発したオープンソースのプロダクショングレードのオフィス文書作成エンジンです。このツールは、MiniMax-docx(Word)、MiniMax-xlsx(Excel)、MiniMax-pdf(PDF)、...の4つの主要コンポーネントで構成されています。
Sub2APIは、Claude、OpenAI、Gemini、Antigravityなどの主要なAIサービスへのサブスクリプションの統合アクセスと管理をサポートするオープンソースのAI APIゲートウェイプラットフォームです。このプラットフォームは、マルチアカウント管理、APIキーの配布、...
DeerFlow 2.0は、ByteDanceが開発したオープンソースのスーパーエージェントフレームワークです。「メインエージェント+11層のミドルウェアチェーン+動的サブエージェント」というアーキテクチャを採用し、LangGraphを介したマルチエージェント連携を実現しています。このフレームワークには、高度な調査、データ分析などの機能が組み込まれています。
MAI-Image-2は、MicrosoftのAIスーパーインテリジェンスチームが開発した第2世代のテキストベース画像モデルで、現在Arena.aiのリーダーボードで世界トップ3にランクインしています。このモデルは、フォトリアリズムの向上、...という3つの主要な機能に重点を置いています。
新しいAPIは、次世代のAIゲートウェイおよび資産管理システムです。AI基盤プラットフォームとして、世界中の30以上の主要なAIサービス(OpenAI、Claude、Gemini、DeepSeekなど)への統合されたインフラストラクチャアクセスを提供します。
PrismAudioは、アリババ傘下のTongyi Labが開発した動画音声変換フレームワークで、無音の動画に環境音効果を自動的に追加します。このモデルは「分解ベースの思考連鎖」技術を先駆的に採用しており、まず音声コンテンツを考慮することで…
ChatClawは、Zhimaが開発したオープンソースのAIエージェントで、macOS/Windows/Linuxに対応したわずか30MBのインストールパッケージを備えています。このツールには、ローカル知識ベース、スキルマーケットプレイス、MCP拡張機能、長期記憶、スケジュールタスクが組み込まれており、DingTalkやLarkなどと統合できます。
Uni-1は、Luma AIが開発した統合型画像理解・生成モデルであり、視覚推論と画像生成を単一の自己回帰型Transformerアーキテクチャに統合した初のモデルです。このモデルは、生成前および生成中に構造化された内部処理を実行できます。
SoulX-LiveActは、Soul App AIチームが開発したオープンソースのリアルタイムデジタル人間生成フレームワークで、ストリーミングAR拡散モデルの安定性の課題を解決します。主なイノベーションには、隣接するフレーム間の拡散ステップを整列させるネイバーフォーシング技術などがあります。
gstackは、YCのCEOであるギャリー・タン氏がオープンソース化した、Claude Code向けのAIプログラミングワークフローであり、AIアシスタントを仮想エンジニアリングチームへと変革します。このツールには、CEOレビュー担当者、スタッフエンジニアなど、15種類の専門家ロールが含まれています。
IndexCacheは、清華大学とZhipuチームが開発したスパースアテンション高速化技術です。クロスレイヤーインデックスの再利用によって冗長な計算を削減することで、DeepSeek Sparse Attention(DSA)におけるインデクサの計算オーバーヘッドが高いという問題を解決します。
Qwen3.5-Max-Previewは、アリ・トンイー・チエンウェンチームが発表した主力大規模モデルのプレビュー版です。このモデルは、LMARaena評価プラットフォームにおいて1464点を獲得し、世界トップ5、中国国内では1位にランクインしました。また、基礎能力評価では世界第6位にランクインしています。
Agencyは、エンジニアリング、デザイン、マーケティング、製品など12部門を網羅する144名以上のプロフェッショナルなAIエキスパートを収録したオープンソースのAIエージェントロールライブラリです。各エージェントは独自の個性、専門的なプロセス、そして明確に定義された納品基準を備えています。
Composer 2はCursorの次世代AIプログラミングモデルであり、「知能とコストの最適なバランス」を謳っています。100万トークンあたりわずか2.50ドルで、CursorBenchテストでは約61%のスコアを達成し、パフォーマンスはほぼ...