OpenAIが、無料の研究協力ツール「Prism」をリリースしました。
OpenAIは、研究ツールの断片化という課題に対処するため、GPT-5.2をベースとした無料の研究コラボレーションプラットフォーム「Prism」を発表しました。このプラットフォームはクラウドベースのLaTeXエディタを統合しており、無制限の共同研究者がリアルタイムで論文を執筆できます。AIは、全文のコンテキストに基づいて、要約から謝辞までの全プロセスを支援し、数式生成、文献管理、図表の最適化、文法校正などを行います。
OpenAIは、研究ツールの断片化という課題に対処するため、GPT-5.2をベースとした無料の研究コラボレーションプラットフォーム「Prism」を発表しました。このプラットフォームはクラウドベースのLaTeXエディタを統合しており、無制限の共同研究者がリアルタイムで論文を執筆できます。AIは、全文のコンテキストに基づいて、要約から謝辞までの全プロセスを支援し、数式生成、文献管理、図表の最適化、文法校正などを行います。
DeepSeekは、次世代文書認識モデル「DeepSeek-OCR 2」をリリースし、オープンソース化しました。DeepEncoder V2アーキテクチャを採用したこのモデルは、従来の固定シーケンス画像スキャン方式を、因果関係を考慮した意味推論モードへと進化させています。軽量な言語モデルによって視覚トークンを動的に再配置することで、AIは人間と同じように、表や複数列レイアウトなどの複雑な文書を論理的な順序で理解することができます。OmniDocBenchベンチマークでは、総合スコア91.09%という記録的な高得点を達成し、読み上げ順序認識エラーを33%削減しました。
Viduは、「あらゆるものを参照可能」な世界初の映像制作モデル「Vidu Q2 Reference Pro」を正式に発売しました。このモデルは、エフェクト、表情、テクスチャ、モーション、キャラクター、シーンの6種類の参照タイプを革新的にサポートし、映像や画像を入力することで、ワンクリックでエフェクトの複製、演技の転送、背景の置き換えなどが可能になり、洗練された追加、削除、修正を実現します。
Dark Side of the Moonは、これまでで最もインテリジェントで汎用性の高いオープンソースモデルであるKimi K2.5をリリースしました。このモデルは、エージェントタスク、コード生成、画像/動画の視覚理解など、複数のベンチマークテストで最先端(SOTA)のパフォーマンスを実現し、マルチモーダル入力と4つの動作モードをサポートしています。革新的な「エージェントクラスタ」機能を搭載しており、最大100個のクローンを自律的に作成して複雑なタスクを並列処理することで、効率を最大4.5倍向上させます。
オープンソースプロジェクトのClawdbotはGitHubで大きな話題となり、わずか2日間でスター数が5,000から20,000に急増しました。このプロジェクトは、自己展開型のAIアシスタントをサポートし、ゲートウェイを介してチャットソフトウェア(WhatsAppやTelegramなど)と複数のAIモデル(Claude、GPTなど)を接続し、カレンダー管理、メール処理、自動化タスクなどの機能を統合することで、真に「会話型」のパーソナルアシスタントを実現します。
NvidiaはクラウドサービスプロバイダーのCoreWeaveに20億ドルの追加投資を発表し、出資比率を11%以上に引き上げ、第2位の株主となった。両社は協力関係を強化し、2030年までに5GWを超えるAIコンピューティング能力の構築を目指す。特筆すべきは、NvidiaがCoreWeaveにVera CPUチップを独自に供給するのは今回が初めてであり、IntelやAMDと競合するデータセンターCPU市場への参入を示唆している可能性がある。
アリババは、同社最大かつ最強の推論モデル「Qwen3-Max-Thinking」を正式にリリースしました。このモデルは1兆を超えるパラメータと36TBの事前学習済みトークンを誇り、複数の国際ベンチマークテストで新記録を樹立しました。革新的なテスト時スケーリングメカニズムを採用することで、推論性能を向上させつつ、より経済的な運用を実現しています。
SenseTimeは、AI搭載会計製品「Kapi Accounting」の主要機能を永久に無料化すると発表した。同社のビッグデータモデル「Daily Update」のマルチモーダル理解機能を活用したこの製品は、写真、音声コマンドなど様々な方法で支出を自動的に記録できる。現在、中国で500万人以上のユーザーを抱えるAI会計製品としてナンバーワンの地位を確立している。今回の無料提供では、自動会計、共有台帳、予算計画、複数口座管理など、30の主要機能が対象となり、利用開始の障壁を完全に取り除く。
テンセントのHunyuanチームは、合計80バイトのパラメータを持つRAW画像モデル「Hunyuan Image 3.0」をリリースしました。ハイブリッドエキスパートアーキテクチャを採用し、画像編集や複数画像の合成など、多様なビジュアル作成機能をサポートしています。ユーザーは、自然言語コマンドを使用して、追加、削除、変更、スタイルの変更、古い写真の復元などの操作を実行できます。このモデルは、画像コンテンツをインテリジェントに理解し、詳細な編集手順を生成できます。
上海を拠点とするAI大型モデルユニコーン企業、Jieyue Xingchenは、50億元を超えるB+ラウンドの資金調達を完了し、国内大型モデル分野における単一ラウンドの資金調達の新記録を樹立した。Megvii Technologyの創業者で、清華大学姚クラスの卒業生である38歳の尹奇氏が正式に会長に就任し、CEOの姜大新氏と共同で会社を率いる。この資金は、基本モデルの研究開発とAI+端末戦略の実施に使用され、基本モデル、マルチモーダル融合、視覚言語アクション(VLA)の3つの主要分野に重点が置かれる。
Zhipu AIは、AI学習アシスタント「AIラーニングパートナー」を正式にリリースし、最初のユーザー体験アプリケーションの受付を開始しました。この製品は、3つの主要機能を通じて学習体験を刷新します。インテリジェントな要約機能により、数百ページに及ぶ文書を知識マップに変換し、「読みやすさ」を向上させます。視覚的にインタラクティブなカードとAIティーチングアシスタントによる質疑応答により、学習プロセスが活気に満ち、興味深いものになります。また、的確な知識ポイントに関する質問と「学習→練習→テスト」のループにより、深い理解と習得を実現します。
大規模モデル推論のためのオープンソースフレームワークであるvLLMの開発チームは、スタートアップ企業Inferactの設立を正式に発表し、シード資金として1億5000万ドルを調達した。これにより、同社の企業価値は8億ドルと評価された。今回の資金調達ラウンドはa16zとLightspeed Venture Partnersが主導し、Sequoia Capitalをはじめとする機関投資家も参加した。これは、史上最大規模のシード資金調達ラウンドの一つとなる。
Tongyi Qianwenチームは、1.7Bおよび0.6Bパラメータスケールを含むQwen3-TTSシリーズの音声生成モデルを正式にオープンソース化しました。このモデルは、音色の複製、音色の作成、擬人化された音声生成を完全にサポートしています。革新的な12Hzマルチコードブック音声エンコーダとデュアルトラックモデリングアーキテクチャを採用することで、効率的な音声圧縮と高忠実度再生を実現し、最初のパケットの音声遅延はわずか97ミリ秒です。このモデルは、中国語、英語、日本語、韓国語を含む10の主要言語と方言をカバーし、自然言語コマンドによる音色、感情、リズムの精密な制御をサポートしています。
清華大学、中国人民大学、Wallfacer Intelligence、およびOpenBMBコミュニティは共同で、ローカライズされた深層研究インテリジェントエージェントであるAgentCPM-Reportをリリースしました。わずか8つのパラメータを持つこのモデルは、40回の深層検索と100回の思考連鎖推論を経て、DeepResearch Benchを含む3つの主要ベンチマークにおいて、トップレベルのクローズドソースシステムを凌駕し、洞察力指標で1位を獲得しました。
Tencent CodeBuddy Code 2.0が正式にリリースされました。主なアップグレードとして、オープンSDK統合機能、プランモードとACPプロトコルによるエージェント機能出力の標準化などがあり、企業は迅速に本番環境レベルのAIアプリケーションを構築できます。このプラットフォームは開発者コミュニティのエコシステムと完全に互換性があり、プラグインマーケットプレイスとカスタムサブエージェントをサポートし、TencentOSと統合してコンテナ化されたセキュアなサンドボックス実行環境を提供します。新バージョンでは、プロジェクトメモリやLSPコード診断などのコア機能が強化され、GLM-4.7を含む複数のモデル間の切り替えをサポートしています。
Baiduは、2.4兆個のパラメータを誇るWenxin Big Modelのバージョン5.0を正式にリリースしました。ネイティブのフルモーダル統合モデリング技術を採用し、テキスト、画像、音声、動画から情報を理解し生成する包括的な能力を備えています。公式発表によると、40以上の権威あるベンチマークテストにおいて、その言語理解能力とマルチモーダル理解能力は、Gemini-2.5-ProやGPT-5-Highといった主流の国際モデルを凌駕しています。
MiniMaxは、AIネイティブワークベンチという新たなパラダイムを提示する第2世代インテリジェントエージェント製品「MiniMax Agent 2.0」をリリースしました。このプラットフォームは、WindowsおよびMacシステムをサポートするデスクトップアプリケーションを備え、ローカルファイルと環境を深く統合することで、ローカルタスクとクラウドタスク間のシームレスな連携を実現します。その中核となるイノベーションである「エキスパートエージェント」システムは、業界標準の運用手順(SOP)と独自の知識をカプセル化することで、プロフェッショナルな能力を一般的な70ポイントから95ポイント以上に向上させます。
StepFunは、オープンソースの100億パラメータマルチモーダルモデル「Step3-VL-10B」をリリースしました。このモデルは、複数のベンチマークテストにおいて、パラメータ数が20倍以上もある主流の大規模モデルを凌駕する性能を発揮します。視覚認識、数学競技、論理推論といった主要な分野で、最先端の(SOTA)パフォーマンスを実現しています。革新的な並列協調推論(PaCoRe)メカニズムにより、複雑なタスクの処理能力が大幅に向上しています。
イーロン・マスク氏は、Xプラットフォーム(旧Twitter)の中核となる推薦アルゴリズムコードであるx-Algorithmの公式オープンソース化を発表した。これにより、Xプラットフォームはトラフィック分配ロジックを完全に公開した初の主要ソーシャルプラットフォームとなった。この新しいアルゴリズムは、xAIのGrokモデルと同じTransformerアーキテクチャを採用し、「手動による特徴量エンジニアリングを一切行わない」ことで、モデルがユーザーのインタラクション履歴を自律的に学習し、コンテンツの関連性を予測する仕組みになっている。
Moonshot AIは、エンタープライズ認証を取得したオープンプラットフォームユーザーからの応募を受け付ける、Kimi新モデルAPIのベータテストプログラムを正式に開始しました。プラットフォームは、開発者のユースケースと新モデルの機能との適合性に基づいて、最初のテストユーザーを選定します。選考を通過した応募者には、公式チームから電話で連絡があります。この取り組みは、開発者とともに次世代モデルの応用可能性を探ることを目的としています。
Lunar Dark Sideは、前回の資金調達からわずか数週間後に新たな資金調達ラウンドを開始し、資金調達前の企業価値は48億ドル近くに達し、前月の43億ドルの評価額を5億ドル上回った。今回の資金調達ラウンドでは、機関投資家による買いが殺到したが、これは主に、ZhipuとMiniMaxの香港IPOの好調なパフォーマンスを受けて、投資家が中国の大手AI企業への投資を加速させたためである。同社は現在100億人民元以上の現金準備金を保有しており、創業者である楊志林氏は、次世代K3推論モデルの開発と計算能力の拡張に注力しており、IPOを急ぐ必要はないと述べている。
AIコンパニオン企業であるナチュラルセレクションは、アリババ、アントグループ、奇明ベンチャーパートナーズなどの投資家から3,000万ドル以上の資金を調達した。同社のEVE Online製品は、積極的なケア、感情的知性と知的知性を組み合わせた「人間味」、最先端の長期記憶、高度に没入感のあるデザイン、そして多次元的なライフスタイルサービス介入という5つの側面から、AIコンパニオンシップを再定義する。
Zhipu AIは、GLM-4.7-Flashモデルを正式にオープンソース化し、リリースしました。このモデルは、合計30バイトのパラメータとわずか3バイトのアクティベーションパラメータを持つハイブリッド思考アーキテクチャを採用しており、軽量な展開で高性能なオプションを提供します。SWE-bench Verifiedやτ²-Benchといった主流のベンチマークテストで優れた性能を発揮し、同規模の他のオープンソースモデルを凌駕して最先端(SOTA)のパフォーマンスを実現しています。
Lightwheel IntelligenceはWorld Labsと提携し、従来の高コストなデジタルツイン技術に代わる「デジタル版」シミュレーションソリューションを提供することで、身体化された知能の大規模評価という課題に取り組んでいます。このソリューションは、軽量な実世界データ取得と3Dガウス拡散技術を活用し、物理的にインタラクティブなシミュレーション環境を迅速に生成することで、環境作成時間を数分に短縮します。