华为开源 AI Agent 统一工作平台 JiuwenSwarm
华为2012实验室、华为云、终端小艺等团队推出首个鸿蒙PC开源AI统一工作台JiuwenSwarm。平台支持办公、编程、娱乐等多场景,一句话可唤醒多智能体团队协同完成任务,如20分钟生成200页PPT、自主开发鸿蒙应用等。同时发布人机协同新范式HITS,实现人与Agent共同组队协作。
华为2012实验室、华为云、终端小艺等团队推出首个鸿蒙PC开源AI统一工作台JiuwenSwarm。平台支持办公、编程、娱乐等多场景,一句话可唤醒多智能体团队协同完成任务,如20分钟生成200页PPT、自主开发鸿蒙应用等。同时发布人机协同新范式HITS,实现人与Agent共同组队协作。
360旗下纳米团队推出新一代企业智能体工作平台纳米Work,平台覆盖谋、干、盯、开发、赚钱、成长六大工作场景,通过多智能体协同执行,交付可直接使用的方案、PPT、网站等成品。平台具备多智能体引擎、多模型底座、云端办公室、多工作模式及多AI专家五大技术亮点,支持一句话布置任务、7×24小时云端执行。
心言集团推出跨智能体终端AgentLink,将Claude、Codex、OpenClaw等分散设备的AI智能体统一接入移动端,扫码可远程操控与协同接力。产品实时展示智能体思考流程与进度,关键节点支持人工确认,独创云笔记接力实现多Agent闭环协作。AgentLink支持双平台,为移动场景下智能体统一管理提供新方案。
SpaceXAI 为 Grok 推出 Build 模式,用户输入提示词可将创意实时转化为带独立域名的可发布产品。Build 模式支持生成网站、应用、游戏及实时仪表盘,提供实时预览与自然语言迭代,无需编写代码可调整布局、样式与逻辑。完成后的项目可通过 grok.me 域名或自定义域名发布,支持导出源代码至 GitHub 继续开发。
Midjourney推出Midjourney V8.2图像生成模型,全面升级提示词理解、风格参考逻辑与出图稳定性,风格种子一致性、垫图融合自然度及复杂场景解析力显著增强,文字渲染精准度与东方古典意境表现达到新高度,一次出图成功率大幅提升。
微软 CEO 纳德拉官宣首个 AI 网络安全模型 MAI-Cyber-1-Flash,在 CyberGym 基准测试中以 95.95% 的成功率超越Claude Mythos 5 和 GPT-5.5 Cyber 等竞品。模型现已接入多智能体安全系统 MDASH,可高效处理约 90% 网络安全任务,与 GPT-5.4 组合后成本较现有配置降低近 50%。
人大与蚂蚁联合推出开源多智能体搜索框架 SearchOS,能为长程复杂信息检索提供系统级协作基础设施。框架将搜索过程中的任务进度、证据关系与补全状态抽象为跨 Agent 共享的系统状态,使多个智能体能在统一调度下分工协作、避免重复与失忆。
月之暗面Kimi K3开放日,正式推出Kimi K3模型权重、技术报告及三项关键Infra技术。Kimi K3为2.8万亿参数MoE模型,具备原生视觉理解与100万token长上下文能力,规模化效率较前代提升2.5倍。同步开源MoonEP高性能通信库、FlashKDA算子及AgentEnv沙箱系统,覆盖从训练通信到分布式RL环境的关键链路。
阿里正式推出一站式 AI 办公工具千问办公,开放Windows与macOS Beta版下载,主打企业IM写作、Office一站式生成、多模态理解、全栈网页生成等六大核心能力。同时,其鸿蒙电脑Beta版也上架AppGallery应用尝鲜,千问办公应用由钉钉科技开发,支持AI写作、PPT生成、文档互转及多模型切换等功能。
据《华尔街日报》报道,美国金融科技公司Stripe正洽谈收购大模型聚合平台OpenRouter,估值约100亿美元。OpenRouter作为模型路由平台,已接入400余个模型,能帮助企业灵活调用、切换不同厂商AI服务,避免被单一巨头绑定。
全球化AI互动娱乐平台海艺宣布完成超亿元B轮融资,由视觉中国、华盖创赢、祥峰投资联合领投。海艺注册用户超6500万,海外占比超90%,毛利率超40%,已沉淀超200万个AI原生创作资产,构建起”SeaArt角色创作+MoreShort短剧消费+SeaSoul角色互动”的完整AI IP生态,从工具竞争转向内容资产与创作者生态壁垒。
美团正式推出全场景AI Agent平台CatPaw,提供开箱即用的AI智能工作台与企业级Agent开发托管能力。平台深度融合美团本地生活行业认知,支持移动端App、PC客户端及云端7×24小时不间断运行,已在内部覆盖9万员工、搭建3万个Agent。CatPaw具备多Agent自主协同、专家与技能即装即用、跨会话长期记忆等能力。
AI教育大佬吴恩达开源桌面Agent项目OpenWorker。与普通聊天机器人不同,工具强调直接交付完成的工作成果,可自主调用本地文件和日常办公工具链完成任务。项目主打本地优先与隐私保护,数据默认保留在用户设备上,用户可自由切换底层模型。OpenWorker目前已支持macOS,Windows测试版已开放下载。
Anthropic推出新一代模型Claude Opus 5,智能水平接近Fable 5,价格仅为其一半。模型在Frontier-Bench、GDPval-AA等编程与知识工作评测中刷新行业纪录。Claude Opus 5在编程、商业自动化、计算机操作等场景表现亮眼,同等成本下性能领先竞品,已成为Claude Max默认模型及Pro版最强选择。
Agnes AI以Apache 2.0许可开放Agnes 2.5 Pro Alpha权重。该模型支持文本与图像输入、约104万Token上下文和工具调用,托管API仍为付费服务。
阿里云开源文档解析模型 OvisOCR2,模型用 96.58 分刷新 OmniDocBench v1.6 榜单纪录,成为首个超越传统流水线方法并登顶的端到端模型。模型仅 0.8B 参数,基于 Qwen3.5-0.8B 后训练,通过真实与合成数据互补引擎及多阶段训练流程,实现文本、公式、表格等内容的单步 Markdown 输出。
小红书 dots infra 团队开源多模态大模型训练框架 BigMac,针对计算效率与显存占用难以兼顾的痛点,提出依赖安全的嵌套流水线设计,用 LLM 流水线为主干有序嵌入编码器与生成器计算。实验显示其训练速度较基线提升 1.08 至 1.9 倍,且显存占用保持稳定,目前已应用于 dots 系列模型生产训练。
微软正式推出两款自研AI模型MAI-Image-2.5-Pro与MAI-Voice-2-Flash并开启公开预览,两者均基于内部训练流程构建。MAI-Image-2.5-Pro是微软目前精度最高的图像模型,支持主视觉生成、细节编辑及图像内文字渲染。MAI-Voice-2-Flash针对高并发语音场景优化,支持15种语言。
TRAE Work 升级内置 Seedream 5.0 与 Seedance 模型,并面向用户免费开放。在 TRAE Work 无需切换工具,通过自然语言可在工作流中直接生成图片和视频,支持文生视频、图生视频及文生图,同时提供多种时长、比例与分辨率。生成内容可嵌入任务上下文,无缝衔接后续文档撰写等工作。
Black Forest Labs推出多模态基础模型FLUX 3,首次在统一架构下联合学习图像、视频与音频。模型基于Self-Flow技术,可单次生成最长20秒带原生音频视频,支持文生视频、图生视频等模式。通过模态间物理约束学习世界表征,在机器人操控任务表现优异。
腾讯云正式推出云端智能体 CodeBuddy NPC,定位为”住在云端的 AI 员工”。开发者只需在 Issue 中 @NPC 派发任务,智能体可自主完成从方案规划到代码交付的全流程,无需人工干预。CodeBuddy NPC支持多 NPC 组队协同完成复杂任务,首轮 Token 消耗已从 2 万多个降至约 2000,降幅超 90%。
商汤在WAIC 2026推出日日新SenseNova U1 Pro,面向复杂多模态任务的AI图像生成系统。U1 Pro支持原生8K直出,具备图文交错思维能力,可围绕目标自主完成草图、细化、着色、检查与调整的全流程。实测显示,模型在超长画幅、复杂海报、琉璃质感山河图及商用电影海报等场景中均表现稳定,文字清晰、构图完整。
智象未来(HiDream.ai)宣布完成15亿元C轮融资,由社保基金四川振兴科创基金、工银资本等联合领投,多家国资与产业资本跟投,老股东持续加注。近三月累计融资超21亿元,正式迈入独角兽行列。本轮融资将加速其从多模态大模型向原生全模态世界模型的演进。
微软开源轻量级多模态图像生成模型系列 Mage-Flow,基于流匹配架构,仅 4B 参数,包含 Base、RL、Turbo 和 Edit 四个版本,支持文本到图像生成、局部编辑与风格迁移。模型可在消费级 GPU 上高效运行,大幅降低部署门槛,适用于电商设计、广告创意、游戏开发等场景。