OpenAI 推出企业级 AI 智能体平台 OpenAI Presence
OpenAI 正式推出企业级 AI 智能体平台OpenAI Presence,帮助企业高效部署和管理 AI Agent,实现客户支持、销售等工作的自动化。平台可将智能体与企业内部数据、管理制度及现有软件深度连接,提供模拟测试、安全防护、人工审核及 AI 自动评分等管理工具,集成语音与聊天技术。
OpenAI 正式推出企业级 AI 智能体平台OpenAI Presence,帮助企业高效部署和管理 AI Agent,实现客户支持、销售等工作的自动化。平台可将智能体与企业内部数据、管理制度及现有软件深度连接,提供模拟测试、安全防护、人工审核及 AI 自动评分等管理工具,集成语音与聊天技术。
Claude Cowork 上线 Record a skill(录制技能)功能,用户边操作屏幕边语音讲解,AI 自动提炼为可重复调用的 Skill,无需再写繁琐 SOP。该功能面向 Pro、Max 及 Team 用户,入口位于桌面应用 Cowork 模式的「+」菜单。
商汤科技推出「咔皮家族」AI应用矩阵,定位为以Personal Intelligence为核心的全天候生活智能体,累计用户已突破4000万,年增速超500%。该家族包含三位私人高管:「咔皮健康」可将智能手表数据翻译为个性化健康建议;「Kapi相机」基于多模态能力提供AI构图、滤镜与姿势推荐;「咔皮记账」连接日常收支与长期财务目标。
腾讯AI创意智能体平台Miora正式全量上线。平台定位为有记忆、能理解需求、能调用多智能体协作的AI创意工作室,用户只需提出目标,Miora可自动拆解任务,将图片、视频、3D、UI等工作交由对应专家处理,保持风格一致。
谷歌推出三款新AI模型:Gemini 3.6 Flash、Gemini 3.5 Flash Cyber 和 Gemini 3.5 Flash-Lite,分别主打性能提升、网络安全优化和智能体应用场景。Gemini 3.6 Flash 在编程、金融等基准测试中表现优于前代,且成本更低。Cyber 版本专为漏洞发现与修复设计,仅向政府机构和可信合作伙伴开放,以防范滥用风险。
元石科技推出问小白 5 Pro,定位为新一代长内容生成引擎,主打长、稳、可查三大核心能力。针对AI长文本写作中常见的数据幻觉、设定前后矛盾、结构松散等痛点,产品通过资料库实现引用可追溯,依托项目记忆机制保持长程设定一致性,借助长文结构保持机制确保万字级文档的论证框架不散架。
腾讯混元推出Hyra,首个支持递归自我改进的通用科学发现智能体。Hyra在AI研发三项基准上均超越Recursive系统;在55个数学开放问题上刷新29项历史最优纪录,并设计出参数减少58%的加法器、效率提升44%的量子路由算法及优于上市药物的抗癌分子候选。
昆仑万维开源新一代可交互世界模型Matrix-Game 3.5。模型通过Patch Memory与Warped PRoPE技术攻克长期记忆与几何一致性难题,实现单卡GPU上720P/20FPS实时交互,且核心功能几乎不新增参数,采用轻量化可迁移架构。团队同步构建自动化数据管线,产出超500万段高质量训练数据。
美团LongCat团队推出全新搜索智能体评测基准LoHoSearch,用762万维基百科实体知识图谱自动生成544道高难度题目。基准通过控制搜索空间与结构复杂度双维度提升难度,评测显示最强模型GPT-5.5准确率仅34.74%,远低于其在BrowseComp上的表现,揭示当前搜索智能体在长链条复杂推理任务上的显著瓶颈。
阿里正式推出语音合成大模型Qwen-Audio-3.0-TTS,包含面向实时交互的Flash版本和面向高质量生成的Plus版本。模型在细粒度标签控制、自然语言指令风格定义、多语种与方言覆盖及复杂声学鲁棒性等方面实现系统性提升,支持在文本中嵌入结构化标签精准调控语气与情绪,覆盖16种语言和20种方言。
面壁智能在WAIC 2026上开源首个具身智能成果MiniCPM-Robot系列模型,包含通用VLA模型RobotManip与跟踪导航模型RobotTrack。Manip用极小参数实现比肩更大模型的性能,支持1分钟原生记忆且推理成本减半;Track为业内首个支持本地断网部署的跟踪模型,可在无网环境下稳定运行。
Meshy宣布完成近4亿美元B轮融资,投后估值超100亿元,创全球AI 3D领域最高估值纪录。过去一年营收翻12倍,注册用户超1200万,累计生成模型超1亿个,全球前十科技公司中已有一半成为其客户。
字节跳动Seed推出音频创作模型Seed Audio 1.0,面向完整声音场景统一建模人声、音效与环境声,实现端到端影视级音频创作。模型支持多要素统一编排与100ms精度时间控制,可基于参考音频保持长时音色一致,覆盖20+语种自然生成。评测显示多数场景音频可用率超90%。
趣丸科技发布Tempolor v4.7(天谱乐大模型V4.7),接入对话式音乐智能体Tunee并开放API。新版本聚焦可控编辑,升级Remix改写与翻唱Cover能力,支持细粒度音频调整,让AI音乐从一键成曲走向随心修改。模型采用第四代分层渐进式架构,整体性能提升约20%,输出48kHz双声道音频。
阿里千问推出Qwen3.8-Max-Preview,Qwen3.8将正式发布并全面开源,模型参数达2.4T,官方称模型可能是除Fable 5外最强大的模型。目前Qwen3.8-Max预览版已率先上线阿里Token Plan、Qoder及QoderWork平台,用户可抢先体验。
多模态通用智能公司 Prana Labs 近日完成近千万美金种子轮融资,由元生资本、XVC、Creekstone、三七互娱联合投资。公司定位多模态基础模型公司,致力构建可交互、带物理约束的规模化世界生成系统,让 AI 在虚拟环境中行动、试错并学习物理规律,以此训练下一代通用智能。 Potentials
百度秒哒在WAIC2026现场发布3.5版本,新版本通过内置SEO Agent降低搜索优化门槛,并全球首发iOS打包能力,支持无代码生成应用并直达iPhone。同时新增共享后端与多环境隔离,实现从创作到多端交付的完整闭环,持续推动无代码开发普惠化。
英伟达开源文本嵌入模型系列 Nemotron 3 Embed,专为检索增强生成与智能体检索设计。模型包含 8B 和 1B 两种参数规模,支持 32k 上下文窗口与 34 种语言。旗舰版 8B 模型在 RTEB 多语言检索基准以 78.5% 得分位居第一,1B 版本通过剪枝与蒸馏在大幅降低推理成本的同时保留 95% 检索精度。
努比亚AI陪伴机器人iMoochi正式上市,售价1699元。产品由中兴通讯在MWC26首发,以萌系毛绒外形与拟生命体交互为核心卖点,通过触摸传感与AI算法实现摇头摆尾、发声反馈等灵动回应,并随使用时间养成独特性格与生活习惯。产品主要面向都市独居人群提供情感慰藉。
谷歌宣布旗下AI笔记助理NotebookLM正式更名为Gemini Notebook,实现AI产品品牌统一。产品仍保持独立运营,将深度融入Gemini应用及Google搜索生态。同时,Gemini Notebook新增安全云计算机支持,具备原生代码编写与执行能力,可基于数据源进行复杂数据分析。
月之暗面正式推出迄今最强模型 Kimi K3,模型拥有 2.8 万亿参数,是全球首个开源的 3 万亿级别模型。Kimi K3 基于 KDA 混合线性注意力机制与注意力残差技术构建,原生支持视觉理解,上下文窗口达 100 万 token。在编程、通用 Agent、视觉 Agent 及知识工作等评测中,Kimi K3 展现出前沿水平,部分项目超越 GPT-5.6 Sol 与 Claude Fable 5。 Kimi
阿里通义实验室推出实时语音交互模型 Qwen-Audio-3.0-Realtime(原 Fun-Realtime-AudioChat),支持语境动态调整语气情感、音色克隆、声纹级背景过滤与多模态双工对话,在 Artificial Analysis 语音推理子项中综合排名第一,超越 GPT-Realtime-2。
端侧大模型独角兽面壁智能完成新一轮融资,2026年上半年累计融资超50亿元,估值突破200亿元,成为中国端侧智能领域估值最高的独角兽。公司孵化自清华大学NLP实验室,核心产品为MiniCPM系列端侧模型,5月开源MiniCPM5-1B。公司商业化已进入汽车、手机、PC等领域,长安、上汽、吉利等车型已量产搭载。
OpenAI 联合外设厂商 Work Louder 正式推出 Codex 首款硬件 Codex Micro,售价 230 美元(约 1556 元),现已开启预购。硬件专为 Codex 设计,通过 RGB 灯光实时映射 AI Agent 的工作状态,让用户无需切换窗口可掌握任务进度。旋钮可动态调节 AI 推理强度,配合摇杆与实体按键,分别用于派发工作流和执行高频决策。