OpenAI 文档显示,GPT-5.6 Sol 作为 GPT-5.6 系列旗舰模型,支持最高 105 万上下文窗口,定价为每百万输入 token 4 美元、输出 20 美元,较前代有所下调。
阿里 QoderWake 1.0 正式推出,支持企业像管理真实员工一样全流程招聘、培训、授权和管理 AI 员工。产品实现人与 AI 在同一组织内协作,人负责决策把关,数字员工负责执行推进,将优秀员工能力沉淀为可复用的数字化生产力,为企业提供不设上限的数字化人力产能。
科大讯飞正式推出星火X2.5大模型。模型基于全国产算力完成全流程训练,采用MoE架构,参数规模达293B-A30B,并持续优化国产超长序列训推难题。新版本重点提升代码生成与智能体能力,数学、理解等通用能力也持续进步。
秘塔科技推出AI心理健康应用「智慧月隐」微信小程序。产品采用结构化卡牌问答互动形式,通过AI追问引导用户抽牌,结合专业心理逻辑进行牌局解读,提供个性化情绪疏导与认知视角建议。产品适用职场压力疏导、情感关系梳理及睡前情绪整理等场景。
马斯克旗下 xAI 拓展 Grok Bot 平台,新适配 iPad 与安卓系统,实现 Mac、iPhone、iPad、安卓四终端覆盖。平台支持 AI 智能体 24 小时组队协作,可登录不同应用、保留任务上下文并在多机器人间共享信息。
GitHub 上一个名为 free-claude-code(FCC)的开源项目宣称可聚合 50 家模型供应商,提供每月超 13 亿免费 Token,并支持在 Claude Code、Codex 等 10 种编码代理中调用。项目强调遵守各供应商服务条款,但相关数字与可用性尚未获官方确认。
继Skild AI、Generalist AI展示机器人通过观看演示视频即可学习新任务后,国内创业公司可可矩阵(COCO Matrix)宣布将In-Context Learning(ICL)作为具身智能的底层范式,其创始人高宇翔称已跑通技术路线,并计划定义人机教学交互数据标准。
OpenAI开发者Thibault Sottiaux在X上发文称,Astra可能是OpenAI最大的竞争优势,内部使用后生产力大幅提升,部分计划提前六个月。相关研究显示多数受访者将AI研究自动化视为重大风险,且半数人预期最强模型不会公开。
Google Cloud 更新 Agent Platform 定价页,显示 Gemini 3.8 Flash、3.7 Flash、3.6 Flash 及 CodeMender 在 2026 年 12 月 31 日前享输入 0.75 美元/百万 tokens、输出 3.75 美元/百万 tokens 的促销价,2027 年起恢复标准价。
Anthropic、OpenAI、Meta和谷歌本周密集发布AI模型更新,英伟达宣布以129亿美元收购开源AI平台Hugging Face。业内人士指出,过快迭代让企业用户陷入“模型疲劳”,需耗费大量资源比较成本与能力,同时安全风险也在上升。
谷歌研究院与 DeepMind 联合发布 WeatherNext 3 人工智能天气模型。该模型不再依赖传统物理模拟,而是直接学习实时卫星数据,可每小时更新一次预报,分辨率较前代提升约五倍,并已整合至谷歌搜索、地图及 Gemini 等产品。
GitHub 宣布 Project HydraFusion,为 Copilot CLI 引入运行时多模型编排机制,可根据具体编码任务动态构建工作流。该项目旨在突破单一模型的局限,通过任务感知的模型路由与组合,提升代码生成与修复的准确性和效率。目前仍处于早期探索阶段,具体模型选择策略与性能数据尚未完全公开。
Grok上线Imagine Video 1.5智能体,由Image 2.0驱动,主打多镜头连续性与叙事能力,并已开放网页、iOS和Android入口。
Ollama Cloud为DeepSeek-V4 Flash与Pro设置非高峰费率:工作日12:00至18:00 UTC之外及整个周末按高峰费率的一半计费。
陶哲轩近日发文,对AI在数学研究中的角色提出警示,认为AI快速给出答案可能掩盖探索过程中的宝贵失败,甚至让AI对数学发展的影响转为负面。他以纳维-斯托克斯方程和孪生素数猜想为例,指出若AI在缺乏透明度的情况下解决难题,数学本身可能无法获得新增价值。
GPT-6 Astra发布后,循环Transformer(recurrent depth)技术引发热议。阿里及合作高校团队早在11个月前就发表两篇论文,分别针对循环中的计算冗余和粒度问题提出MeSH与SpiralFormer方案,均被顶会接收。
Artificial Analysis 发布智能指数 4.2 版,回应此前对 GPT-6 Astra 评分偏低的质疑。新版中 Astra 较前代提升 4 分,但仍落后于 Anthropic 的 Claude Fable 5.1。指数新增两个基准测试,并提高私有测试数据权重以降低刷分可能。