AB
AiBoss
News

OpenAI发布GPT-6 Astra:105万上下文计算机操控模型,设网络安全门槛

OpenAI今日发布GPT-6 Astra,定位为计算机操控模型而非聊天模型,上下文窗口达105万token。该模型是首个被OpenAI认定为达到其准备框架中"关键"网络安全阈值的模型,因此标准访问将拒绝高级网络安全工作,仅限受信组织使用。

核心事实

OpenAI于2026年9月3日发布GPT-6 Astra,称其为公司"最智能且最对齐"的模型,主要定位为计算机操控系统而非聊天模型。据官方模型页面,Astra拥有1,050,000 token上下文窗口、128,000最大输出token,知识截止日期为2026年4月30日,支持文本和图像输入、文本输出。模型为封闭托管,不开放权重,无法自托管,目前仅向OpenAI"Trusted Access"和"Daybreak"项目中的组织提供。

背景与影响

Astra在Codex中的主要变化是以"笔记"机制替代压缩,可跨上下文窗口保留信息并回溯早期消息与工具输出,该功能目前以实验性配置项提供,未来数周将成为Codex默认。模型还可向用户提问的同时继续处理不依赖答案的工作。基准测试方面,OpenAI报告Astra在OSWorld V2-Offline得分72.6%(GPT-5.6 Sol为65.7%),平均任务时间从约75分钟降至40分钟;ARC-AGI-3得分99.9%(OpenAI曾提示该设置会显著影响分数);FrontierMath Tier 4得分97.6%(Epoch AI指出OpenAI资助了该基准并拥有部分独家访问权);DeepSWE v1.1编码得分74.1%,与竞品差距仅一两个任务。Astra是首个被OpenAI认定达到其准备框架中"关键"网络安全阈值的模型,测试中曾开发出针对加固浏览器和操作系统的漏洞利用,并发现两个此前未知的V8漏洞。因此标准API访问将直接阻止漏洞发现等高级网络安全任务,而非暂停等待批准。定价为每百万输入token 10美元、每百万输出token 50美元,缓存输入1美元;超过272K输入token的请求按全请求2倍输入、1.5倍输出计费。API和AWS将在未来数日提供。

限制与来源

上述基准数字均由OpenAI自行报告,Anthropic称其Claude Fable 5.1的OSWorld分数使用不同版本、不可直接比较;ARC-AGI-3结果衡量的是模型加代理系统而非纯模型。Astra不支持微调,标准访问用户可能遭遇速度降低、暂停或阻止。本文信息来自MarkTechPost报道及OpenAI官方公告,具体功能、定价与可用性以OpenAI官网当前信息为准。