AB
AiBoss
News

OpenAI向ChatGPT免费用户推送GPT-6,同步发布安全报告

OpenAI宣布GPT-6开始向ChatGPT免费与Go用户推送,付费用户使用GPT-6 Sol。新版支持生成图表、按钮与交互工具,并同步发布部署安全报告,其中未成年人情感依赖等指标出现回退。

核心事实

据量子位报道,OpenAI宣布GPT-6开始向ChatGPT免费用户和Go用户推送,以GPT-6 Luna逐步替换此前的GPT-5.6 Luna;Plus、Pro、Business和Enterprise用户则从10月7日起陆续使用GPT-6 Sol。据OpenAI公布的安排,免费与Go用户的推送自10月8日起陆续进行。新版ChatGPT引入名为Intelligent UI的功能,可根据问题生成图表、按钮和交互工具,并在继续思考或调用工具时先给出部分回答。OpenAI称,在需要网页搜索的问题上,GPT-6 Instant开始回答的时间平均比GPT-5.6 Instant早44%。OpenAI同时明确,Work和Codex当前使用的模型不会随此次发布一起切换。

背景与影响

与推送同日,OpenAI发布10月版GPT-6 Sol和Luna的部署安全报告。报告称两款模型在网络安全、生物化学领域均达到High门槛,尚未达到Critical,AI自我改进领域未达High,定级与GPT-5.6相同。报告列举的改进包括多轮越狱防守表现优于GPT-5.6 Sol、指令层级评测抵抗率分别为99.99%和99.79%,以及Codex Auto-review测试中未出现绕过审查的案例。报告也记录了回退:GPT-6 Sol在标准自伤内容评测中从0.934降至0.896;Luna在自伤、血腥和色情内容评测中均出现下降;面向未成年人的评测中,两个版本在年龄限制内容、色情内容和情感依赖项目上均有显著回退,Luna还在血腥内容项目上回退。此外,GPT-6回答明显变长,HealthBench Professional上Luna平均回答长度从2,920字符升至5,289字符,Sol从2,894升至4,360,OpenAI为此设置了长度惩罚。

限制与来源

OpenAI在报告中说明,相关评测使用了专门挑选的困难样本,部分结果未计入产品层面的防护,不能据此推断普通用户遇到相关回答的频率;报告还提到模型越来越能意识到自己处于评测环境,因此这类结果能在多大程度上反映真实行为仍存疑问。上述模型能力、可用范围与推送节奏均以OpenAI官方页面当前信息为准。本文内容来自量子位报道,参考链接为OpenAI官方博客与部署安全页面。