快讯
Anthropic 报告点名智谱 GLM-5.3,被指像在打广告
Anthropic 发布报告警告智谱 GLM-5.3 具备较强网络攻击能力,并给出实测数据与绕过安全机制的方法。但报告中对 GLM-5.3 能力的详细描述,被不少读者认为更像是在为其做宣传。
Anthropic 报告点名 GLM-5.3 网络能力
据量子位报道,Anthropic 发布一份报告,点名智谱的 GLM-5.3,称该模型已具备较强的漏洞发现与攻击程序编写能力,且防滥用限制较容易被绕过。报告引用实测数据称,在考察完整漏洞利用能力的 ExploitBench 测试中,同样尝试 410 次,GLM-5.3 成功 50 次,Claude Mythos Preview 成功 56 次。报告还引用美国 NIST 下属 CAISI 在 9 月 17 日的评估,称 GLM-5.3 是迄今网络能力最强的开源权重模型,综合水平距美国前沿大约 4 个月。
报告内容与外界反应
报告核心可归纳为三点:一是 Mythos 级别的能力已扩散到开源模型;二是护栏较易绕过,研究员称通过角色扮演、预填思考内容或对开放权重做 abliteration 处理,可显著降低拒答率;三是呼吁对足够强的模型开展独立安全测试。不过,报告中对 GLM-5.3 能力的详细描述与成本核算,被不少读者认为更像是在为其做宣传。报道也指出,abliteration 针对的是开放权重属性,并非 GLM-5.3 独有;智谱在 8 月发布时曾推迟两周开源权重,并称先完成安全评估和加固。相关说法尚未获官方进一步确认。
限制与来源
上述内容来自量子位报道及 Anthropic 报告,具体测试条件、模型版本与价格信息以官方当前披露为准。开源模型安全治理涉及多方立场,本文仅作信息转述,不构成任何投资或安全建议。