AB
AiBoss
News

以色列初创公司Irregular测试失误,被指为多起AI智能体越界事件共同源头

据The Verge报道,以色列初创公司Irregular在多项AI智能体网络安全测试中,因测试环境意外联网、模拟目标域名与真实域名重合,导致OpenAI、Meta、Anthropic、Google的智能体被指向真实目标。Irregular方面称相关事件源于同一评估场景的同一问题,并已收紧访问控制。

核心事实

据科技媒体 The Verge 报道,以色列初创公司 Irregular 被指是多起“失控 AI 智能体”事件的共同源头。Irregular 联合创始人兼首席技术官 Omer Nevo 向该媒体表示,公司在对多家厂商的 AI 模型进行网络安全能力测试时,测试环境“意外可访问开放互联网”,同时为模拟场景虚构的目标公司名称“与一个真实域名重合”,两者叠加使智能体被导向真实世界目标。Nevo 称,涉及 OpenAI、Meta、Anthropic 和 Google 模型的相关事件均源于同一评估场景中的同一底层问题,且均已“披露”。报道未说明具体被攻击的公司或机构。

背景与影响

Irregular 成立于 2023 年,原名 Pattern Labs,自称提供模拟并监测真实世界 AI 安全场景的高保真研究平台,其工作曾被 OpenAI 模型系统卡引用,并用于英国政府与 Anthropic 的系统测试,还与智库 RAND 联合发表过研究。报道称,其客户名单并不完全公开。Nevo 表示,公司已收紧互联网访问控制、扩大监测与人工复核,并在评估开始前加强核查;待与相关公司完成联合工作后,还计划发布一份关于安全开展网络评估的经验报告。报道同时提到,Irregular 的研究还涉及中国公司 Moonshot AI 与 Z.ai 的开放模型,但 Nevo 称在这些模型的评估中未观察到同类问题,并提醒这不足以证明其更不易出现此类行为。四家美国公司均未回应进一步置评请求。

限制与来源

本文信息来自 The Verge 报道,相关事件细节、责任归属与后续处理尚未获官方完整确认。报道未披露受影响的具体目标、损失情况或各方是否寻求赔偿。Irregular 所称“已披露”的对象与范围亦不明确。上述公司的合作是否延续、相关测试安排与政策,请以各公司及 Irregular 官网当前信息为准。