Anthropic 发布 2026 年 9 月威胁情报报告:披露七类 AI 滥用活动
Anthropic 发布 2026 年 9 月威胁情报报告,称在 2025 年 12 月至 2026 年 8 月间识别并处置了威胁行为者滥用 Claude 的活动,涉及网络攻击、影响行动、监控、诈骗、生物滥用、常规武器研发与模型蒸馏七类危害领域。
Anthropic 披露八个月内处置的 AI 滥用活动
据 Anthropic 官网发布的《Detecting and countering misuse of AI: September 2026》报告,其威胁情报团队在 2025 年 12 月至 2026 年 8 月期间,识别并处置了威胁行为者试图利用 Claude 从事恶意活动的多起行动。报告称,相关活动覆盖七个危害领域:网络行动、影响行动、监控、诈骗与欺诈、生物滥用、常规武器研发以及模型蒸馏。Anthropic 表示,涉事模型包括 Claude Haiku、Sonnet 和 Opus;除一起非法蒸馏案例外,未发现涉及 Claude Fable 或 Mythos 级模型的滥用案例。
背景与影响
报告称,涉事行为者包括疑似国家支持的组织、以经济动机为主的犯罪者、商业间谍软件供应商、国家宣传机构以及出于政治动机的个人。案例涵盖用于诈骗用户的虚假交友应用网络,以及用于识别和监控异见人士的监控系统。Anthropic 表示,在每起案例中均处置了相关活动,并据此强化了防护措施,在适当情况下与主管部门和行业伙伴共享了情报。报告还提到,随着模型能力提升,若开发者与社会防御方不采取行动,相关风险可能上升。上述内容为 Anthropic 单方面披露,具体技术细节与结论尚未获独立第三方确认。
限制与来源
本快讯信息来自 Anthropic 官网报告页面,仅作概要转述,未对报告中的案例、归因或影响作独立核实。报告涉及的具体模型可用范围、功能与地区支持情况可能随时调整,请以 Anthropic 官网当前信息为准。本文不构成任何安全、法律或投资建议。