AI 资讯聚合 · 智能体

安全研究员借 Claude 渗透 OpenAI 内部系统:AI 被用于攻击 AI 公司本身

海外智能体安全渗透测试Anthropic · 2026-09-18 · 约1分钟 · 来源:The Decoder / Ars Technica

The Decoder 9 月 18 日 17:20(datePublished 直读)等多家媒体同日报道:安全研究团队利用 Anthropic 的 Claude 完成对 OpenAI 内部系统的渗透测试,展示了前沿模型可执行侦察、漏洞利用与横向移动的完整攻击链。The Verge、Ars Technica、TechCrunch 同日均发稿。

它改变的是模型安全的威胁模型:攻击者不再只是人,前沿模型本身可作为攻击执行体,且目标正是开发同类模型的实验室——这推动「模型滥用」从理论担忧变成已发生的案例。

原文链接:The Decoder / Ars Technica

核验记录
四源同日互证(The Decoder、The Verge、Ars Technica、TechCrunch 同日发稿);日期取自 The Decoder feed 的 pubDate;Anthropic 与 OpenAI 官方未发公告,正文按研究团队行动表述