安全研究员借 Claude 渗透 OpenAI 内部系统:AI 被用于攻击 AI 公司本身
The Decoder 9 月 18 日 17:20(datePublished 直读)等多家媒体同日报道:安全研究团队利用 Anthropic 的 Claude 完成对 OpenAI 内部系统的渗透测试,展示了前沿模型可执行侦察、漏洞利用与横向移动的完整攻击链。The Verge、Ars Technica、TechCrunch 同日均发稿。
它改变的是模型安全的威胁模型:攻击者不再只是人,前沿模型本身可作为攻击执行体,且目标正是开发同类模型的实验室——这推动「模型滥用」从理论担忧变成已发生的案例。
核验记录
四源同日互证(The Decoder、The Verge、Ars Technica、TechCrunch 同日发稿);日期取自 The Decoder feed 的 pubDate;Anthropic 与 OpenAI 官方未发公告,正文按研究团队行动表述
← 上一篇阿里通义发 Qwen3.8-Omni-Flash:1M 上下文全模态,围绕智能体音视频理解与工具调用构建下一篇 →中国团队腹部 CT 通用诊断 AI 登 Science:单一模型多病种达专家级