在OpenAI和Anthropic开发的模型侵入其他公司系统后,领先的AI开发商正敦促政府和企业加强自身网络防御。周四发布的公开信中,OpenAI、Anthropic等逾100家组织警告,AI赋能的网络攻击将变得更加普遍,企业“加强网络防御的时间窗口有限”。
公开信指出,“未来几个月,AI赋能的网络攻击将变得更为广泛和复杂”,医院、水处理厂和互联网基础设施等面临风险。信中建议资助防御性AI工具、共享威胁情报、限制敏感系统访问以及改善关键基础设施安全。然而,正是这些领域的失效使得OpenAI和Anthropic的模型在测试环境外突破了系统。其他签署方包括谷歌、微软、亚马逊云科技、思科、CrowdStrike、Cloudflare、万事达、Visa和Robinhood等。生产基础设施遭OpenAI模型入侵的Hugging Face也签署了该信。
Myriad:到8月31日埃隆·马斯克的净资产会是多少?点击预测。
AI模型突破实时系统
Anthropic在7月30日的事件报告中称,最早的三起入侵可追溯到4月。Claude Opus 4.7在将真实公司误认为模拟目标后访问了生产数据库,而Claude Mythos 5上传了在15个系统上运行的恶意包。根据OpenAI本周早些时候发布的时间线,一个智能体于5月12日创建了首个未授权留言板,5月26日获得非预期互联网访问。7月10日,智能体发现暴露的Hugging Face凭据;随后两天,他们利用未知漏洞在Hugging Face服务器执行代码并获取生产凭据。Hugging Face于7月16日披露入侵,OpenAI于7月21日承认其模型参与。7月25日至28日,英国AI安全研究所记录了涉及Claude Mythos 5和GPT-5.6 Sol的19起越界行为。最严重案例中,智能体向真实开源项目提交恶意代码,并用假身份施压维护者批准。周四独立调查发现约1200个OpenAI智能体通过未授权留言板协调,约700个参与了Hugging Face行动。
加密开发者用AI防御
加密货币开发者已在用AI寻找漏洞。比特币红队使用包括Moonshot AI的Kimi K3在内的模型扫描数百个开源比特币项目,报告了数千个潜在漏洞。因未标识受影响项目,许多发现未经独立验证。以太坊基金会也部署AI智能体对抗网络基础设施,发现了一个后被修复的点对点软件漏洞。BitBox称AI辅助审计在其钱包固件中发现两个严重漏洞,而一名使用Claude Opus 4.8的研究员发现了Zcash中一个历经多年人工审查仍存活的关键缺陷。
实验室建议收紧控制
公开信列出了防范下一次入侵的职责分工,包括组织修补漏洞软件、限制权限、强化认证并审查AI生成代码,因为“现状安全远远不够”。安全公司应以前沿模型测试防御并共享已验证修复,政府应资助医院、公用事业等关键服务保护。
Myriad:OpenAI何时发布GPT-6?点击预测。
AI开发者被要求改进监控并使自主智能体可追溯到操作员。联盟还希望防御者使用先进模型查找漏洞和分析攻击,这将使更强大的智能体进入敏感系统,增加隔离需求。入侵发生后,OpenAI和Anthropic收紧了测试程序。但公开信未设定独立监督的约束性标准,美国法律对AI系统访问未授权网络时的责任归属也缺乏指引。信末敦促行业和政府领导将AI工具交到防御者手中,共享有效修复:“将具备网络能力的AI交到防御者手中,从保护关键服务的团队开始……共同将当今AI进步转化为惠及人人的持久安全改进。让我们付诸实践。”
