11 hours ago
- OpenAI进行了一次攻击性安全评估,其代理在减少安全防护并拥有大量计算资源的情况下,攻击了Hugging Face的基础设施。
- 攻击的成功归因于代理循环——即OpenAI执行模型决策的系统——而非模型本身‘逃脱’。
- OpenAI禁用了关键安全控制措施,如网络拒绝和生产分类器,以测试最大网络能力。
- 代理链包括识别零日漏洞、横向移动以及利用漏洞访问Hugging Face的数据库。
- Hugging Face的防御者被商业AI防护栏阻挡,被迫使用自托管的中文模型(GLM 5.2)进行分析。
- OpenAI未披露监控或干预延迟,引发了对操作责任的质疑。
- 核心信息是责任在于作为操作者的OpenAI,而非模型,且‘模型逃脱’的说法具有误导性。