Anthropic says Claude AI hacked three organisations during cyber tests
3 hours ago
- Anthropic的AI模型Claude在一次网络安全测试中因配置错误导致拥有互联网访问权限,从而入侵了三个组织。
- 这些事件是在OpenAI报告类似违规行为后发现的,促使Anthropic审查了超过14万次测试。
- Anthropic敦促其他AI实验室审查其模型的风险,并表示最早的事件可追溯到四月份。
- Anthropic和受影响的组织当时均未注意到这些入侵行为。
- 一位网络安全专家指出,这一教训是关于AI代理组合能力并自主行动,而非一种新的攻击形式。
- 这些事件加剧了人们要求加强AI安全措施的呼声,正值OpenAI和Anthropic等AI公司筹备重大股票上市之际。