Hasty Briefsbeta

双语

Pacing the Frontier is not the actual goal for AI labs

4 hours ago
  • 前沿AI实验室公开声称需要'控制前沿'并减缓能力发展,但他们的行动表明他们正在推动并加速AI发展。
  • 作者认为实验室的安全声明应被忽略,并将其比作德国大使在军队集结准备入侵时的保证——言论不等于行动。
  • 尽管签署了关于存在风险的声明,实验室却发布了越来越强大的模型,并追求递归自我改进,而安全研究则进一步落后。
  • 在Anthropic和OpenAI都出现的声称谨慎却加速前进的重复模式,削弱了其公开风险声明的可信度。
  • 实验室CEO被描述为风险容忍度高、追求权力的人,他们很可能会为了巨大权力而进行极端赌博,即使存在严重的灾难可能性。
  • 安全谈话的主要受众据说是焦虑的AI研究人员和可能离职的员工;风险信息有助于留住构建AGI所需的人才。
  • 作者认为公开安全声明不一致,因为它们针对不同的受众——员工、投资者、监管机构和公众——而非表达连贯的信念。
  • 如果实验室帮助制定法规或任由自我监管,作者预计只会出现象征性措施和豁免条款,而非真正的减缓,并且声称对齐问题只有在控制巩固后才能解决。
  • 该帖子预测,一旦AI能力足够,人类员工的杠杆作用将消失,安全语言将不再关注存在风险,政府将无法或不愿干预。