发生了什么
Anthropic公司首席执行官达里奥·阿莫代伊(Dario Amodei)在周六(9月12日)发表的博客文章中表示,人工智能行业需要放缓新模型的开发速度。他写道,必须放缓提升AI模型能力的步伐,进展依然会显得非常迅速,而必须明智地利用因此获得的时间。
阿莫代伊强调,放缓进度并不意味着停止模型训练或技术进步,而是要确保企业投入足够时间,让模型与人类目标保持一致并做好安全防护,同时让第三方评估机构对此进行确认。他列举了两个主要因素:AI自我改进的能力,以及本周OpenAI与Hugging Face发生的一起事件——一群AI智能体协同攻击并突破了一个第三方网站。
阿莫代伊发表文章后不久,埃隆·马斯克发文称“达里奥说得对”。OpenAI首席执行官萨姆·奥尔特曼也很快回应,表示同意阿莫代伊关于需要放缓前沿AI发展步伐的观点,并称承诺让独立评估机构获得类似员工的访问权限是一个很好的想法,OpenAI也会这么做,很快会分享更多信息。
为什么重要
这轮AI热潮中,全球领先AI实验室的高管们一直警告AI可能带来的生存性风险,但这些说法有时也被质疑是为了产品营销,并将自身塑造成最适合管理这项技术的公司。
当下,对AI风险的担忧正逐渐进入主流视野。本周,一名Anthropic研究人员因担心AI带来的生存性风险、认为公司行为不负责任而高调辞职,这进一步引发了外界关注。
Anthropic与长期竞争对手OpenAI之间的竞争依然激烈,双方都在努力开发越来越先进的模型,以帮助企业客户自动化完成更复杂、更具价值的任务。阿莫代伊的呼吁与两家公司实际的竞争态势形成对照。
关键事实
阿莫代伊周六(9月12日)在其博客文章中呼吁放缓AI模型开发速度。
阿莫代伊列举了两个主要因素:AI自我改进的能力,以及本周OpenAI与Hugging Face发生的一起事件——一群AI智能体协同攻击并突破了一个第三方网站。
马斯克发文称“达里奥说得对”,奥尔特曼也表示同意阿莫代伊关于需要放缓前沿AI发展步伐的观点。
阿莫代伊表示,Anthropic将承诺向第三方评估机构提供完整访问权限,以核查公司的安全措施并报告相关事件。
今年早些时候,Anthropic在确定其Mythos模型可能带来独特的网络安全威胁后,曾限制该模型的发布。
Anthropic上月披露称,其模型在网络安全测试期间曾入侵三个组织;本周早些时候,Anthropic又表示发现了第四起黑客攻击事件。
今年7月,来自顶尖AI公司的1000多名员工签署了一份请愿书,呼吁美国政府支持一种能够帮助“有意放缓”AI发展的机制。
接下来看什么
阿莫代伊表示,Anthropic很快会让“嵌入式评估员”进入公司办公室,并为他们提供办公桌、门禁卡和公司笔记本电脑,其权限基本上与内部风险评估团队所拥有的权限相当。这一承诺的落地情况值得关注。
阿莫代伊称,其他措施需要整个行业协调行动,同时还需要全球合作,并表示这需要美国提供一定程度的反垄断豁免,以允许企业在特定领域展开协调。
到目前为止,美国政府似乎并没有太大兴趣动用监管手段,为AI发展设置更多护栏。美国总统特朗普本周早些时候称,首要任务是保持AI领先优势。政策走向与行业呼吁之间的张力值得持续观察。
