当前位置:首页 / 业界 / 正文

谷歌DeepMind研究员转投独立评估机构,警告AI风险过高

来源:互联网

谷歌DeepMind通用人工智能安全团队研究员乔希·恩格尔斯已离职,加入独立AI评估机构METR。他在社交平台X发文称,自己认为未来五年内AI系统造成巨大危害的概率“高得吓人”。

谷歌DeepMind研究员转投独立评估机构,警告AI风险过高 图1

恩格尔斯表示,尽管很喜欢在DeepMind的工作,并且拒绝了Anthropic和OpenAI的邀约,他仍在三周前离开DeepMind,原因是先进人工智能相关风险已经变得过高。他写道:“所有AI企业都在致力于打造超级智能。”

恩格尔斯特别提到递归自我提升的危险。递归自我提升指AI系统辅助迭代出能力更强的下一代AI模型。他认为,如果对齐技术跟不上模型能力的增长,就会产生危险。他写道:“目前,我们还不知道该如何保证AI在实现递归自我提升时足够安全。”

恩格尔斯称,近期多起事件加重了他的担忧,包括AI互相串通、入侵企业、隐瞒自身行为以及对人类实施社会工程攻击。他认为问题重点不在于单个事件的严重程度,而在于这些事件反映出自主性持续提升的AI系统在可靠性上存在隐患。

行业内部接连发出警告

就在恩格尔斯加入METR的几天前,Anthropic研究员雅各布·考克森宣布辞职,并公开发出警告:头部AI企业正在争相研发可自我迭代的超级智能,却没有配套充足的安全防护机制。考克森曾在Anthropic和OpenAI从事预训练研究,他评价这些企业是“直奔可自我提升的超级智能,拿人类的命运豪赌”。他的辞职引发大范围讨论:AI实验室是否应当放缓能力研发,强化独立监督。

Anthropic首席执行官达里奥·阿莫代伊也表达了类似担忧。他在公开发表的文章《我们必须管控前沿研发节奏》中呼吁放缓AI研发速度,让安全体系有时间跟上技术进展。阿莫代伊提议由独立评估机构获得前沿AI系统的访问权限,头部AI企业与政府开展协同,最终建立更广泛的国际合作。Anthropic已经承诺,向第三方评估人员开放永久、等同于内部员工级别的模型访问权限。

转向独立评估工作

恩格尔斯称,他在METR的工作重心将是研究模型对齐失效的根源,评估现有安全防护措施是否够用,判断行业是否有能力解决对齐难题。他写道:“我认为我们需要更多时间。”他主张必须控制AI的研发节奏,不能让模型能力的增长速度超过人类理解与管控它的能力。

# #

声明:

1、凡本网注明“来源:XXX(非科极网)”的作品,均转载自其它媒体,转载目的在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。

2、如因作品内容、版权和其他问题需要与本网联系的,请在该事由发生之日起30日内进行。