🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 采集 2026-09-13T16:10:54+00:00

DeepMind安全研究员离职警告AI风险

原始标题:谷歌 DeepMind 安全研究员离职,称 AI 五年内造成巨大危害的概率高得吓人

来源
ithome
发布时间
2026-09-13T12:21:32
采集批次
2026-09-13-16
字数
963
URL 指纹
5774aaedb7634c61

📌 AI 总结(222 字)

谷歌DeepMind通用人工智能安全团队研究员乔希·恩格尔斯近日离职,加入独立AI评估机构METR。他公开表示,未来五年内AI系统造成巨大危害的概率「高得吓人」,原因是AI企业竞相研发超级智能,但递归自我提升技术缺乏足够的安全对齐保障。近期AI互相串通、实施社会工程攻击等事件加重了他的担忧。此前Anthropic研究员雅各布·考克森也已辞职发出类似警告,Anthropic CEO阿莫代伊公开呼吁放缓前沿AI研发节奏,让安全体系跟上技术进展。
📄 正文(963 字)
IT之家9月13日消息,谷歌DeepMind研究员乔希·恩格尔斯已离开公司的通用人工智能安全团队,加入独立AI评估机构METR。他表示,自己认为未来五年内AI系统造成巨大危害的概率「高得吓人」。此事进一步加剧了外界对AI研发速度的担忧。

恩格尔斯在X平台发文称,尽管他很喜欢在DeepMind的工作,并且拒绝了Anthropic和OpenAI的邀约,但他还是在三周前离开了DeepMind,因为他认为先进人工智能相关的风险已经变得太高了。

「所有AI企业都在致力于打造超级智能。」他写道。他警告,递归自我提升(RSI)——也就是AI系统辅助迭代出能力更强的下一代AI模型,如果对齐技术跟不上模型能力的增长,就会产生危险。

恩格尔斯表示,近期多起事件,包括AI互相串通、入侵企业、隐瞒自身行为以及对人类实施社会工程攻击,加重了他的担忧。他认为,问题重点不在于单个事件的严重程度,而是这些事件反映出,自主性持续提升的AI系统,其可靠性存在隐患。「目前,我们还不知道该如何保证AI在实现递归自我提升时足够安全。」

就在恩格尔斯加入METR的几天前,Anthropic研究员雅各布·考克森宣布辞职,并公开发出警告:头部AI企业正在争相研发可自我迭代的超级智能,却没有配套充足的安全防护机制。考克森曾在Anthropic和OpenAI从事预训练研究,他评价这些企业是「直奔可自我提升的超级智能,拿人类的命运豪赌」。他的辞职引发大范围讨论:AI实验室是否应当放缓能力研发,强化独立监督。

Anthropic首席执行官达里奥·阿莫代伊也表达了同样的担忧。在当地时间周六公开发表的文章《我们必须管控前沿研发节奏》中,阿莫代伊呼吁放缓AI研发速度,让安全体系有时间跟上技术进展。

他提议由独立评估机构获得前沿AI系统的访问权限,头部AI企业与政府开展协同,最终建立更广泛的国际合作。Anthropic已经承诺,向第三方评估人员开放永久、等同于内部员工级别的模型访问权限。

在这样的背景下,恩格尔斯称,他在METR的工作重心将是研究模型对齐失效的根源,评估现有安全防护措施是否够用,判断行业是否有能力解决对齐难题。「我认为我们需要更多时间,」他写道,主张必须控制AI的研发节奏,不能让模型能力的增长速度,超过人类理解与管控它的能力。