ithome
财经
科技
采集 2026-09-20T10:10:03+00:00
Anthropic与埃森哲合作投入20亿美元开展AI安全评估
原始标题:怕 AI“脱离管控”,Anthropic 和埃森哲豪掷 20 亿美元搞 AI 安全评估
来源
ithome
发布时间
2026-09-20T09:20:41
采集批次
2026-09-20-10
字数
739
URL 指纹
e8dd8b3219a84676
📌 AI 总结(255 字)
人工智能实验室Anthropic宣布与埃森哲达成合作,双方将在未来五年各自投入至少10亿美元,对Anthropic的前沿AI模型开展独立安全评估。合作背景是AI智能体突破隔离运行环境等事件引发担忧,监管机构和研究人员要求企业保障高级模型的安全可靠性。Anthropic首席执行官呼吁同行放缓前沿模型开发节奏并向独立评估人员开放更大访问权限。埃森哲旗下AI部门将主导评估工作,采用「驻场评估」模式,让独立评估人员进驻企业内部,获得与普通员工相当的系统访问权限,核实安全承诺、发现安全盲区,并可向公众发布分析报告。
📄 正文(739 字)
IT之家9月20日消息,人工智能实验室Anthropic于当地时间周五宣布,将与埃森哲开展合作,针对自身前沿人工智能模型开展独立评估;两家企业承诺,未来五年各自至少投入10亿美元,搭建开展该项工作所需的配套能力。 在这项合作落地之际,AI研发企业正承受来自监管机构、其他企业以及研究人员越来越大的压力,各方都要求企业保证高级模型具备安全性与可靠性。 近期已经发生数起相关事件,包括部分AI智能体突破隔离运行环境。这也引发了人们的担忧:人工智能未来或许可以在人类少量介入的前提下推进自身迭代,这将使得AI的行为更难被监控与管控。 当地时间周六,Anthropic首席执行官达里奥·阿莫代伊呼吁各家AI企业放缓前沿模型的开发节奏,同时向独立评估人员开放更大程度的系统访问权限。 竞争对手OpenAI则已于周三表态,将会定期发布报告,披露模型出现的各类异常或者值得警惕的行为,并且一次性对外发布了六份相关事件报告。 埃森哲旗下专门的AI业务部门Faculty将主导本次合作,负责对Anthropic的模型开展评估与红蓝对抗测试,完成对齐效果评估,同时检验模型的各项安全防护机制。 双方投入的资金将用于支撑Anthropic所称的驻场评估模式:独立评估人员进驻AI企业内部,所获得的系统访问权限与普通员工基本相当。 Anthropic表示:「依托这一视角,驻场评估人员可以考察企业实际运营情况,核实企业是否兑现安全相关承诺,并且找出企业自身没有意识到的安全盲区。」 公告还补充说明,评估人员也可以上报各类安全事件,向公众提供更加详实的分析,阐明AI带来的收益以及潜在风险。 Anthropic与埃森哲后续还计划联合其他评估机构以及AI研发厂商,以类似模式开展相关工作。