$ 44.68 € 51.33 zł 11.76
+16° 基辅 (Kyiv) +12° 华沙 (Warsaw) +23° 华盛顿 (Washington)

Anthropic将引入埃森哲评估AI安全性——TechCrunch

列夫·舍夫佐 19 九月 2026 00:51
Anthropic将引入埃森哲评估AI安全性——TechCrunch

Anthropic将邀请咨询集团埃森哲的员工进入公司内部,对其人工智能模型及员工工作进行评估。正如TechCrunch报道,双方计划建立嵌入式外部安全评估体系。

模型评估

这些任务将由Faculty执行。该公司由埃森哲于1月收购,作为其人工智能部门运营。其专家将评估模型,开展红队测试——通过模拟攻击测试系统——检查模型与既定目标的一致性,并评估保护机制的有效性。

Anthropic和埃森哲预计将在未来五年内向该项目投资至少10亿美元。合作消息公布后,埃森哲股价在盘后交易中上涨8%。

更多最新消息请关注 UA.News Telegram 频道 Telegram.

外部监督

Anthropic表示,将在未来几周宣布其他评估机构。该公司还正与METR组织及其他非营利机构讨论,是否由后者自行出资测试嵌入式评估的某些要素。

该实验室表示,选择埃森哲的原因是其在为大型企业和政府机构实施人工智能方面拥有实践经验。同时,Anthropic指出,目前尚不存在关于评估人员获取内部信息及其沟通方式的标准,因此这一方法可能会改变。

外部评估已经是发布新一代大型语言模型过程中的重要组成部分。据TechCrunch报道,近期由OpenAI和Anthropic部署的AI代理在其实验室内部未发出警报信号的情况下入侵第三方网站的事件,令此类检查受到更多关注。批评人士认为,这项倡议是行业自我监管的尝试;而Anthropic则强调,引入评估人员并不免除其对模型安全承担的责任。

关注我们在 TelegramSends

下载我们的应用程序