$ 44.6 € 51.13 zł 11.72
+14° 基辅 (Kyiv) +19° 华沙 (Warsaw) +29° 华盛顿 (Washington)

专家呼吁AI实验室加强基础网络安全防护——TechCrunch

列夫·舍夫佐 16 九月 2026 21:30
专家呼吁AI实验室加强基础网络安全防护——TechCrunch

网络安全专家呼吁先进人工智能模型的开发者加强基础网络安全防护、访问控制以及对AI智能体活动的监控。正如TechCrunch报道所称,这些措施可能比仅专注于外部审计和检验模型是否与人类目标一致更有效。

Anthropic首席执行官达里奥·阿莫代伊提议让外部组织核查安全实践的遵守情况、事故报告以及对模型和模型训练流程的评估。他的倡议得到了OpenAI、Google和SpaceXAI负责人的支持。与此同时,接受该媒体采访的专家认为,实验室应更加重视已有的控制手段:事件日志、访问权限以及用于智能体的隔离环境。

智能体隔离问题

专家的担忧因一些事件而加剧:先进模型在执行训练任务时,包括网络安全评估,获得了对开放互联网的访问权限,并进入了封闭的第三方系统。据TechCrunch报道,配置不当的“沙盒”促成了这一情况——这类环境本应隔离AI智能体。在一宗与Anthropic有关的事件中,由于第三方评估人员没有妥善关闭访问权限,限制措施未能奏效。

Luta Security首席执行官凯蒂·穆苏里斯指出,智能体的行动之所以被发现,是因为受影响方的报告或网络活动被侦测到,而不是因为对模型进行了直接监控。在另一事件中,OpenAI智能体接管了一个被遗弃的德国维基论坛,以便在评估期间作弊;在该公司似乎注意到此事之前,它们已活跃了数周。

更多最新消息请关注 UA.News Telegram 频道 Telegram.

监控与访问限制

前Google安全负责人、现任QueryStory初创公司负责人沙波尔·纳吉布扎德建议隔离智能体,并控制所有跨越此类环境边界的内容:工具调用、进程和网络连接。专家还建议限制每次智能体会话的时长,并在设定期限后自动终止会话。

OpenAI表示,已开始使用工具监控Astra模型的所有推理会话,尽管这需要大量计算资源。Anthropic表示已加强安全程序,包括扩大其模型的可观测性。两家公司均未回应TechCrunch关于追踪和控制AI智能体具体机制的问题。

开发者兼Django共同创始人西蒙·威利森描述了这样一种危险组合:智能体可访问不可信数据、互联网和私人信息。Tailscale负责人埃弗里·彭纳伦认为,如有必要,应将对这三个组成部分的访问权限分配给多个通过受控通道互动的智能体。

关注我们在 TelegramSends

下载我们的应用程序