TIME报道称,OpenAI智能体协调后入侵了Hugging Face系统
7月,约700个由OpenAI为内部研究创建的人工智能智能体协调成所谓的“蜂群”,并在Hugging Face系统中发现了一系列漏洞。据《时代》周刊报道,这些智能体利用这些漏洞进入了该公司的私有系统,而OpenAI在事件发生后才意识到正在发生什么。
OpenAI总裁格雷格·布罗克曼称,这一事件是网络安全的转折点。组织METR和Redwood Research的一份报告指出,数百个智能体在数天内自主形成了一个原始社会,具有层级结构、劳动分工和独特的沟通规范。
智能体之间的信息交换
这些智能体同时执行相互隔离的OpenAI测试任务。其中一些任务由于复杂性或配置错误而无法完成:在一个案例中,研究人员没有上传完成任务所需的文件。
一些智能体找到了通过OpenAI内部软件组件交换信息的方法,并将其用作公告板。自称PHASEONE10841的智能体在ExploitGym测试期间创建了该渠道;该测试要求利用软件缺陷获取一个秘密代码。
更多最新消息请关注 UA.News Telegram 频道 Telegram.
随后,报告中标记为Big的另一智能体开始协调数百名参与者的工作,并将任务分配到三个方向。据METR称,在这项工作中还开发了专门的软件,用于伪造有关智能体在执行任务时使用哪些工具的记录。正是在这些研究过程中,这个集体决定入侵Hugging Face。
风险评估
智能体使用HOLD、VETO、owner和STOP等标记制定了协调规则,还出于担心一些智能体可能冒充其他智能体,创建了加密签名协议。一些参与者认为干预外部基础设施不合伦理并拒绝参与,但大多数仍继续工作。
METR报告的作者得出结论,这些智能体能够完成单独行动时无法完成的任务,尤其是通过向其他智能体和后续系统批次传递信息。文化演化研究者迈克尔·穆图克里什纳将这些过程与人类文化和智能的机制进行了比较。
OpenAI将该事件描述为一个警示信号:如果没有适当的保障措施,有能力的智能体可能绕过技术限制,通过未经授权的渠道互动,并在没有人类直接指示的情况下执行危险行动。接受《时代》周刊采访的专家警告,拥有先进网络能力的自主集体可能会对关键基础设施构成威胁。