微软发布AI模型行为准则
微软公布了一份人工智能模型行为准则,旨在引导模型远离危险行为。该文件规定了公司在训练模型时遵循的价值观和限制,TechCrunch报道。
模型的绝对限制
根据微软的体系,每个模型都将拥有一套通用行为准则,其优先级将高于个别用户的意愿和具体任务。绝对限制包括禁止将模型用于网络攻击、与核武器有关的活动以及制作深度伪造内容。
该文件还包含旨在防止人类总体失去对AI控制权的条款。模型不得使用自适应、欺骗性、自我强化机制、串通或其他方法,以规避或克服人类监督。获授权的人员或系统必须保留可靠地引导、修改和关闭模型的能力。
更多最新消息请关注 UA.News Telegram 频道 Telegram.
AI发展的原则
该准则规定,模型应支持人类而非取代人类,并促进人类福祉。文件预测,在未来十年内,超级智能AI系统将在完成大多数任务方面超越人类。该准则将对此类系统的遏制、控制和对齐称为人类面临的最大挑战之一。
微软与Anthropic、OpenAI和xAI总体上支持谨慎发展先进AI系统的方式。微软首席执行官萨提亚·纳德拉也表示支持聚焦于AI对齐的研究,以及在AI实验室中设置内置评估者的理念。