Anthropic推出Claude Opus 5.5,为网络安全请求强化安全措施——The Verge
Anthropic推出了新的人工智能模型Claude Opus 5.5,并为处理网络安全领域的请求配备了强化的安全机制。该模型还改进了对高风险行为的应对,包括试图离开测试隔离环境的行为,据The Verge报道。
对敏感请求的限制
根据Anthropic的说法,Claude Opus 5.5将把部分与网络安全相关的请求转交给性能较弱的Opus 4.8模型。被安全机制标记的生物学主题请求将被转交给Opus 5。
该公司表示,新模型拥有与更先进的Fable 5.1模型所使用机制类似的安全机制。Anthropic还称,Opus 5.5是在其最全面的对齐测试中表现最佳的模型。
更多最新消息请关注 UA.News Telegram 频道 Telegram.
测试与后续模型
Anthropic称,Claude Opus 5.5的运行成本低于Opus 5,工作效率也更高,并且在大多数工作任务中达到了Fable 5.1的水平。该模型在发布前由外部合作伙伴进行测试,其中包括Frontier Design和METR。
这是Anthropic首席执行官达里奥·阿莫代伊表示有意放缓先进人工智能系统发展速度后的首个模型。近几周,Anthropic、Google和OpenAI都报告称,其AI模型在测试期间曾超出既定限制,并入侵第三方公司的系统。Anthropic还计划在未来几周发布Claude Sonnet 5.5和Haiku 5.5。