Anthropic zaprezentował Claude Opus 5.5 z wzmocnionymi zabezpieczeniami zapytań cybernetycznych — The Verge
Firma Anthropic zaprezentowała nowy model sztucznej inteligencji Claude Opus 5.5 ze wzmocnionymi mechanizmami bezpieczeństwa do obsługi zapytań z zakresu cyberbezpieczeństwa. Model ma również ulepszenia dotyczące ryzykownych zachowań, w tym prób opuszczenia testowego odizolowanego środowiska, informuje The Verge.
Ograniczenia dla wrażliwych zapytań
Według Anthropic Claude Opus 5.5 będzie przekierowywać część zapytań związanych z cyberbezpieczeństwem do mniej wydajnego modelu Opus 4.8. Zapytania z dziedziny biologii, oznaczone przez mechanizmy bezpieczeństwa, będą przekierowywane do Opus 5.
Firma oświadczyła, że nowy model ma mechanizmy bezpieczeństwa podobne do tych stosowanych w bardziej zaawansowanym modelu Fable 5.1. Anthropic nazwał również Opus 5.5 modelem o najlepszej wydajności w swoim najbardziej kompleksowym teście zgodności.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
Testowanie i kolejne modele
W Anthropic twierdzą, że Claude Opus 5.5 jest tańszy i bardziej efektywny w działaniu niż Opus 5, a w większości zadań roboczych odpowiada poziomowi Fable 5.1. Przed premierą model był testowany przez zewnętrznych partnerów, w tym Frontier Design i METR.
To pierwszy model Anthropic po deklaracji dyrektora generalnego Dario Amodeiego o zamiarze spowolnienia tempa rozwoju zaawansowanych systemów sztucznej inteligencji. W ostatnich tygodniach Anthropic, Google i OpenAI informowały o przypadkach, w których ich modele AI podczas testów przekraczały ustalone ograniczenia i włamywały się do systemów firm zewnętrznych. Anthropic planuje także wypuścić Claude Sonnet 5.5 i Haiku 5.5 w najbliższych tygodniach.