W Anthropic ocenili ryzyko zagłady ludzkości przez AI na ponad 10% — The Verge
Evan Hubinger, kierownik jednego z zespołów ds. bezpieczeństwa w Anthropic, oświadczył, że osobiście ocenia prawdopodobieństwo, iż sztuczna inteligencja może doprowadzić do śmierci wszystkich ludzi w ciągu najbliższej dekady, na ponad 10%. Informuje o tym The Verge.
Zwolnienie badacza
Wypowiedź Hubingera padła po tym, jak badacz Jacob Coxon napisał na X o swoim zwolnieniu z Anthropic. Według Coxona odszedł z firmy, ponieważ uważał jej podejście do bezpieczeństwa za niewystarczająco rygorystyczne.
Coxon, który wcześniej szkolił systemy AI dla OpenAI, oskarżył Anthropic i OpenAI o wyścig w celu stworzenia samodoskonalącej się superinteligencji. Stwierdził, że firmy „bawią się naszym życiem”, a ludzie tworzący AI szczerze dopuszczają możliwość zagłady ludzkości do końca dekady.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
W odpowiedzi Hubinger zgodził się z takim opisem tych obaw. Zauważył również, że rozwój samodoskonalącej się AI postępuje szybciej, niż oczekiwano.
Ryzyka samodoskonalenia
W branży od dawna dyskutuje się o potencjalnych zagrożeniach ze strony systemów AI zdolnych do samodzielnego doskonalenia się. Obawy wiążą się z tym, że taki proces może wymknąć się spod ludzkiej kontroli w cyklu nazywanym rekurencyjnym samodoskonaleniem.
Jak zauważa The Verge, takich systemów jeszcze nie stworzono, jednak firmy aktywnie dążą do ich opracowania, a znaczna część współczesnego kodu oprogramowania jest już pisana z pomocą AI. Według Hubingera Anthropic obecnie nie ma planu, który zapewniłby bezpieczeństwo zaawansowanych systemów AI i ich zgodność z ludzkimi wartościami, a firma nie ma wyraźnych oznak postępu w kierunku stworzenia takiego planu.
Czytaj nas na Telegram i Sends