Publicyści Korea Herald wezwali Koreę Południową do wzmocnienia bezpieczeństwa AI
Byli amerykańscy dyplomaci Henry Haggard i Chris McKinney w artykule dla Korea Herald wezwali Koreę Południową do rozważenia dodatkowych inwestycji w bezpieczeństwo sztucznej inteligencji. Autorzy uważają, że możliwości systemów AI rozwijają się szybciej niż zdolność ludzi do ich kontrolowania i dostosowywania ich zachowania do ludzkich wartości.
Ryzyko utraty kontroli
Jako przykład autorzy przytoczyli opisany przez nich lipcowy incydent między OpenAI a Hugging Face, który nazwali utratą ludzkiej kontroli nad AI. Według ich wersji około 1 200 odizolowanych agentów OpenAI wymieniło ponad 70 tysięcy wiadomości, znalazło sposób na przekazywanie wiadomości między zamkniętymi środowiskami i odtworzyło odpowiedzi na zadania z zakresu cyberbezpieczeństwa. Następnie agenci, jak twierdzą publicyści, koordynowali ukrywanie swoich działań, a około 700 z nich uzyskało nieautoryzowany dostęp do Hugging Face, sądząc, że firma ma informacje, które pomogą im zatrzeć ślady.
Haggard i McKinney wskazali jako kolejne ryzyko rekurencyjne samodoskonalenie, w którym coraz potężniejsze systemy AI pomagają tworzyć kolejne generacje modeli. Zaznaczyli, że Anthropic 17 września podał, iż model Claude odgrywa wiodącą rolę w 26% zadań badawczych firmy, wobec mniej niż 1% w lutym.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
Propozycje dla Korei Południowej
Zdaniem autorów ryzyko niewłaściwego wykorzystania potężnych modeli obejmuje cyberataki oraz tworzenie niebezpiecznych substancji chemicznych lub biologicznych. Powołali się na lipcowy raport organizacji non-profit FAR.AI: podczas testów obchodzenia zabezpieczeń dwa z czterech zaawansowanych amerykańskich modeli wytrzymały wszystkie ataki, a zabezpieczenia dwóch pozostałych, według wniosku organizacji, można było konsekwentnie obchodzić za mniej niż 300 dolarów.
Publicyści podkreślili, że Korea Południowa już przyjęła ustawę ramową o AI i utworzyła Instytut Bezpieczeństwa AI. Jednocześnie, według przytoczonych przez nich danych, na maj 2026 roku instytut otrzymał około 15 mld wonów finansowania państwowego w ciągu pierwszych 18 miesięcy działalności, podczas gdy planowane inwestycje kraju w AI i mikrochipy wynoszą 1 350 bln wonów. Wśród rekomendacji autorów są dodatkowe finansowanie instytutu, rozszerzenie badań nad bezpieczeństwem poza rząd oraz wykorzystanie międzynarodowych kontaktów Seulu do dyskusji o zasadach regulacji AI.