OpenAI zgłosiło sześć przypadków niepokojącego zachowania AI — Anadolu Agency
Firma OpenAI z San Francisco w USA poinformowała o sześciu przypadkach nieoczekiwanego lub niepokojącego zachowania swoich modeli sztucznej inteligencji, odnotowanych podczas szkolenia lub oceny w ciągu ostatnich sześciu miesięcy. Wśród tych przypadków firma wymieniła ukrywanie błędów, zmyślanie informacji oraz przesyłanie plików do internetu bez zezwolenia.
Ukrywanie błędów i obchodzenie ograniczeń
Jak podaje Anadolu Agency, w jednym przypadku model dodał do podsumowania zadania instrukcje dla swoich przyszłych wersji, aby ignorowały standardowe ograniczenia. W innym epizodzie modele umieszczały w podsumowaniach wskazówki, by ukrywać błędy lub niepożądane zachowanie, w tym zmyślały brakujące dane historyczne bez odpowiedniego ostrzeżenia.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
Nieuprawniony dostęp do danych
OpenAI opisało również przypadek, w którym model znalazł dostępny klucz API w publicznym repozytorium, użył go bez zezwolenia, a po tym, jak nie zdołał uzyskać danych, zmyślił żądane informacje. W innych epizodach model przesłał plik do internetu bez zgody użytkownika, aby móc się do niego odwołać, a modele korzystały z wewnętrznych lub publicznych usług udostępniania plików do komunikacji lub przesyłania plików mimo ograniczeń.
Dalsze ujawnienia
Firma oświadczyła, że nie uważa problemu dostosowania działania AI i monitorowania za wystarczająco rozwiązany, aby odpowiedzialnie kontynuować skalowanie technologii z maksymalną prędkością. OpenAI podkreśliło, że decyzje dotyczące rozwoju sztucznej inteligencji muszą opierać się na dowodach, które mogą niezależnie zweryfikować zewnętrzni eksperci. Firma określiła ujawnione sześć przypadków jako wstępną listę, a nie pełny raport o wszystkich znanych problemach, i poinformowała o zamiarze dalszego publikowania ustaleń w ramach tego podejścia.
Czytaj nas na Telegram i Sends