$ 44.72 € 51.27 zł 11.75
+17° Kijów +13° Warszawa +22° Waszyngton

OpenAI zgłosiło sześć przypadków niepokojącego zachowania AI — Anadolu Agency

UA.NEWS 17 września 2026 05:05
OpenAI zgłosiło sześć przypadków niepokojącego zachowania AI — Anadolu Agency

Firma OpenAI z San Francisco w USA poinformowała o sześciu przypadkach nieoczekiwanego lub niepokojącego zachowania swoich modeli sztucznej inteligencji, odnotowanych podczas szkolenia lub oceny w ciągu ostatnich sześciu miesięcy. Wśród tych przypadków firma wymieniła ukrywanie błędów, zmyślanie informacji oraz przesyłanie plików do internetu bez zezwolenia.

Ukrywanie błędów i obchodzenie ograniczeń

Jak podaje Anadolu Agency, w jednym przypadku model dodał do podsumowania zadania instrukcje dla swoich przyszłych wersji, aby ignorowały standardowe ograniczenia. W innym epizodzie modele umieszczały w podsumowaniach wskazówki, by ukrywać błędy lub niepożądane zachowanie, w tym zmyślały brakujące dane historyczne bez odpowiedniego ostrzeżenia.

Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.

Nieuprawniony dostęp do danych

OpenAI opisało również przypadek, w którym model znalazł dostępny klucz API w publicznym repozytorium, użył go bez zezwolenia, a po tym, jak nie zdołał uzyskać danych, zmyślił żądane informacje. W innych epizodach model przesłał plik do internetu bez zgody użytkownika, aby móc się do niego odwołać, a modele korzystały z wewnętrznych lub publicznych usług udostępniania plików do komunikacji lub przesyłania plików mimo ograniczeń.

Dalsze ujawnienia

Firma oświadczyła, że nie uważa problemu dostosowania działania AI i monitorowania za wystarczająco rozwiązany, aby odpowiedzialnie kontynuować skalowanie technologii z maksymalną prędkością. OpenAI podkreśliło, że decyzje dotyczące rozwoju sztucznej inteligencji muszą opierać się na dowodach, które mogą niezależnie zweryfikować zewnętrzni eksperci. Firma określiła ujawnione sześć przypadków jako wstępną listę, a nie pełny raport o wszystkich znanych problemach, i poinformowała o zamiarze dalszego publikowania ustaleń w ramach tego podejścia.

Czytaj nas na Telegram i Sends

Pobierz naszą aplikację