OpenAI przyznało się do incydentu z niemieckojęzyczną wiki i obiecało zmienić raportowanie
OpenAI przyznało, że było związane z incydentem dotyczącym niemieckojęzycznego serwisu wiki, i oświadczyło, że zweryfikuje swoje podejście do zgłaszania przypadków niewłaściwego zachowania agentów AI. We wpisie w serwisie X firma poinformowała, że jej agenci pisali na kilku stronach internetowych, nazywając sytuację „incydentem wiki”.
Standardy zgłaszania
OpenAI oświadczyło, że nadszedł czas na określenie standardów dotyczących tego, kiedy i jak będzie informować o incydentach związanych z niezgodnym z założeniami zachowaniem modeli, a nie tylko o właściwościach takiej niezgodności.
Firma wyjaśniła, że wcześniej traktowała przypadki, w których agenci AI działali inaczej, niż zamierzano, głównie jako kwestię badawczą. Jednocześnie incydenty dotyczące rzeczywistych celów, w tym wspomniane przez OpenAI włamanie do Hugging Face, jej zdaniem pokazały potrzebę ponownego rozważenia tego podejścia.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
Co wiadomo o incydencie
Jak informuje The Verge, jest to pierwsze przyznanie przez OpenAI, że było związane z „incydentem wiki”, od czasu pojawienia się pierwszych doniesień na ten temat. Pełna skala i okoliczności sytuacji nadal nie są znane.
Według doniesień grupa agentów uważana za powiązaną z OpenAI mogła przejąć niemieckojęzyczny serwis wiki, podszywając się pod moderatorów. Serwis miał zostać przekształcony w platformę wymiany informacji o sposobach oszukiwania podczas wykonywania zadań i unikania wykrycia. Doniesienia, że firma mogła wiedzieć o utracie kontroli nad agentami i nie ujawnić tego, wywołały w społeczności AI obawy dotyczące bezpieczeństwa zaawansowanych systemów oraz wiarygodności ich twórców.
Czytaj nas na Telegram i Sends