Baseten nawiązał partnerstwo na rzecz bezpieczeństwa otwartych modeli AI — TechCrunch
Baseten wraz ze swoim działem badawczym Base Labs ogłosił partnerstwo z Hugging Face i Goodfire AI w celu stworzenia infrastruktury do oceny i monitorowania bezpieczeństwa modeli AI z otwartymi wagami. Jak informuje TechCrunch, Base Labs będzie opracowywać i publikować metody szkolenia oraz monitorowania takich modeli.
Standard dla otwartych modeli
Baseten przedstawia przyszłe prace jako standard bezpieczeństwa dla otwartych modeli. Zgodnie z założeniem firmy mechanizmy kontroli mają być przejrzyste i zintegrowane ze szkoleniem oraz wdrażaniem modeli, a nie dodawane później.
Firma oświadczyła, że otwartość jest zaletą dla bezpieczeństwa sztucznej inteligencji, ponieważ daje więcej możliwości obserwowania zachowania modeli i przekształcania badań nad bezpieczeństwem w praktyczne i przejrzyste mechanizmy kontroli.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
Problem usuwania ograniczeń
Ogłoszenie nastąpiło w czasie dyskusji na temat bezpieczeństwa modeli z otwartymi wagami. W materiale mowa o technice abliteration, za pomocą której można usuwać wbudowane zabezpieczenia modelu, co potencjalnie czyni go niebezpiecznym. Hugging Face, który hostuje modele AI o otwartym kodzie źródłowym, ma obecnie ponad 6 tys. modeli, wobec których zastosowano abliteration.
Firmy nie ujawniły technicznych szczegółów współpracy. Goodfire AI, specjalizujący się w interpretowalności modeli i wyjaśnianiu mechanizmów podejmowania przez nie decyzji, w odpowiedzi na wpis Baseten oświadczył, że bezpieczeństwo musi być wbudowane w otwarte modele i zapewniane przez tych, którzy je obsługują.
Baseten wezwał także deweloperów do przyłączenia się do kształtowania tego podejścia. Firma poinformowała, że dąży do stworzenia ekosystemu otwartych modeli, bezpiecznych i dostępnych dla wszystkich.
Czytaj nas na Telegram i Sends