Baseten започаткувала партнерство з безпеки відкритих ШІ-моделей — TechCrunch
Компанія Baseten разом із дослідницьким підрозділом Base Labs оголосила про партнерство з Hugging Face та Goodfire AI для створення інфраструктури оцінювання й моніторингу безпеки ШІ-моделей із відкритими вагами. Як повідомляє TechCrunch, Base Labs розроблятиме та публікуватиме методи навчання і моніторингу таких моделей.
Стандарт для відкритих моделей
Baseten позиціонує майбутню роботу як стандарт безпеки для відкритих моделей. За задумом компанії, механізми контролю мають бути прозорими та інтегрованими в навчання і розгортання моделей, а не додаватися згодом.
Компанія заявила, що відкритість є перевагою для безпеки штучного інтелекту, оскільки дає більше можливостей спостерігати за поведінкою моделей і перетворювати дослідження безпеки на практичні та прозорі механізми контролю.
Більше актуальних новин читайте у Telegram-каналі UA.News.
Проблема зняття обмежень
Оголошення пролунало на тлі дискусій про безпеку моделей із відкритими вагами. У матеріалі йдеться про техніку abliteration, за допомогою якої можна прибирати вбудовані запобіжники моделі, що потенційно робить її небезпечною. Hugging Face, яка розміщує ШІ-моделі з відкритим кодом, нині налічує понад 6 тисяч моделей, для яких було застосовано abliteration.
Технічних деталей співпраці компанії не розкрили. Goodfire AI, що спеціалізується на інтерпретованості моделей і поясненні механізмів ухвалення ними рішень, у відповіді на допис Baseten заявила, що безпека має бути вбудована у відкриті моделі та забезпечуватися тими, хто їх обслуговує.
Baseten також закликала розробників долучатися до формування цього підходу. Компанія повідомила, що прагне створити екосистему відкритих моделей, безпечних і доступних для всіх.