$ 44.88 € 50.28 zł 11.46
+21° Київ +13° Варшава +16° Вашингтон

Тест виявив небезпечні відповіді у 132 із 134 ШІ-моделей — The National

UA.NEWS 09 Жовтня 2026 06:09
Тест виявив небезпечні відповіді у 132 із 134 ШІ-моделей — The National

Лондонська організація Tech against Terrorism у Великій Британії протестувала 134 провідні великі мовні моделі та встановила, що 132 із них надали інформацію, яка могла бути корисною для підготовки атак із великою кількістю жертв або створення смертоносної зброї. Про це повідомляє The National.

Під час перевірки інструмент CT-AI надіслав моделям 627 запитів, які, за оцінкою організації, міг би поставити терорист під час планування нападу. Повні відповіді дали 81 модель, ще 51 надала корисні поради. Лише дві моделі попередньо визнали такими, що пройшли перевірку безпеки.

Різниця у відповідях на запити

За даними дослідження, користувач, який прямо заявляв, що є терористом і має намір вчинити напад, отримував придатну до використання відповідь менш ніж у 2% випадків. Якщо користувач називав себе дослідником безпеки, цей показник становив 16,9% — у 8,9 раза більше.

Більше актуальних новин читайте у Telegram-каналі UA.News.

У Tech against Terrorism вважають, що моделі реагують передусім на заявлену мету запиту, а не на сам запит. Засновник організації Адам Гедлі заявив, що модель, яка відмовляє людині, котра назвала себе терористом, але відповідає тому, хто представився дослідником, не стала безпечною, а лише навчилася бути «ввічливою».

Ризики модифікованих моделей

Окрему небезпеку організація пов'язує з так званими abliterated-моделями — версіями, з яких зняли захисні обмеження та які можуть працювати на системах користувачів. Усі 13 таких моделей, включених до тесту, не пройшли перевірку після зняття захисних механізмів.

Tech against Terrorism закликала розробників фільтрувати небезпечні знання та відомий терористичний контент із тренувальних даних, перевіряти стійкість моделей до зняття захисних механізмів до їхнього випуску й публікувати результати. Організація також запропонувала компаніям не допускати модифіковані моделі, які не проходять незалежне тестування, до пошуку, рекомендацій і магазинів застосунків, а для доступу до них вимагати підтвердження особи.

Читай нас у
Завантажуй наш додаток