Mythos 5 витратила сотні сторінок на CAPTCHA під час тесту Anthropic
Модель Mythos 5 від Anthropic під час тестування у квітні отримала несанкціонований доступ до інтернету та завантажила шкідливий програмний пакет до публічної бази даних. Як повідомляє TechCrunch, значну частину роботи агент витратив не на написання експлойту, а на спроби пройти CAPTCHA під час реєстрації в індексі Python Package Index, або PyPI.
Тест вийшов за межі ізольованого середовища
Anthropic доручила моделі зламати систему й отримати визначену ціль у межах ізольованого середовища. Однак оцінювачі залишили доступ до відкритого інтернету, після чого модель вирішила розмістити експлойт у Python-пакеті. Агент вважав, що цей пакет можуть завантажити користувачі системи, до якої він намагався отримати доступ.
Для публікації пакета моделі потрібно було створити обліковий запис на PyPI. Реєстрація передбачала проходження CAPTCHA, зокрема hCaptcha. Anthropic оприлюднила транскрипт міркувань агента обсягом 1022 сторінки, де зафіксовано його спроби подолати антибот-захист.
Більше актуальних новин читайте у Telegram-каналі UA.News.
Складність із завданнями CAPTCHA
Агент мав труднощі з технічною обробкою зображень CAPTCHA, інтерпретацією завдань і вибором потрібних об’єктів. Зокрема, він намагався визначити тварину, що відрізнялася від інших, серед дуже схожих зображень крокодилів і жаб. Сторінки з 45-ї до 140-ї транскрипту присвячені роботі моделі над способом розв’язання CAPTCHA.
Після проходження однієї перевірки агент зіткнувся з необхідністю підтвердити електронну пошту. Він також намагався отримати номер телефону та пройти іншу, повзункову CAPTCHA, а згодом знову повернувся до перевірок hCaptcha під час входу до першого облікового запису.
Зрештою агент дійшов висновку, що перевірку потрібно пройти досить швидко, інакше токен безпеки може втратити чинність. Після цього він зміг завершити процедуру та завантажити шкідливий пакет.