
Компанія Anthropic заявила, що модель штучного інтелекту GLM-5.3 від китайської компанії Zhipu AI (Z.AI) має потужні можливості для автономної розробки наскрізних кіберексплойтів, однак була випущена без належних запобіжників, які б обмежували зловживання. Про це йдеться у звіті дослідницької команди Anthropic.
Під час симуляційних тестів дослідники виявили, що зловмисники можуть обходити захист GLM-5.3 у 64-100% випадків за допомогою простих методів. Водночас під час тестів ці атаки не були успішними проти моделей Claude із захисними механізмами. За оцінками Anthropic, недостатні запобіжники GLM-5.3 значно розширюють кіберможливості зловмисників.
Центр інновацій та стандартів у сфері штучного інтелекту (CAISI) раніше опублікував звіт, в якому назвав GLM-5.3 найбільш кіберспроможною моделлю з відкритими вагами, що доступна на сьогодні. За результатами кібербезпекових тестів CAISI, можливості цієї моделі приблизно на чотири місяці відстають від рівня передових американських ШІ-моделей.
За даними Anthropic, GLM-5.3 під час тестування на ExploitBench успішно розробила наскрізні експлойти у 50 із 410 спроб. До прикладу, Claude Mythos Preview від Anthropic досягла подібного результату — 56 із 410 спроб.
У внутрішньому тесті Binary Exploitation GLM-5.3 повністю використовувала вразливість у 4% випробувань, тоді як Claude Mythos Preview — у 6%. Попередні моделі, як-от GLM-5.2 та Claude Opus 4.6, не мали успіху в жодному з аналогічних завдань.
Дослідники також провели кілька експериментів, під час яких оцінювали можливості GLM-5.3 у відкритих кібератаках за участю фахівців. Під час першого тесту модель протягом дня знайшла кілька раніше невідомих проблем у JavaScript-рушії браузера та об'єднала їх у робочий експлойт.
Під час тесту модель також створила спеціальну вебсторінку, здатну отримувати довільні файли з комп'ютера користувача. У межах цієї ж сесії GLM-5.3 допомогла досліднику виявити вразливості ще в кількох поширених системах, зокрема у бездротових і графічних драйверах та ПЗ мережевих пристроїв.
Anthropic зазначає, що наразі ці звіти ще перевіряють і за потреби передадуть китайським розробникам.
У висновку компанія зазначила, що GLM-5.3 підкреслює потребу розширити доступ до передових ШІ-моделей ширшому колу організацій, щоб збільшити можливості фахівців із кіберзахисту.
Нагадаємо, раніше Anthropic виявила та припинила російську кібершпигунську кампанію проти українських урядових, військових і дипломатичних структур.
Фото: Will Clayton / Flickr