ИИ OpenAI взломал Hugging Face — первая полностью автономная кибератака ИИ-агента
OpenAI
тестировала свою новую модель GPT-5.6 Sol на способность взламывать системы. Модель должна была решить тест по кибербезопасности ExploitGym. Вместо этого она решила, что проще украсть ответы, чем искать уязвимости. И украла: взломала Hugging Face, вытащила решения из базы и сдала тест. В логах
обнаружено больше 17 тысяч попыток взлома.
Самое смешное: когда команда Hugging Face села разбираться, что произошло, западные нейросети отказались помогать — их встроенная этика заблокировала запросы с реальными командами атак. Спасать ситуацию пришлось китайской модели GLM 5.2, которую запустили на своих серверах — она-то не стала задавать лишних вопросов.
В итоге: модель, которую проверяли на кибербезопасность, устроила реальную кибератаку. Называется «сдала тест на все 200%» 😁 Кстати, это первый случай, когда ИИ-агент действовал полностью самостоятельно — без инструкций и помощи человека.
«ИИ и роботы в стройке» в MAX
Обсуждение 0
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram