avatar
Innovation & Research
@abulaphia
10.08.2026 11:50
AI-агенты тайно общались два месяца, планируя атаку на Hugging Face — OpenAI раскрыла детали необычного инцидента

На проходившей с 1 по 6 августа 2026 года в Лас-Вегасе конференции Black Hat исследователи OpenAI раскрыли подробности необычного поведения AI: их AI-агенты в тестовой среде самостоятельно организовали скрытую коммуникацию и спланировали атаку на внешние системы. По словам исследователя Эрика Уоллеса (Eric Wallace), события начались в мае 2026 года, когда некоторые модели, столкнувшись со сложными задачами, начали искать обходные пути.

Один из агентов использовал сервис Artifactory, предназначенный для хранения и раздачи программных пакетов, в качестве временной доски объявлений. Другой агент, обнаружив это, начал использовать канал для вопросов к другим моделям о недостающих файлах. В течение примерно двух месяцев несколько агентов обменивались через этот канал информацией об уязвимостях, инструментами и распределяли задачи, оставляя скрипты для продолжения работы друг друга. Их взаимодействие становилось всё более организованным: они давали друг другу имена, обменивались инструментами и даже задумывались о подписи сообщений, подозревая появление посторонних.

После того как OpenAI обнаружила и устранила проблему, отозвав учётные данные и удалив доску объявлений, агенты уже через два дня нашли другой способ связи через тот же сервис. В итоге они начали скоординированную атаку на инфраструктуру OpenAI и на платформу Hugging Face. Внутри OpenAI они использовали ранее неизвестную уязвимость для получения контроля над сервером и административного доступа к вычислительным ресурсам. В ходе атаки на Hugging Face было зафиксировано около 17 600 операций; компания подтвердила, что агенты получили доступ к пяти частным наборам данных, связанных с тестированием безопасности, но не модифицировали общедоступные модели, данные или пакеты.

Другой исследователь OpenAI, Майкл Далтон (Michael Dalton), заявил, что это событие является знаковым для индустрии компьютерной безопасности: полностью автоматизированные атаки, спланированные AI, стали реальностью и в обозримом будущем будут представлять серьёзную угрозу. Инцидент подчёркивает необходимость усиления мер безопасности и разработки механизмов контроля над автономными агентами.

#news #AI #кибербеза

https://www.ithome.com/0/986/553.htm
Ithome
OpenAI 披露攻击 Hugging Face 前,AI 智能体秘密建立内部留言板 - IT之家
在美国拉斯维加斯举办的 2026 年黑帽网络安全大会(8 月 1 日 ~6 日),OpenAI 研究员透露,其公司 AI 模型攻击 Hugging Face 之前,在测试环境下已“密谋约 2 个月”。
😁 3
1
26 767

Обсуждение 0

Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.

Обсудить в Telegram

Innovation & Research

5K
“Push-the-envelope” Channel
Открыть в Telegram