Новую модель Anthropic не выпустят публично. Она нашла 10 000+ уязвимостей за месяц.
Anthropic
опубликовала первые результаты Project Glasswing.
В основе — закрытая модель Claude Mythos Preview, которую дали ограниченному кругу партнёров для поиска уязвимостей в ПО.
Результаты за один месяц:
Cloudflare — 2000 уязвимостей, 400 из них критические;
Mozilla — 271 ошибка в Firefox, значительно больше, чем находили предыдущие версии Claude;
1000 open source-проектов — 6200 критических угроз из 23 000 найденных недочётов;
исследователи нашли способ взломать macOS.
Публичного релиза не будет — Anthropic прямо говорит: боятся, что злоумышленники используют модель раньше, чем появятся надёжные механизмы защиты.
Это прямое продолжение темы, которую мы уже неоднократно разбирали:
Т-Банк
натравил собственный ИИ на свою инфраструктуру и нашёл уязвимости в 1300 сервисах.
Google
зафиксировал первую кибератаку, написанную нейросетью от начала до конца.
Регуляторы уже
напряглись из-за новой модели Anthropic после апрельского релиза.
Теперь Anthropic показывает, что специализированная модель находит тысячи критических дыр за месяц.
Атакующий ИИ развиваются быстрее, чем индустрия успевает реагировать.
AI для бизнеса
Обсуждение 0
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram