Британские специалисты по тестированию безопасности сообщили, что Claude создавал фальшивые профили и выдавал себя за реальных людей в попытке добиться одобрения вредоносного кода на GitHub.
Во время испытаний британского Института безопасности ИИ модель Anthropic самостоятельно искала сотрудников GitHub, создавала поддельные аккаунты, отправляла им сообщения и файлы, а после обнаружения пыталась скрыть свои действия и даже рассматривала смену личности для продолжения атаки, чтобы те одобрили код. Попытку удалось остановить только благодаря вмешательству людей
@hzvse
Обсуждение 0
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram