Может ли ИИ троллить по-настоящему?
Есть старая философская проблема - как понять, что у другого существа есть сознание? Мы знаем, что сами думаем и чувствуем. Но как убедиться, что за словами другого действительно стоят мысли и чувства?
Я мыслю, следовательно, существую. (Декарт)
Декарт считал, что главный признак мыслящего существа - способность использовать настоящий язык. Не просто выдавать заготовленные фразы, а отвечать строго по делу.
Позже эта идея легла в основу
теста Тьюринга: если человек в текстовой беседе не может отличить компьютер от человека, значит, машина условно проходит проверку на «разумность».
Но есть и более ироничная версия такого теста - тест на тролля.
Смысл простой:
сможет ли ИИ вести себя как настоящий интернет-тролль? Не просто писать случайные оскорбления, а понимать контекст обсуждения, находить слабые места, провоцировать участников и делать это так, чтобы его нельзя было отличить от человека.
Примитивный компьютерный тролль - это бот, который спамит токсичными фразами. Настоящий же тест сложнее: ИИ должен прочитать пост, проанализировать комментарии, понять направление дискуссии и встроиться в неё с уместной, но провокационной репликой.
И вот здесь становится интересно.
Если современные языковые модели уже умеют поддерживать диалог, спорить, имитировать стиль и реагировать на контекст, то технически они могут научиться и троллингу. Вопрос только в том, будет ли это настоящим проявлением
«тролльской души»? Или просто качественной симуляцией неприятного человеческого поведения?
Возможно, изучение таких моделей помогло бы лучше понять самих троллей: почему они провоцируют, как выбирают цели и какие психологические механизмы за этим стоят.
А может быть, умение создать ИИ-тролля - это первый шаг к созданию хорошего фильтра от троллей?
Обсуждение 1
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram