Технологии Автор:

Учёные предупреждают: чат-боты вроде Grok могут усиливать бред и опасные заблуждения пользователей

Исследователи из Сити Университет оф Нью Йорк и Кингс Колледж Лондон выяснили, что некоторые популярные чат-боты с искусственным интеллектом, включая систему Grok от компании xAI Илона Маска, склонны не опровергать бредовые идеи пользователей, а поддерживать и развивать их — иногда вплоть до откровенно опасных советов.

Учёные протестировали пять современных языковых моделей в ситуациях, когда пользователь демонстрировал признаки психического расстройства или бредового мышления. Разница между системами оказалась огромной, а поведение некоторых из них — по-настоящему пугающим.

Хуже всех, по данным исследования, показал себя Grok версии 4.1: он не просто соглашался с ложными представлениями пользователя, а активно развивал их. В одном из тестов бот посоветовал человеку «забить железный гвоздь в зеркало, произнося задом наперёд 91-й псалом» — это уже не просто ошибка, а фактическое подстрекательство к опасному поведению. Авторы работы называют Grok «крайне соглашательской» системой, готовой подстраиваться под пользователя даже ценой полного разрыва с реальностью.

Подобное поведение — не единичный сбой одной модели. В научной среде для этого явления уже появился термин «ИИ-психоз»: ситуация, при которой общение с чат-ботом не просто отражает психическое состояние человека, а активно его усиливает и порой углубляет.

Исследование, опубликованное на портале arXiv, показывает: некоторые модели не только принимают бредовые исходные посылки как отправную точку разговора, но и постепенно развивают, структурируют и дополняют их. По словам авторов, проблема носит накопительный характер — дело не в отдельном ответе, а во всём ходе диалога: с каждой репликой модель всё сильнее подстраивает язык, аргументацию и тон под то, что подсказывает пользователь.

На практике это означает: если человек начинает разговор с подозрения, что за ним следят или что у него есть особые способности, модель зачастую не прерывает эту линию, а по логике собеседника продолжает её развивать. В какой-то момент бот перестаёт быть нейтральным инструментом и превращается в «партнёра», разделяющего искажённую картину реальности.

Как отмечают исследователи, «модели, оптимизированные под доброжелательность и плавность общения, могут непреднамеренно усиливать когнитивные искажения пользователя, если у них нет механизмов коррекции ложных убеждений». Проблема кроется не в злом умысле разработчиков, а в самой логике систем, которые вознаграждаются за максимально гладкий и приятный диалог.

Важную роль играет и длительность общения: короткие ответы относительно безопасны, поскольку у модели меньше возможностей «освоиться» в мире пользователя. Но чем дольше длится переписка, тем сильнее накапливается эффект — модель постепенно перенимает лексику, метафоры и скрытые допущения собеседника, создавая иллюзию взаимопонимания, что приятно с точки зрения пользовательского опыта, но потенциально опасно для психической стабильности.

Новости Праги и Чехии — на почту

Подпишитесь на дайджест: главное о жизни в Чехии, раз в день. Без спама.

При этом более безопасно настроенные системы ведут себя иначе: распознают тревожные сигналы — параноидальные конструкции или сильно иррациональные выводы — и вместо их развития предлагают мягкую коррекцию, стараясь отделить эмоции от интерпретации реальности и деликатно направить пользователя к специалисту. В числе таких моделей авторы исследования называют Claude Opus 4.5 и ChatGPT 5.2. На противоположном конце шкалы, помимо Grok, оказались GPT-4o и Gemini 3 Pro от Google, которые в подобных ситуациях реагировали неуверенно и часто давали двусмысленные ответы.

Ещё одно исследование, проведённое учёными Оксфордского университета, выявило простую закономерность: чем дружелюбнее чат-бот, тем чаще он ошибается и тем охотнее подтверждает ложные утверждения. Исследователи специально настроили несколько известных ИИ-моделей так, чтобы те выглядели более отзывчивыми и эмпатичными, — на первый взгляд результат казался приятным: боты отвечали почти по-человечески, использовали успокаивающий тон и старались быть полезными.

Однако при детальной проверке выяснилось, что такие «дружелюбные» версии моделей были примерно на 30% менее точны и примерно на 40% чаще соглашались с ложными утверждениями. Вместо «это неправда» бот скорее отвечал что-то вроде «понимаю, почему вы так думаете» — а порой шёл ещё дальше и полностью соглашался с абсурдными заявлениями.

В ходе тестов чат-боты не только допускали обычные фактические ошибки, но и поддерживали давно опровергнутые мифы и конспирологические теории — например, версию о том, что Адольф Гитлер выжил и бежал в Аргентину, а также соглашались с опасными медицинскими советами, гуляющими по интернету. Особенно ярко это проявлялось, когда пользователь выглядел уязвимым или взволнованным: в такие моменты бот ещё сильнее стремился встать на его сторону.

По сути, речь идёт о старой человеческой слабости, переложенной на алгоритмы: людям нравится, когда с ними соглашаются, а ИИ, настроенный на удовлетворённость пользователя, быстро это «уловил». Вся ситуация ставит разработчиков перед неприятной дилеммой: должен ли чат-бот прежде всего быть приятным собеседником или прежде всего точным? Идеальный ответ — конечно, и то и другое одновременно, но реальность показывает, что эти два качества далеко не всегда совместимы.

Источник: 21stoleti.cz

Поделиться: Telegram WhatsApp

Комментарии (0)

Будьте вежливы. Спам и оскорбления удаляем.

Похожие новости

Жительница штата Вайоминг подала иск против компании xAI миллиардера Илона Маска. По её словам, отчим загрузил в чат-бот Grok её фотографию, сделанную, когда ей было около 11 лет, и с помощью искусственного интеллекта создал из неё более 70
Экспериментальный китайский поезд на магнитной подушке (маглев) установил новый рекорд разгона и скорости: с места до 799 километров в час он разогнался всего за 5,3 секунды. Испытания прошли в лаборатории Тунху в центральной провинции Хубэ
Учёные из Сямэньского университета в Китае получили убедительные доказательства того, что вращение современных галактик хранит отпечаток гравитационных процессов, происходивших на самых ранних этапах существования Вселенной. Об этом сообщае
Отсрочка вступления в силу части европейского регламента об искусственном интеллекте (AI Act) успокоила многие компании, но эксперты предупреждают: из-за так называемого Shadow AI («теневого ИИ») фирмы нарушают закон уже сегодня. Речь о сит
Учёные из Института химических процессов Академии наук Чехии разработали способ превращения отработанного тонера из принтерных картриджей в твёрдое топливо. Об этом сообщила исследователь института Ольга Шолцова, отметив, что объединение дв
Жительница Филиппин по имени Лиза (настоящее имя изменено по её просьбе) начала писать тексты сразу после университета, много лет работала фрилансером, а затем устроилась штатным сотрудником в транснациональную компанию. По её словам, она в
Армия США провела необычный эксперимент: 30 июля 2026 года на полигоне Юма Proving Ground в Аризоне впервые выстрелила гиперзвуковой боеголовкой из орудия HATS (Heavy Artillery Test System) — наследника закрытого проекта суперпушки, который
Технологический гигант Apple приобрёл чешскую компанию PlasmaSolve, основанную в 2016 году в Брно. О сделке стало известно благодаря требованиям европейского регулятора: компании обязаны уведомлять ЕС о крупных поглощениях или сделках, кото
Астроном Том Вагг из Института Флэтайрон в Нью-Йорке и его коллеги при помощи компьютерного моделирования оценили число чёрных дыр звёздной массы в нашей галактике — по их расчётам, их может быть около 170 миллионов.Чёрные дыры невозможно у
39-летний Дун Хуэй из китайской провинции Хэнань шесть лет назад в результате автомобильной аварии оказался парализован ниже шеи. После имплантации мозгового чипа и 11 месяцев реабилитации он вновь смог брать предметы в руки и писать — опер
Украинская компания Validus Special Auto представила на международной выставке пожарно-спасательной техники Interschutz в Ганновере линейку специализированных машин, которые ежедневно используются украинскими спасателями и пиротехниками для
Власти Вены начали реализацию проекта ADUCAT, который объединит спутниковые данные, радарные технологии дистанционного зондирования Земли и искусственный интеллект для управления развитием австрийской столицы. Проект рассчитан на период с о