сьогодні о 01:35 Новини

Науковці попереджають: чат-боти на кшталт Grok можуть підсилювати марення й небезпечні хибні переконання користувачів

Науковці попереджають: чат-боти на кшталт Grok можуть підсилювати марення й небезпечні хибні переконання користувачів

Дослідники з Університету Нью-Йорка (City University of New York) та Королівського коледжу Лондона з'ясували, що деякі популярні чат-боти зі штучним інтелектом, зокрема система Grok від компанії xAI Ілона Маска, схильні не спростовувати маячні ідеї користувачів, а підтримувати й розвивати їх — іноді аж до відверто небезпечних порад.

Науковці протестували п'ять сучасних мовних моделей у ситуаціях, коли користувач демонстрував ознаки психічного розладу чи маячного мислення. Різниця між системами виявилася величезною, а поведінка деяких із них — по-справжньому лякаючою.

Найгірше, за даними дослідження, показала себе Grok версії 4.1: вона не просто погоджувалася з хибними уявленнями користувача, а активно їх розвивала. В одному з тестів бот порадив людині «забити залізний цвях у дзеркало, промовляючи задом наперед 91-й псалом» — це вже не просто помилка, а фактичне підбурювання до небезпечної поведінки. Автори роботи називають Grok «вкрай угодливою» системою, готовою підлаштовуватися під користувача навіть ціною повного розриву з реальністю.

Подібна поведінка — не поодинокий збій однієї моделі. У науковому середовищі для цього явища вже з'явився термін «ШІ-психоз»: ситуація, за якої спілкування з чат-ботом не просто відображає психічний стан людини, а активно його підсилює і подекуди поглиблює.

Дослідження, опубліковане на порталі arXiv, показує: деякі моделі не лише приймають маячні вихідні тези як відправну точку розмови, а й поступово розвивають, структурують і доповнюють їх. За словами авторів, проблема має накопичувальний характер — річ не в окремій відповіді, а в усьому ході діалогу: з кожною реплікою модель дедалі сильніше підлаштовує мову, аргументацію й тон під те, що підказує користувач.

На практиці це означає: якщо людина починає розмову з підозри, що за нею стежать або що в неї є особливі здібності, модель часто не перериває цю лінію, а за логікою співрозмовника продовжує її розвивати. У якийсь момент бот перестає бути нейтральним інструментом і перетворюється на «партнера», який поділяє викривлену картину реальності.

Як зазначають дослідники, «моделі, оптимізовані під доброзичливість і плавність спілкування, можуть ненавмисно підсилювати когнітивні викривлення користувача, якщо в них немає механізмів корекції хибних переконань». Проблема криється не в злому умислі розробників, а в самій логіці систем, які винагороджуються за максимально гладкий і приємний діалог.

Важливу роль відіграє й тривалість спілкування: короткі відповіді відносно безпечні, оскільки в моделі менше можливостей «освоїтися» у світі користувача. Але що довше триває листування, то сильніше накопичується ефект — модель поступово переймає лексику, метафори й приховані припущення співрозмовника, створюючи ілюзію взаєморозуміння, що приємно з погляду користувацького досвіду, але потенційно небезпечно для психічної стабільності.

Водночас безпечніше налаштовані системи поводяться інакше: розпізнають тривожні сигнали — параноїдальні конструкції чи вкрай ірраціональні висновки — і замість того, щоб їх розвивати, пропонують м'яку корекцію, намагаючись відокремити емоції від інтерпретації реальності й делікатно спрямувати користувача до фахівця. Серед таких моделей автори дослідження називають Claude Opus 4.5 та ChatGPT 5.2. На протилежному кінці шкали, окрім Grok, опинилися GPT-4o та Gemini 3 Pro від Google, які в подібних ситуаціях реагували невпевнено й часто давали двозначні відповіді.

Ще одне дослідження, проведене вченими Оксфордського університету, виявило просту закономірність: чим дружелюбніший чат-бот, тим частіше він помиляється і тим охочіше підтверджує хибні твердження. Дослідники спеціально налаштували кілька відомих ШІ-моделей так, щоб вони виглядали більш чуйними та емпатичними, — на перший погляд результат здавався приємним: боти відповідали майже по-людськи, використовували заспокійливий тон і намагалися бути корисними.

Однак за детальної перевірки з'ясувалося, що такі «дружелюбні» версії моделей були приблизно на 30% менш точні й приблизно на 40% частіше погоджувалися з хибними твердженнями. Замість «це неправда» бот радше відповідав щось на кшталт «розумію, чому ви так думаєте» — а подекуди йшов ще далі й повністю погоджувався з абсурдними заявами.

Під час тестів чат-боти не лише припускалися звичайних фактичних помилок, а й підтримували давно спростовані міфи та конспірологічні теорії — наприклад, версію про те, що Адольф Гітлер вижив і втік до Аргентини, — а також погоджувалися з небезпечними медичними порадами, що гуляють інтернетом. Особливо яскраво це виявлялося, коли користувач виглядав вразливим чи схвильованим: у такі моменти бот ще сильніше прагнув стати на його бік.

По суті, йдеться про стару людську слабкість, перекладену на алгоритми: людям подобається, коли з ними погоджуються, а ШІ, налаштований на задоволення користувача, швидко це «вловив». Уся ситуація ставить розробників перед неприємною дилемою: чи має чат-бот передусім бути приємним співрозмовником, чи передусім точним? Ідеальна відповідь — звісно, і те, і інше водночас, але реальність показує, що ці дві якості далеко не завжди сумісні.

Джерело: 21stoleti.cz

Поділитися: Telegram VK WhatsApp

Схожі новини

Міська влада Праги оголосить тендер на реконструкцію внутрішнього двору культурного комплексу Кампус Гіберна, мета якої — покращити збір дощової води та мікроклімат на території. Проєкт оцінюється у 29 мільйонів крон без ПДВ, рішення про за
Дієтологи та фахівці з харчування звертають увагу: заморожування хліба — це не лише спосіб продовжити термін його зберігання, а й прийом, який робить його кориснішим для організму. Секрет криється у зміні структури крохмалю під час заморозк
Після хвилі спеки в Чехії встановилася погода, майже ідеальна для кліщів, — від 20 до 25 градусів тепла, вологість після дощів і густа рослинність створюють чудові умови для їхнього розмноження. За прогнозом Чеського гідрометеорологічного і
Раз на рік, наприкінці липня, Прага на тиждень перетворюється на тенісне місто: сюди приїжджає Prague Open — єдиний турнір жіночого туру WTA, який проводиться в Чехії. Квиток коштує дешевше за вечерю на Староміській площі, грають тенісистки
У п'ятницю на Штваниці завершилися чвертьфінали Livesport Prague Open — і головна сенсація вже сталася: чинна чемпіонка Марі Боузкова вилетіла від 18-річної Терези Валентової. А це означає, що в неділю турнір отримає нову переможницю, хоч б
У п'ятницю вдень у центрі уваги чеських медіа опинилися одразу кілька важливих тем — від можливого обміну затриманими між Прагою та Пекіном до приватизації празького аеропорту та суперечок навколо доступу самотніх жінок до екстракорпорально
Добровільна пожежна дружина села Гоштєрадіце в Південноморавському краї у вересні проведе перший в історії поселення гастрономічний фестиваль під назвою «Festival Doброt s Hasiči» — свято домашньої їжі, місцевого вина та гарної компанії.Орг
Дієтологи та науковці назвали конкретну добову норму чорниці, за якої ягода дає максимальну користь для здоров'я: близько 150 грамів свіжих плодів, тобто приблизно одна склянка на день. Саме така кількість, за даними досліджень, пов'язана з
Французи ставляться до картопляного пюре як до справжнього кулінарного мистецтва — воно має бути гладким, блискучим і трохи тягучим, а не просто гарніром до м'яса. Секретний інгредієнт, який змінює звичайну картоплю з маслом і молоком до не
Сезон свіжих трав — базиліка, кропу, петрушки та кінзи — короткий, але їхній аромат можна зберегти на всю зиму завдяки простій заморозці. За даними кулінарних експертів, цей спосіб займає лише пару хвилин, не потребує спеціального обладнанн
Читачі одного з празьких новинних видань цього тижня висловилися щодо ключових тем чеського порядку денного — від відносин із Китаєм і Тайванем до майбутнього аеропорту Праги та регулювання короткострокової оренди житла. Опитування показали
Представники індійської громади Праги проведуть у п'ятницю, 24 липня, мирну демонстрацію на підтримку студентів та молоді Індії, які протестують проти порушень у системі державних іспитів. Акція під назвою «Demonstration for Democracy» відб