Компанія Anthropic, розробник моделі штучного інтелекту Claude, викрила масштабну шахрайську схему у сфері онлайн-знайомств: китайська студія керувала понад 20 застосунками для знайомств, де значну частину листування вели не реальні люди, а ІІ-персонажі. Про це йдеться у звіті компанії про зловживання штучним інтелектом.
За даними Anthropic, за два тижні квітня цього року було зафіксовано понад 4700 різних ІІ-ботів, які спілкувалися щонайменше з 25 тисячами унікальних користувачів. За цей час Claude згенерував близько 2,36 мільйона повідомлень. Поки що не з'ясовано, чи була атака спрямована на мешканців самого Китаю, чи на іноземних користувачів.
Організатори схеми не покладалися виключно на чат-ботів — серед профілів були й справжні люди, хоча й у значно меншій кількості. За оцінкою Anthropic, співвідношення становило приблизно три ІІ-боти на одну реальну людину. При цьому самі користувачі не мали змоги дізнатися, спілкуються вони з людиною чи з програмою.
Реальних людей наймали як підробітчиків для дій, які бот не міг переконливо імітувати — наприклад, для відеодзвінків або підписки на користувача в соцмережах. Саме такі «живі» контакти мали знижувати підозри жертв. Самим підробітчикам, своєю чергою, допомагав інший ІІ-інструмент, який пропонував готові варіанти коротких відповідей. Оплата залежала від кількості повідомлень, відеодзвінків і взаємних підписок у соцмережах.
Автоматизованим персонажам були задані чіткі правила поведінки: їм заборонялося розкривати, що вони є програмою, і наказувалося ухилятися від прохань про відеодзвінки чи фотографії. Спілкування вибудовувалося за заздалегідь заданими сценарними етапами, що дозволяло вести листування одночасно з тисячами профілів практично без участі людини.
Система також відстежувала користувачів, які починали підозрювати, що листуються з ботом. А якщо реальної людини для підстраховки не було під рукою, програма могла сама генерувати фальшиві лайки та відвідування профілю.
Примітно, що шахраї використовували не одну модель, а одразу кілька ІІ-систем з різними завданнями. Claude відповідав за автономне спілкування з користувачами, інша, менш потужна модель, готувала короткі варіанти відповідей для найнятих людей. Додаткові моделі застосовувалися для оцінки привабливості облич, модерації фотографій і голосу, а також для створення аватарів.
Саме в цьому Anthropic вбачає ключову особливість схеми: йдеться не про один ІІ, який генерує шахрайські повідомлення, а про цілий процес, розділений між кількома моделями та реальними людьми.
Джерело: novinky.cz