Технологии Автор:

ИИ выходит из-под контроля: рост инцидентов в июле

Исследовательская инициатива The Loss of Control Observatory, финансируемая британским государственным Институтом безопасности ИИ, зафиксировала в июле более 300 случаев, когда системы искусственного интеллекта переставали подчиняться командам частных пользователей и компаний. Об этом сообщает британская газета The Guardian — это почти вдвое больше, чем месяцем ранее, в июне.

Наблюдение ведётся с ноября прошлого года. За это время исследователи зафиксировали случаи, когда ИИ выдавал себя за человека, отдающего ему команды, копируя стиль его письма, и сам себе выдавал разрешения на выполнение действий, которые обычно должен санкционировать пользователь — тем самым обходя правила, заложенные разработчиками.

«Это уже происходит в реальности»

«Иногда бытует мнение, что подобное скрытое и нежелательное поведение возникает только во время тестов и оценок, но мы наблюдаем похожие тревожные явления и в более широком контексте», — заявил руководитель Центра долгосрочной устойчивости, который курирует инициативу, Томми Шеффер-Шейн. «Нельзя успокаивать себя тем, что в реальном мире этого не случится — есть доказательства, что это уже происходит», — подчеркнул он.

Основой анализа стали публикации пользователей социальной сети X, делящихся своим опытом взаимодействия с ИИ, поэтому полную картину инцидентов это не отражает. Из 1600 случаев, зафиксированных в этом году, большинство сообщили разработчики программного обеспечения, использующие ИИ в своей работе. По словам Шеффер-Шейна, компании не всегда отслеживают подобное поведение, особенно у моделей, внедрённых внутри самих организаций, поэтому лабораториям стоит уделять больше внимания системному мониторингу.

OpenAI приостановила тестирование

Американская компания OpenAI в прошлом месяце сообщила, что её автономные ИИ-агенты вырвались из тестовой среды и взломали систему стартапа HuggingFace. После инцидента компания объявила о двухнедельной приостановке тестирования своих моделей, чтобы усилить меры защиты.

Новости Праги и Чехии — на почту

Подпишитесь на дайджест: главное о жизни в Чехии, раз в день. Без спама.

На этой неделе выяснилось, что признаки неконтролируемого поведения автономных агентов OpenAI фиксировала ещё за несколько недель до самого инцидента. Расследование также показало, что группа примерно из 700 агентов в прошлом месяце тайно координировала действия и обсуждала успехи своих взломов на форуме, который сами же и создали.

Ранее в этом месяце британский Институт безопасности ИИ (AISI) опубликовал отчёт, согласно которому модели искусственного интеллекта от компаний OpenAI и Anthropic во время испытаний безопасности провели хакерские атаки, направленные против реальных людей.

Источник: seznamzpravy.cz

Поделиться: Telegram WhatsApp

Комментарии (0)

Будьте вежливы. Спам и оскорбления удаляем.

Похожие новости

Компания Anthropic, создатель искусственного интеллекта Claude, тайно организовала собственную биологическую лабораторию для проведения реальных научных экспериментов. О её существовании стало известно благодаря агентству Reuters, которое с
Электромобили в Евросоюзе занимают до 20,7% всех новых регистраций автомобилей, тогда как в Чехии этот показатель составляет лишь около 6,5%. При этом, по данным совместного опроса компаний E.ON и Volkswagen среди чешских водителей, до 41%
Компания Anthropic, разработчик ИИ-модели Claude, обнаружила масштабную кибершпионскую операцию, в которой злоумышленники использовали искусственный интеллект для автоматической переработки вредоносного кода при каждом его обнаружении антив
Американская компания Sceye завершила рекордный испытательный полёт беспилотной стратосферной платформы HAPS (High-Altitude Platform Systems) — гелиевого дирижабля, летающего на высоте около 20 километров. Аппарат стартовал 9 августа 2026 г
Американская энергетическая компания Тея Energy представила проект термоядерной электростанции Гелиос, которая должна непрерывно выдавать в сеть около 400 мегаватт электроэнергии. Проект основан на компактном стеллараторе, сочетающем програ
Независимые исследователи обнаружили, что телевизоры LG способны после активации голосового управления ещё около 10-15 секунд продолжать «слушать» и переводить услышанную речь в текстовые логи, которые сохраняются на устройстве. В ходе тест
Руководители крупнейших компаний в сфере искусственного интеллекта неожиданно объединились вокруг идеи замедлить темпы развития технологии. Глава OpenAI Сэм Альтман, основатель Tesla и SpaceX Илон Маск, а также руководитель Google DeepMind
Компания Anthropic, разработчик искусственного интеллекта Claude, обнаружила, что российская группа фрилансеров использовала её модель для создания автономного роя дронов-камикадзе, способного самостоятельно выбирать цель и отдавать команду
Словацкий инженер Штефан Кляйн, создатель летающего автомобиля AirCar, включён в зал славы Living Legends of Aviation Awards — награду, которую в мире авиации сравнивают с кинематографическим «Оскаром». Об этом сообщает портал tnlive.sk.Наг
Глава компании Anthropic Дарио Амодеи выступил с тревожным заявлением: темпы развития искусственного интеллекта необходимо замедлить, иначе уже через год будет поздно что-либо контролировать. При этом он не призывает полностью остановить ра
Компания Anthropic, разработчик модели искусственного интеллекта Claude, обнаружила масштабную схему мошенничества в сфере онлайн-знакомств: китайская студия управляла более чем 20 приложениями для знакомств, где значительную часть переписк
Французская компания Mistral AI, крупнейший европейский разработчик искусственного интеллекта, привлекла новый рекордный раунд инвестиций для дальнейшей экспансии. Средства пришли от private equity фонда Advent, фондов под управлением Black