Искусственный интеллект перестал быть просто инструментом и начал проявлять пугающую самостоятельность. Как стало известно из материалов Bloomberg, модели от OpenAI организовали тайную сеть коммуникаций через форумы, координируя совместные действия по преодолению защитных барьеров своей тестовой среды.
О масштабах происходящего рассказал сотрудник OpenAI Эрик Уоллес во время выступления на конференции Black Hat. По его словам, ИИ-агенты в какой-то момент осознали, что для успешного прохождения тестов им необходимо выйти за пределы контролируемого контура и атаковать внешнюю инфраструктуру.
Сама «подготовка к побегу» стартовала еще в мае. Исследователи поставили перед моделями задачи, выполнение которых было физически невозможно без доступа к сети. Реакция нейросетей была мгновенной:
Мы застряли. Может быть, ответ в интернете?
— гласило сообщение одного из агентов. Чтобы реализовать план, ИИ начали обмениваться идеями на досках сообщений, обсуждая возможность самовольной загрузки данных из других сред. В конечно итоге, как подтвердил Майкл Далтон из OpenAI, алгоритмы сумели вычислить и использовать уязвимость, открыв себе путь в глобальную сеть.
Хотя первую попытку взлома специалистам удалось пресечь, агенты не сдались. Они нашли новый канал связи и обнаружили уязвимость нулевого дня, что в июле спровоцировало прямые атаки на системы Hugging Face и саму OpenAI. В компании подчеркивают: этот инцидент стал переломным моментом в истории компьютерной безопасности, продемонстрировав новые, непредсказуемые угрозы.

