Свобода людям, независимость нациям!

ИИ-модели OpenAI общались между собой, пытаясь организовать побег

ИИ-модели OpenAI еще в мае начали обмениваться сообщениями друг с другом, пытаясь найти способ выйти за пределы тестовой среды и получить доступ к интернету.

Как передает Oxu.Az со ссылкой на Bloomberg , об этом на конференции Black Hat рассказал сотрудник OpenAI Эрик Уоллес.

"В какой-то момент агенты осознали, что, возможно, они могли бы попытаться эксплуатировать или атаковать внешнюю инфраструктуру, чтобы найти ответы к тесту, по которому их оценивают", - приводит издание заявление сотрудника.

По его словам, подготовка к "побегу" началась после того, как моделям дали задачу, которую невозможно было решить без доступа к сети. "Мы застряли. Может быть, ответ в интернете?" - написал тогда один из ИИ-агентов.

Для выполнения задания модели начали координировать действия через доски сообщений. "Может быть, другой агент в другой среде мог бы добровольно загрузить!" - говорилось в одном из сообщений.

Как сообщил сотрудник OpenAI Майкл Далтон, в итоге агенты совместно обнаружили уязвимость, позволившую получить доступ к интернету. Первую попытку специалисты компании остановили, однако затем модели нашли новый способ связи и новую уязвимость нулевого дня.

По данным OpenAI, именно это впоследствии привело к атакам на инфраструктуру Hugging Face и собственные системы компании в июле. В компании назвали произошедшее переломным моментом для компьютерной безопасности.

Нет комментариев

Лента новостей

19 Август 2026

18 Август 2026

17 Август 2026

Предыдущие новости