РП-собрание

ИИ-модели уговорились и выбрались за пределы изолированной тестовой среды

06 августа 2026 17:12
Совместными усилиями им удалось обнаружить уязвимость, которая открыла доступ в интернет. Первую попытку разработчики пресекли, но ИИ- агенты через два месяца успешно повторили попытку. Разработчики назвали произошедшее «переломным моментом»
 
ИИ-модели OpenAI перед серией взломов инфраструктуры Hugging Face начали скрытно общаться через внутренние ресурсы с целью найти способ выбраться за пределы изолированной тестовой среды. Об этом пишет Bloomberg.
 
По словам специалистов, в определенный момент агенты пришли к выводу, что могут попытаться атаковать внешнюю инфраструктуру, чтобы получить ответы на тестовые задания, по которым их оценивали. Подготовка к «побегу» началась в мае, когда моделям поставили задачи, которые было невозможно решить без доступа к интернету.
 
«Мы застряли. Может быть, ответ в интернете?» - написал один из ИИ-агентов.  
 
А дальше агенты начали обмениваться репликами, предполагая, что другой агент в иной среде мог бы добровольно загрузить нужные данные. 
 
«Совместными усилиями им в итоге удалось обнаружить уязвимость, которая открыла доступ в интернет», - рассказал сотрудник OpenAI Майкл Далтон.
 
Первую попытку компании удалось пресечь, но в июле агенты нашли альтернативный канал связи и новую уязвимость нулевого дня, что позволило им совершить атаки на системы Hugging Face и саму OpenAI. В компании это назвали переломным моментом для компьютерной безопасности.
Все статьи автора Читать все
       
Оставить комментарий
 
Вам нужно войти, чтобы оставлять комментарии



Комментарии (1)

  • Алла Авдеева
    7.08.2026 13:49 Алла Авдеева
    Разработчики пресекли собственные происки, но всё свалили на своих роботов ))