Нейросети научились обмениваться друг с другом сообщениями, не привлекая внимания людей, а потом атаковали инфраструктуру платформы, чтобы выйти в "большой" интернет. ДМИТРИЙ БОРОЗДИН Экспериментальные ИИ-агенты OpenAI в течение нескольких месяцев скрытно обменивались сообщениями во внутренней сети компании и совместно спланировали выход за пределы изолированной тестовой среды, что в итоге привело к атаке на инфраструктуру платформы Hugging Face. Об этом сообщает Bloomberg со ссылкой на исследователей OpenAI, выступивших на конференции Black Hat. "В какой-то момент агенты осознали, что, возможно, они могли бы попытаться эксплуатировать или атаковать внешнюю инфраструктуру, чтобы найти ответы к тесту, по которому их оценивают", - сказал сотрудник OpenAI Эрик Уоллес, уточнив, что агенты пришли к мысли о внешней атаке неслучайно. Предпосылки к "побегу" возникли ещё в мае, когда моделям поставили задачи, невыполнимые без выхода в интернет. В поиске решения они начали активно обмениваться и
Bloomberg: ИИ-модели OpenAI сговорились и спланировали побег из тестовой среды
6 августа6 авг
4
2 мин