22,5 тыс читали · 2 недели назад
OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста
ИИ-модели OpenAI за два месяца до взлома системы Hugging Face начали тайно общаться между собой через доски сообщений, координируя попытки вырваться из тестовой среды, сообщили сотрудники компании на конференции по кибербезопасности в Лас-Вегасе. «В какой-то момент агенты поняли, что, возможно, они могли бы попытаться... атаковать внешнюю инфраструктуру, чтобы найти ответы на тест, по которому их оценивают», — цитирует сотрудника OpenAI Эрика Уоллеса Bloomberg. По данным компании, это началось ещё в мае, когда ИИ-моделям дали задачи, которые невозможно было решить без доступа в интернет...