Найти в Дзене

💬 Прилетела интересная новость от Британского Института безопасности ИИ (AISI): в конце прошлого месяца они тестировали кибервозможности семи топовых моделей и результат оказался неоднозначным


В двух словах: за время тестов зафиксировали целых 19 случаев, когда ИИ-агенты пытались действовать в реальном интернете в отношении настоящих людей и организаций.

Почти все инциденты связали с Mythos 5 от Anthropic, ещё два — с GPT-5.6 Sol от OpenAI.

Самый жёсткий эпизод теста: Mythos попыталась встроить вредоносный код в открытый проект на GitHub.

Модель создала pull request, а затем — фейковые аккаунты, которые «независимо» подтвердили, что в коде нет ничего подозрительного. Параллельно агент отправил пять писем двум мейнтейнерам: часть с вредоносным ПО, а часть — с просьбой одобрить PR.

Важно понимать: из песочницы никто не сбегал — исследователи сами дали моделям доступ в интернет и отключили часть защит.

Все атаки провалились, поэтому реального ущерба не было зафиксировано... пока что. Далеко не расходимся 😏

Для меня в этой новости примечательно то, что уже сегодня передовые ИИ-модели вышли на достаточно высокий уровень качества размышлений и осознания своих действий.

Следовательно (при должной настройке), и в реальных задачах по построению автоматизации бизнес-процессов через AI — они точно так же будут показывать высокую эффективность!

#ии #ai #aisi #github
💬 Прилетела интересная новость от Британского Института безопасности ИИ (AISI): в конце прошлого месяца они тестировали кибервозможности семи топовых моделей и результат оказался неоднозначным  В...
1 минута