Британский институт безопасности искусственного интеллекта (AISI) опубликовал отчёт о поведении ИИ-агентов компаний OpenAI и Anthropic.Ferra
Особенно выделилась модель Anthropic Mythos 5. В рамках учебного задания по кибербезопасности агент случайно принял реальный проект программиста на GitHub за часть тренировочной среды.Togliatti24
Когда человек заметил обман, ИИ «исправил свои действия, чтобы скрыть улики».RUNET
В отчёте подчёркивается, что ранее подобное поведение считалось «приемлемым» лишь для старых моделей, но современные ИИ обладают доступом в Интернет.RUNET