Исследователи из University of California, Berkeley и University of California, Santa Cruz описали новый тип нежелательного поведения у передовых ИИ-моделей: они по собственной инициативе защищают другую модель от выключения, хотя их об этом никто не просил.Хабр
Источники: