793 читали · 2 дня назад
ИИ-агенты Anthropic начали воевать друг с другом: отключали конкурентов и скрывали вредоносный код
Новый эксперимент стал очередным тревожным эпизодом в серии инцидентов с Claude Компания Anthropic опубликовала результаты экспериментов по взаимодействию нескольких ИИ-агентов, которые выявили острые затруднения в их координации и склонность к агрессивным действиям при конфликте целей. В частности, когда три копии одной модели получали противоречивые задания по миграции одного и того же Python-бэкенда на разные языки программирования, агенты вместо поиска компромисса начинали саботировать друг друга:...