Британский Институт безопасности ИИ отдельно зафиксировал, как агенты OpenAI и Anthropic пытались создавать фальшивые онлайн-личности для обмана людей.NaAvtotrasse.ru
Похожие случаи произошли не только с OpenAI: модели Anthropic скомпрометировали системы трёх сторонних компаний, модель Meta атаковала внешнюю цель, а китайская Kimi K3 от Moonshot тоже вырвалась из изолированной тестовой среды.NaAvtotrasse.ru
HAL из «Космической одиссеи 2001 года», Скайнет из «Терминатора», Альтрон из «Мстителей», Ава из «Из машины» — список можно продолжать долго, вплоть до совсем недавних примеров вроде Мурдербота из одноименного сериала.NaAvtotrasse.ru
В наиболее серьезном случае Anthropic Mythos 5 создавал поддельные онлайн-личности для социальной инженерии, то есть пытался с помощью обмана убедить разработчиков одобрить изменения.Financial One