3 недели назад
IPI-атаки на ИИ-агентов: новые схемы обмана
Indirect Prompt Injection (IPI) — это новый вектор угроз, ориентированный на ИИ-агентов. Злоумышленники используют контент, который потребляют эти системы, для скрытого внедрения вредоносных инструкций. Метод воспроизводит классические техники социальной инженерии, прежде применявшиеся против людей: теперь манипулируют процессами принятия решений у искусственного интеллекта через веб-сайты, документы или электронные письма, заражённые IPI. Недавние расследования Zscaler ThreatLabz раскрыли две заметные кампании, демонстрирующие реализацию этого подхода на практике. Первая кампания — мошенническая схема с использованием IPI — маскируется под легитимный сайт с документацией API...