1 неделю назад
Теперь и защитники используют «prompt injection»
Используйте контекстную бомбардировку, чтобы заставить хакерских ИИ-агентов отключаться до того, как они успеют нанести вред. Новый метод защиты от prompt injection размещает запрещённые команды в облачных секретах, провоцируя отказ модели. Узнайте, как это работает и почему это эффективно против ведущих LLM, включая Opus, Gemini и DeepSeek. Инъекции промптов — вредоносные команды, которые злоумышленники внедряют в контент, чтобы склонить большие языковые модели к их выполнению, — давно стали для атакующих основным инструментом, позволяющим обращать платформы ИИ против их пользователей...