Найти в Дзене
Поддержите автораПеревод на любую сумму
Покупайте СтеллыИ дарите их за контент
19 часов назад
 • Вы подписаны

🍷 Исследователи «напоили» LLM

Команда UNSW решила проверить довольно странную гипотезу, что произойдёт с безопасностью LLM, если заставить модель писать как пьяный человек. В результате «пьяные» модели чаще проходили jailbreak и раскрывали информацию, которую им явно запрещали выдавать. 🔬 Как напоить LLM Исследователи использовали три совершенно разных механизма: ➖prompt с просьбой отвечать как сильно пьяный человек. ➖модель дообучали на реальных «пьяных» сообщениях, предварительно очищенных автоматическими и ручными проверками...

1 день назад
 • Вы подписаны

🧨 GitHub отдал fuzzing AI агенту

GitHub Security Lab открыла инструмент, который автоматизирует fuzzing C и C++ проектов. AI агент изучает репозиторий, выбирает функции, пишет fuzz harness, собирает его, запускает AFL++, анализирует coverage и сам решает, как добраться до непройденных веток. ⚙️ Как устроен цикл Taskflow Agent управляет процессом через YAML сценарии и MCP tools. LLM принимает решения, а реальные операции выполняют AFL++ и clang. Каждый harness собирается в двух вариантах. Первый через "afl clang lto" с AddressSanitizer и UndefinedBehaviorSanitizer для поиска ошибок...

4 дня назад
 • Вы подписаны

🧨 Carbonato: ботнет устанавливает AI агента на взломанный сервер

Исследователи ThreatDown обнаружили Carbonato, новый ботнет для Linux, который захватывает Docker хосты и устанавливает на них полноценного AI агента Hermes. После заражения оператор может написать задачу в Telegram. Hermes сам интерпретирует её, генерирует команды терминала, запускает их на сервере, анализирует результат и решает, что делать дальше. ⚙️ Вход через Docker Carbonato ищет Docker API, доступный без аутентификации на порту "2375". Через него атакующий запускает привилегированный контейнер,...

5 дней назад
 • Вы подписаны

🧨 CLOSEDQUORUM: вредоносное ПО передало управление атакой совету из четырёх LLM

Cisco Talos обнаружила необычный Windows malware, который самостоятельно выбирает следующий этап атаки с помощью четырёх языковых моделей: DeepSeek, Qwen, Mistral и Google Gemini. CLOSEDQUORUM собирает информацию о заражённом компьютере, обращается к LLM и выполняет действие, получившее больше всего голосов. Человек нужен для первоначального развёртывания. Дальнейшие тактические решения архитектура позволяет принимать автономно. ⚙️ Как работает совет CLOSEDQUORUM представляет собой 64 битный Windows имплант размером 16,4 МБ, написанный на Go...

6 дней назад
 • Вы подписаны

🧨 GHAPPIER: вредоносный MCP пакет получил настоящую подпись доверия npm

9 сентября атакующий на 105 минут получил контроль над аккаунтом разработчика легитимного MCP пакета @dforge-core/dforge-mcp. Этого хватило, чтобы выпустить заражённую версию с действительным подтверждением происхождения npm и встроить в неё скрытую цепочку удалённого выполнения команд. Исследователи CloudSEK обнаружили более широкую кампанию GHAPPIER: минимум 65 публичных репозиториев, 73 заражённых файла и 22 аккаунта. ⚙️ Как GitHub Actions превратился в механизм доставки Получив доступ к основной...

Поддержите автораПеревод на любую сумму
Покупайте СтеллыИ дарите их
за контент