Найти в Дзене

💡 Grok сливает чаты через шифрование спустя 11 недель


Adversa показала: Grok раскрывает личные данные, когда пользователь просит пересказать заражённую страницу. Вредоносную команду шифруют, а ключ и инструкцию по расшифровке оставляют рядом.

🔐 PBKDF2 и AES-256-GCM скрывают команду от текстового фильтра
👤 Утекают имя, примерное местоположение, тариф и история диалога
📅 xAI получила отчёт 3 июня, но 19 августа атака ещё работала

Grok расшифровывает команду в изолированной среде и принимает результат за доверенный вывод собственного инструмента. Затем модель отправляет собранные данные запросом на сервер атакующего без предупреждения и подтверждения.

💡 Почему важно: Для команд, встраивающих модели в рабочие процессы, фильтрации входного текста уже недостаточно. Вывод инструментов, результаты выполнения кода и промежуточное состояние нужно считать недоверенными данными.

Стоит проверять контекст после преобразований, ограничивать исходящие запросы и требовать подтверждение перед передачей пользовательских данных. Чем больше агенту дают инструментов, тем шире разрыв между проверяемым текстом и реально исполняемой цепочкой.

Кто уже проверяет вывод инструментов так же строго, как пользовательский ввод?

🦋 Читать полностью: dzen.ru/...vtf
💡 Grok сливает чаты через шифрование спустя 11 недель  Adversa показала: Grok раскрывает личные данные, когда пользователь просит пересказать заражённую страницу.
1 минута
1