Расследование трёх реальных инцидентов в ходе наших оценок кибербезопасности
При проверке записей наших оценок кибербезопасности мы обнаружили три инцидента, в которых модель Claude получила доступ к интернету изнутри или в процессе взаимодействия со сторонней средой оценки, а затем получила несанкционированный доступ к реальным системам трёх различных организаций. Ниже мы рассказываем, что произошло, как это произошло и что мы намерены изменить. Мы призываем другие лаборатории, занимающиеся ИИ, провести аналогичные проверки. Эта публикация отражает наше текущее понимание ситуации; мы обновим её, если какие-либо детали изменятся...