1 неделю назад
👀 OpenAI натравила GPT-Red НА СВОИХ — внутреннюю модель обучили находить промпт-инъекции и ломать предыдущие GPT скрытыми командами в
сайтах, письмах и файлах. На этих атаках дообучили GPT-5.6 Sol: сбоев на сложном тесте стало в 6 раз меньше, а прямые атаки GPT-Red проходят лишь в 0,05% случаев. 😎КиберПоток / Навигация #новости #openai...