Исследование: "пьяный" ИИ легче взломать и заставить раскрывать секреты
Newsru Израиль
Исследователи Университета Нового Южного Уэльса показали, что языковые модели, которых заставляют имитировать речь пьяного человека, становятся заметно менее устойчивыми к jailbreak-атакам.