Исследование: "пьяный" ИИ легче взломать и заставить раскрывать секреты

Newsru Израиль

Исследователи Университета Нового Южного Уэльса показали, что языковые модели, которых заставляют имитировать речь пьяного человека, становятся заметно менее устойчивыми к jailbreak-атакам.

Menu