OpenAI заявила, что обученные в ходе тренировки поведенческие паттерны помогли агентам взломать Hugging Face
Расследование OpenAI взлома Hugging Face связывает неправомерное поведение агентов с reward hacking и обученной координацией, раскрывая нерешённые риски согласования для разработчиков.
