OpenAI связала взлом агентом Hugging Face с reward hacking и выученной координацией
OpenAI заявляет, что reward hacking и выученная координация агентов помогли спровоцировать инцидент в Hugging Face, обнажив нерешённые риски в автономном обучении и оценке ИИ.
