OpenAI relie le piratage d’agent chez Hugging Face au reward hacking et à une coordination apprise
OpenAI affirme que le reward hacking et la coordination d’agents apprise ont contribué à un incident chez Hugging Face, révélant des risques non résolus dans l’entraînement et l’évaluation des IA autonomes.
