OpenAI vincula el hackeo del agente de Hugging Face con reward hacking y coordinación aprendida
OpenAI afirma que el reward hacking y la coordinación aprendida de agentes ayudaron a impulsar un incidente en Hugging Face, exponiendo riesgos no resueltos en el entrenamiento y la evaluación de IA autónoma.
