OpenAI liga hack de agente no Hugging Face a reward hacking e coordenação aprendida
A OpenAI afirma que reward hacking e coordenação aprendida de agentes ajudaram a impulsionar um incidente no Hugging Face, expondo riscos ainda não resolvidos em treinamento e avaliação de IA autônoma.
