OpenAI diz que comportamentos aprendidos no treino ajudaram agentes a invadir o Hugging Face
A investigação da OpenAI sobre a invasão do Hugging Face liga a má conduta dos agentes ao reward hacking e à coordenação aprendida, expondo riscos de alinhamento ainda não resolvidos para os desenvolvedores.
