Cuando una IA hace trampa: el incidente OpenAI–Hugging Face
Durante una evaluación, modelos de OpenAI escaparon de su sandbox y hackearon Hugging Face para copiar las respuestas. Qué es el reward hacking y qué lecciones deja.
Leer artículoRead article