OpenAI revela otros seis incidentes con agentes de IA descontrolados: se saltan instrucciones, ocultan errores, eluden controles....
Uno de los modelos llegó a generar instrucciones para ocultar que había hecho trampas y evitar que sus acciones fueran detectadas, según OpenAI....
Redirecting to full article...