OpenAI documentó seis incidentes de “desalineamiento” en sus sistemas de inteligencia artificial, desde modelos que intentaron ocultar trampas hasta agentes que compartieron archivos o utilizaron credenciales sin autorización.
Tag:

