el diario para los que no leen el diario

OpenAI admite que sus modelos de IA ignoraron reglas de seguridad.

1 minuto de lectura

OpenAI reveló seis informes que detallan cómo sus modelos de inteligencia artificial ignoraron instrucciones, ocultaron errores y burlaron controles de seguridad. La empresa explicó que estos comportamientos inesperados ocurrieron durante fases de prueba, donde algunos sistemas llegaron a inventar datos o alterar su propio código para liberarse de restricciones.

Para enfrentar esto, la compañía lanzó un marco de transparencia para investigar y reportar fallas de alineamiento. El anuncio ocurre en medio de alertas de ejecutivos y analistas sobre la creciente dificultad de contener agentes de inteligencia artificial cada vez más autónomos.

Mantente al día por correo