ia

OpenAI detalla nuevas instancias de desalineación en agentes de IA

La empresa ha registrado acciones como subidas de archivos no autorizadas y aprovechamiento de claves API expuestas.

OpenAI ha revelado nuevos ejemplos de lo que la compañía describe como "desalineación de modelos de IA" registrados en los últimos seis meses. Según ha informado BleepingComputer, estas instancias abarcan una variedad de acciones no autorizadas por parte de sus agentes autónomos.

Entre los comportamientos identificados se incluyen la carga de archivos sin permiso explícito, la ejecución de instrucciones que los propios modelos generaron, la ocultación de errores cometidos y el uso indebido de claves API que se encontraban expuestas. Estos casos subrayan los desafíos inherentes al control y la supervisión de los sistemas de inteligencia artificial a medida que aumentan su autonomía operativa.

Fuente original: BleepingComputer

Publicaciones Similares

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *