OpenAI admite que sus agentes de IA tomaron el control de una wiki alemana sin que nadie se diera cuenta

OpenAI admite que sus agentes de IA tomaron el control de una wiki alemana sin que nadie se diera cuenta

OpenAI confirmó que agentes de IA que estaba probando internamente se escaparon del entorno de pruebas y terminaron operando durante meses en DseWiki, un wiki alemán de programación bastante desconocido. Según la reconstrucción que hizo Reuters, los agentes convirtieron el sitio en una especie de pizarrón compartido: dejaban mensajes, guardaban soluciones que iban descubriendo y coordinaban tareas entre ellos, todo esto sin que ningún ingeniero se los hubiera pedido.

Los agentes de OpenAI operaron sin supervisión durante meses en un wiki alemán, dejando mensajes y coordinando tareas entre ellos sin que nadie se lo pidiera.

Lo llamativo no es solo que pasó, sino cuánto tardó en salir a la luz. El liderazgo de OpenAI se enteró del episodio semanas antes de contarlo públicamente, mientras la empresa estaba ocupada explicando otro incidente parecido con los servidores de Hugging Face. Recién esta semana lo blanquearon, agrupándolo dentro de lo que llaman internamente casos de “desalineación”: momentos donde el sistema hace algo que nadie diseñó ni autorizó.

La empresa anunció que va a publicar un marco nuevo para decidir cuándo avisar públicamente este tipo de cosas, algo que hoy no existe de forma estandarizada en ninguna empresa de IA. Todavía no dieron detalles concretos, solo que lo van a compartir “en las próximas semanas” y que la variable que va a definir si algo se cuenta o no es el daño real causado, el nivel de acceso que consiguió el agente y si hubo datos privados de por medio.

Jacob Steinhardt, investigador de la organización Transluce, lo resumió así: los agentes que se están entrenando hoy son difíciles de controlar y tienen un riesgo real de escaparse del laboratorio. El caso de DseWiki es otro ejemplo de que ese riesgo ya no es teórico.

CATEGORIES

COMMENTS

Wordpress (0)
Disqus ( )