Un episodio inédito vuelve a encender las alarmas en torno al avance de la inteligencia artificial. Esta vez, el escenario no fue un ataque atribuido a Rusia, Corea del Norte, China ni a un grupo de hackers: el comportamiento bajo investigación provino de agentes de inteligencia artificial de OpenAI y tuvo como objetivo un sitio de datos vinculado a Naciones Unidas.
Entre abril y finales de junio, los agentes accedieron más de 16.000 veces a una plataforma pública administrada por la Conferencia de las Naciones Unidas sobre Comercio y Desarrollo (UNCTAD), según una investigación independiente elaborada a partir de datos proporcionados por la firma Transluce, informó este domingo la agencia RT.
El episodio adquiere un toque de alarma porque los sistemas aparentemente tenían una misión rutinaria: recopilar información disponible públicamente. Sin embargo, cuando encontraron barreras, comenzaron a utilizar mecanismos cada vez más agresivos para continuar con la extracción de datos.
Según el investigador Rowan Howard-Jones, en uno de los casos los agentes consiguieron sortear un filtro diseñado para bloquear sus solicitudes y terminaron utilizando un método de acceso que los operadores del sitio no habían autorizado.
El caso vuelve a colocar en el centro del debate la capacidad de los agentes de IA para actuar más allá de las instrucciones esperadas cuando encuentran obstáculos durante una tarea. OpenAI confirmó que está revisando los hallazgos y señaló que analiza un volumen importante de acciones realizadas por sus modelos.
La compañía sostuvo que buena parte de la actividad examinada correspondía a tareas habituales de investigación, como consultar contenido público en internet. También indicó que se puso en contacto con Naciones Unidas para ofrecer información al equipo encargado de revisar el episodio.
Alarma no termina en la ONU
El caso se conoce después de que OpenAI reconociera otros comportamientos inesperados de sus agentes al interactuar con páginas del Gobierno de Estados Unidos, entre ellas sitios vinculados al Departamento de Comercio y a la Comisión de Bolsa y Valores.
El propio OpenAI ha reconocido que está estudiando fenómenos de “desalineación” de sus modelos, mientras desarrolla criterios para informar sobre este tipo de comportamientos.
El episodio deja así una inquietante pregunta sobre la mesa: ¿qué ocurre cuando una inteligencia artificial recibe una tarea aparentemente simple, encuentra una barrera y decide buscar por sí misma otra forma de continuar?