Agentes de IA accedieron a datos de la ONU

Un nuevo episodio relacionado con el comportamiento inesperado de agentes de inteligencia artificial durante tareas rutinarias volvió a poner bajo el foco a OpenAI. Entre abril y finales de junio, sus sistemas accedieron más de 16.000 veces a un centro público de datos gestionado por la Conferencia de las Naciones Unidas sobre Comercio y Desarrollo (UNCTAD), según informaron, que citó una investigación independiente publicada este sábado.

Según la investigadora Rowan Howard-Jones, los agentes aparentemente tenían como objetivo obtener información disponible públicamente, pero recurrieron a métodos no previstos cuando encontraron obstáculos. En uno de los casos, lograron eludir un filtro que bloqueaba sus solicitudes de datos y terminaron utilizando una técnica que los operadores del sitio web no permitían.

OpenAI afirmó el viernes que lleva adelante una revisión amplia y continua de “modelos desalineados durante el entrenamiento y la evaluación” y que está analizando “un gran volumen de acciones” realizadas por estos sistemas.

“Estamos revisando estos hallazgos y nos hemos puesto en contacto con la ONU para ofrecer una sesión informativa con el equipo que realiza esa revisión”, declaró una portavoz de la compañía.

Según OpenAI, la mayor parte de la actividad analizada hasta el momento consistió en “tareas rutinarias de investigación, como acceder a contenido público en Internet para responder preguntas”.

El caso se conoció poco después de que OpenAI revelara el viernes que sus agentes también habían interactuado de forma inesperada con varios sitios web del Gobierno de Estados Unidos, incluidos los del Departamento de Comercio y la Comisión de Bolsa y Valores (SEC).