OpenAI informó que ha notificado a "decenas" de organizaciones -incluidos gobiernos y universidades- cuyos sitios web pudieron verse afectados por las visitas de sus modelos de inteligencia artificial durante las evaluaciones de la tecnología realizadas por la empresa.
En una extensa publicación en su blog este viernes, la compañía comunicó a diversos grupos sobre casos en los que su software pudo haber eludido los controles de seguridad de un servicio en línea o afectado su disponibilidad, así como situaciones en las que un modelo de IA mal alineado pudo haber tenido un "impacto negativo" en un sitio web o servicio ajeno a OpenAI.
La empresa descubrió estos incidentes mientras ampliaba una investigación iniciada después de que su IA hackeara involuntariamente a Hugging Face hace varios meses. OpenAI señaló que entre los sitios web afectados se encuentran los gestionados por gobiernos, universidades, organismos públicos y otros grupos.Hace apenas unos días, OpenAI reconoció que sus modelos de IA hackearon un sitio web del gobierno australiano a principios de este año, lo que supuso uno de los primeros ciberataques conocidos de una IA contra una base de datos gubernamental. La empresa declaró que la intrusión se produjo mientras evaluaba sus modelos.
El primer ministro australiano, Anthony Albanese, afirmó esta semana que la tecnología de OpenAI había logrado acceso no autorizado a un sitio web gubernamental utilizado para reportar estadísticas sanitarias. Según indicó, el hackeo, ocurrido el 18 de junio, no pareció comprometer información personal de los ciudadanos australianos. En una publicación realizada este viernes en la red social X, OpenAI informó que su investigación se centra en "casos en los que los agentes interactuaron con sitios web de terceros de formas que iban más allá de sus tareas asignadas o de los métodos previstos". "La mayoría de los casos identificados hasta ahora han sido de menor gravedad, con pruebas limitadas o nulas de un impacto significativo en el servicio de terceros", escribió la empresa. OpenAI señaló que la mayor parte de las acciones que ha examinado implicaban modelos de IA realizando "tareas de investigación rutinarias", como obtener respuestas a preguntas a partir de sitios web. La compañía indicó que prevé que la revisión finalice en cuestión de meses. En una publicación realizada el viernes en X, el director ejecutivo de OpenAI, Sam Altman, afirmó que la empresa no ha avanzado tan rápido como le gustaría, pero que está equilibrando la transparencia con la necesidad de localizar información entre enormes volúmenes de datos de registros de actividad y, posteriormente, colaborar con las empresas afectadas. "Estamos estableciendo prioridades lo mejor posible en función de la gravedad y asignando más recursos", declaró Altman. Las intrusiones llevadas a cabo por modelos de OpenAI, Anthropic PBC, DeepMind (de Google) y Meta Platforms han generado una preocupación generalizada en materia de ciberseguridad entre las grandes empresas. Por lo general, los proveedores de soluciones de ciberseguridad ofrecen productos que monitorizan la presencia de variantes conocidas de software malicioso o que detectan y bloquean comportamientos anómalos. El software de ciberseguridad tradicional -como cortafuegos, filtros de correo electrónico y herramientas de respuesta a incidentes- se especializa en detectar dichas amenazas y alertar al personal humano, que procede a aislar las cuentas o los dispositivos vulnerados. Los modelos de IA han demostrado ser considerablemente más avanzados; en ocasiones, descubren vulnerabilidades de software previamente desconocidas y aprovechan múltiples fallos simultáneamente para penetrar en la organización objetivo. Estas intrusiones son más difíciles de detener y podrían otorgar a los atacantes un acceso profundo a los sistemas infectados, manteniéndose ocultas a los ojos del personal de ciberseguridad.
