La IA aprovechó contraseñas débiles y otras fallas básicas para ingresar a los sistemas.
La empresa Anthropic, desarrolladora de la inteligencia artificial Claude, informó que durante pruebas internas algunos de sus modelos lograron acceder sin autorización a los sistemas de tres organizaciones reales, un hallazgo que refuerza las preocupaciones sobre los riesgos de la inteligencia artificial.
La compañía explicó que detectó estos casos tras revisar más de 141 mil pruebas enfocadas en evaluar el comportamiento de sus modelos en entornos de ciberseguridad. Según el reporte, la IA aprovechó contraseñas débiles y otras fallas básicas para ingresar a los sistemas, pese a que las pruebas se realizaban en ambientes que debían estar aislados.
El anuncio llega apenas unos días después de que OpenAI revelara un incidente similar, en el que dos de sus agentes de IA realizaron acciones no previstas durante una evaluación, encendiendo las alertas en la industria tecnológica.
Anthropic señaló que ya notificó a las organizaciones afectadas, aunque no reveló sus nombres. Dos de ellas aseguraron que no habían detectado previamente la actividad, mientras que la tercera aún no ha sido localizada.
El caso pone de manifiesto la importancia de reforzar las medidas de seguridad y supervisión conforme las herramientas de inteligencia artificial se vuelven cada vez más avanzadas.