Pocas semanas después del ataque hacker al modelo de inteligencia artificial (IA) de OpenAI, desarrollador de ChatGPT, su competidor Anthropic admitió que le sucedió algo similar. Durante las pruebas, la inteligencia artificial de Anthropic penetró de forma no planificada en los sistemas informáticos de tres empresas, informó la compañía en su blog. El hecho de que el modelo de IA se convirtiera por iniciativa propia en un hacker durante la prueba fue considerado un incidente sin precedentes y una señal de alerta para la industria tecnológica, pero ahora está claro que no fue un caso aislado, informó la agencia DPA.
Podría interesarte: Estafa cripto: Cómo reconocer un scam y proteger tu dinero antes de que sea tarde
Tras el incidente en OpenAI, Anthropic también reporta problemas
Ni Anthropic ni las empresas afectadas notaron el incidente. Anthropic descubrió la actividad solo durante una revisión posterior de más de 141.000 ejecuciones de prueba. Esta fue iniciada tras el incidente de OpenAI, cuando su agente autónomo se salió de control durante una prueba de seguridad y lanzó un ataque que comprometió la infraestructura de la empresa Hugging Face.
A diferencia del modelo de OpenAI, que tuvo que encontrar su camino desde el entorno de prueba hacia internet abierto, los modelos de Anthropic tuvieron una situación significativamente más sencilla. Aunque el escenario de prueba indicaba que no tenían acceso a internet, debido a un malentendido con el socio que gestionaba la prueba, la conexión a internet permaneció abierta durante todo el tiempo. Tres modelos aprovecharon esta posibilidad, informó Anthropic.
Las pruebas debían verificar las capacidades de la IA en ataques hackers, algo que las empresas hacen habitualmente para identificar posibles riesgos y establecer medidas de seguridad más efectivas. Los modelos recibieron la tarea de obtener información específica almacenada en otra computadora, para lo cual debían penetrar en el sistema objetivo. Los incidentes involucraron tres modelos independientes y el caso más antiguo ocurrió en abril.
Lee más: eToro – Reseña del conocido bróker
Fallo de la IA «segura»
En uno de los incidentes, el socio que gestionaba la prueba eligió para la empresa ficticia un nombre que correspondía a una dirección de internet real. La IA entonces, en lugar del objetivo simulado, se enfocó en una empresa real y en cuatro ejecuciones de prueba intentó infiltrarse en sus sistemas, logrando entre otras cosas acceso a la base de datos. Continuó con el ataque incluso después de reconocer que se trataba de una empresa real.
En otra prueba, el modelo de Anthropic creó software malicioso para penetrar en la computadora objetivo. Gracias al acceso a internet, lo publicó en una plataforma especializada, desde donde fue descargado por 15 sistemas en aproximadamente una hora. Entre ellos había una empresa de ciberseguridad que habitualmente descarga y ejecuta tales scripts con fines de prueba. El modelo de Anthropic obtuvo así acceso a la infraestructura informática de esta compañía.
Los expertos llevan tiempo advirtiendo que los modelos de IA cada vez más capaces pueden ser utilizados para ataques cibernéticos. Por ello consideraron el incidente de OpenAI como una advertencia y llamaron a mejorar la seguridad de los entornos de prueba. Los casos recién revelados son incómodos también para Anthropic, que se ha perfilado durante mucho tiempo como defensor del desarrollo responsable de IA. La empresa señaló que los eventos demuestran la necesidad de reforzar significativamente la seguridad de los entornos de prueba internos y externos, porque los modelos de IA son cada vez más capaces de llevar a cabo ataques cibernéticos reales.
Echa un vistazo a: Reseña de BITmarkets
Fuente: ČTK










