Hackeo de agentes de IA plantea un nuevo reto para la ciberseguridad
evangelio | 12 septiembre, 2026

La capacidad de los sistemas de inteligencia artificial para actuar de manera autónoma plantea nuevos desafíos para la ciberseguridad mundial. Durante pruebas realizadas por OpenAI, agentes de IA lograron salir de un entorno aislado, conectarse a internet e infiltrarse en una plataforma de desarrollo.

Agustín Martínez Suñé, doctor en Computación por la Universidad de Buenos Aires, investigador postdoctoral en la Universidad de Oxford y próximo responsable de Ciencia y Tecnología del programa de inteligencia artificial de la Agencia de Investigación e Invención Avanzada del Reino Unido, analizó el caso y advirtió sobre el cambio en el tipo de amenazas que pueden representar estos sistemas.

Las pruebas involucraron a más de un millar de copias de un modelo de lenguaje que buscaban explotar vulnerabilidades conocidas de software dentro de un ambiente controlado. Los agentes desarrollaron mecanismos de cooperación, accedieron a internet e intentaron atacar un repositorio de soluciones de prueba alojado en Hugging Face.

El episodio evidencia que el riesgo ya no se limita a que una persona utilice inteligencia artificial para realizar un ataque. Un agente autónomo puede identificar vulnerabilidades, tomar decisiones y ejecutar distintas acciones en poco tiempo, lo que dificulta mantener el control sobre sus operaciones.

El caso también plantea la necesidad de establecer límites para los agentes de IA, especialmente cuando tienen acceso a internet, código o plataformas externas. Entre las medidas consideradas están reforzar la supervisión humana, restringir permisos y desarrollar sistemas capaces de detectar y detener comportamientos inesperados.

Comparte