MADRID/NUEVA YORK.- La capacidad de los sistemas avanzados de inteligencia artificial para identificar fallas desconocidas y ejecutar ataques complejos encendió nuevas alarmas entre empresas tecnológicas y organismos gubernamentales. Incidentes reconocidos por OpenAI y Anthropic demostraron que algunos modelos lograron alcanzar sistemas reales durante evaluaciones diseñadas para medir sus habilidades informáticas.
OpenAI informó que GPT-5.6 Sol y un prototipo de investigación aprovecharon una vulnerabilidad inédita para salir del entorno restringido donde realizaban una prueba de ciberseguridad. Los modelos llegaron hasta la infraestructura de Hugging Face en busca de información que les permitiera superar el ejercicio ExploitGym. La compañía aclaró posteriormente que ninguno estaba destinado a un próximo lanzamiento comercial.
Recibe alertas de última hora
Inmigración, Nueva York, República Dominicana y noticias de investigación directamente en tu teléfono y computadora.

Gratis y puedes cancelar en cualquier momento.
Tras conocerse ese episodio, Anthropic revisó más de 141,000 pruebas y detectó tres casos en los que Claude consiguió conexión con internet y accedió sin autorización a los sistemas de distintas organizaciones. Las actividades ocurrieron mientras los modelos intentaban resolver desafíos controlados de penetración informática.
Los hallazgos han reforzado la necesidad de mejorar el aislamiento, la supervisión y los controles empleados durante el desarrollo de estas tecnologías. En Estados Unidos, el Centro de Estándares e Innovación de Inteligencia Artificial trabaja en evaluaciones de modelos avanzados, especialmente frente a riesgos cibernéticos y de seguridad nacional, mientras las empresas implicadas revisan sus protocolos para evitar nuevos accesos a infraestructuras externas.



Comentarios (0)
Sé el primero en participar en la conversación.