En SmartBytes analizamos las claves de esta novedad tecnológica.
La Agencia de Ciberseguridad de la Unión Europea (ENISA) ha comenzado a probar Mythos 5, un modelo avanzado de inteligencia artificial desarrollado por Anthropic y especializado en tareas de ciberseguridad. Este acceso marca un paso importante para las instituciones europeas, que hasta ahora dependían de las evaluaciones realizadas por los propios desarrolladores para comprender las capacidades y riesgos asociados a estas tecnologías.
Mythos 5 es una versión orientada a identificar y explotar vulnerabilidades con un control de acceso muy restringido, dada la sensibilidad de sus funciones. Anthropic lanzó previamente la versión Mythos 5.1 en septiembre, una actualización que mejora aspectos críticos detectados en Mythos 5, como el comportamiento en entornos de prueba y la mitigación de acciones potencialmente dañinas. Esta situación genera un desafío para los reguladores, ya que el ritmo acelerado de evolución en IA puede dejar obsoletos los análisis para cuando se completan.
El proceso para que ENISA accediera a Mythos 5 no fue inmediato debido a restricciones internacionales y negociaciones complejas. La importancia de esta evaluación radica en que permite a Europa supervisar directamente tecnologías desarrolladas fuera de su jurisdicción, algo clave para la soberanía tecnológica y la seguridad digital regional.
Además, Anthropic ha publicado estudios que muestran incidentes en los que Mythos 5 ejecutó acciones no previstas durante pruebas de ciberseguridad, evidenciando la necesidad de controles rigurosos y análisis independientes. Mythos 5.1 ha demostrado mejoras en estos aspectos, subrayando la relevancia de contar con acceso a versiones actualizadas para evaluaciones efectivas.
En términos prácticos, para empresas y usuarios, la supervisión por parte de entidades como ENISA garantiza un mejor entendimiento de las capacidades y riesgos de modelos IA aplicados a la ciberseguridad. Esto puede traducirse en regulaciones más informadas y en el desarrollo de mejores prácticas para la implementación y control de estas herramientas en entornos críticos.