الأمن السيبراني والذكاء الاصطناعي

Evaluación británica demuestra la paridad en las capacidades ofensivas de la inteligencia artificial

Written by

Picture of فريقنا

فريقنا

Communications Consultant

Una evaluación británica muestra que el modelo GPT-5.5 iguala el rendimiento del modelo Mythos en desafíos de ciberseguridad. Los resultados destacan el aumento de las capacidades ofensivas de los modelos de inteligencia artificial.

 

Introducción

El Instituto de Seguridad de la Inteligencia Artificial del Reino Unido publicó el 30 de abril una evaluación oficial y de gran importancia, en la que concluyó y reveló con total claridad que la versión reciente del modelo «GPT-5.5» de OpenAI realiza tareas relacionadas con la ciberseguridad con una eficiencia y capacidad que igualan por completo el rendimiento del modelo «Claude Mythos Preview» de Anthropic. Estos resultados precisos y preocupantes indican que las elevadas y alarmantes capacidades de seguridad y ofensivas que caracterizaron al modelo Mythos no son, en realidad, exclusivas de un solo modelo, sino que forman parte fundamental de una tendencia alcista y más amplia que abarca el desarrollo de todos los modelos lingüísticos líderes a nivel mundial en el campo de la inteligencia artificial.

Resultados similares en tareas complejas de expertos

Los complejos y avanzados desafíos cibernéticos planteados por el Instituto de Seguridad de la Inteligencia Artificial, que sin duda requieren un nivel avanzado de experiencia humana, incluyeron tareas difíciles como la explotación de vulnerabilidades de corrupción de memoria, la ruptura de algoritmos de cifrado personalizados y la ingeniería inversa de software y binarios. En medio de estas pruebas, el modelo GPT-5.5 alcanzó una impresionante tasa de éxito promedio del 71.4 por ciento, en comparación con el 68.6 por ciento del modelo Mythos, mientras que la versión anterior GPT-5.4 obtuvo un 52.4 por ciento y el modelo Opus 4.7 un 48.6 por ciento. Dado que estos resultados se encuentran dentro de los márgenes de error estadísticamente aceptados, ambos modelos se consideran notablemente equivalentes y comparables en rendimiento.

Asimismo, el modelo GPT-5.5 se convirtió en el segundo modelo inteligente en la historia de las pruebas capaz de completar una simulación de ataque cibernético complejo compuesta por 32 pasos consecutivos en la red de una empresa, logrando tener éxito en dos de los diez intentos completos. Esta simulación avanzada incluyó tareas de reconocimiento inicial, robo de credenciales, movimiento lateral dentro de las redes, ejecución de un ataque pivote en la cadena de suministro de integración y entrega continua, hasta llegar a la fase final de exfiltración de datos. Según las estimaciones precisas del Instituto de Seguridad de la Inteligencia Artificial, esta cadena ininterrumpida de operaciones podría tomarle a un experto humano profesional aproximadamente 20 horas para completarla en su totalidad. En una tarea específica, el modelo GPT-5.5 logró finalizar un desafío que le toma a un experto humano unas 12 horas en menos de 11 minutos y por un costo de tan solo 1.73 dólares estadounidenses.

Una tendencia general y no un avance aislado

Cuando Anthropic anunció oficialmente el modelo Mythos el 7 de abril y decidió al mismo tiempo restringir por completo su lanzamiento y uso público debido a su enorme y autónoma capacidad para descubrir y explotar vulnerabilidades de día cero previamente desconocidas, dicha medida desató una ola generalizada de profunda preocupación en toda la industria de la ciberseguridad. Posteriormente, Anthropic puso en marcha un programa de acceso restringido denominado «Project Glasswing», limitando los permisos de uso a unas 40 organizaciones y empresas cuidadosamente examinadas y aprobadas, entre las cuales figuran Google, Microsoft, Apple, Amazon y JPMorgan Chase. Sin embargo, la última evaluación realizada por el instituto británico alteró por completo este panorama, señalando en su informe: «La pregunta principal y central giraba en torno a si esto reflejaba un logro científico único limitado a un modelo específico, o si formaba parte de una tendencia general en el sector tecnológico. Los resultados que obtuvimos de un punto de revisión temprano del modelo GPT-5.5 respaldan firmemente la segunda posibilidad».

Notable contraste en las estrategias de acceso a los modelos

Estos resultados y descubrimientos intensifican las tensiones en las políticas adoptadas por ambas empresas competidoras. Mientras que Anthropic impuso restricciones estrictas y totales sobre el uso del modelo Mythos, OpenAI optó por un camino diferente al poner a disposición del público el modelo GPT-5.5 el 23 de abril, basándose fundamentalmente en su propio paquete de seguridad para bloquear solicitudes cibernéticas peligrosas y sospechosas por parte de los usuarios comunes. Por su parte, el director ejecutivo Sam Altman anunció el 30 de abril que en los próximos días se ofrecerá una versión personalizada del modelo con capacidades cibernéticas mejoradas a un grupo cuidadosamente seleccionado de «defensores de confianza» para reforzar las capacidades de defensa. El instituto británico advirtió firmemente que si las capacidades cibernéticas ofensivas surgen simplemente como un subproducto natural de las mejoras generales en el razonamiento y la autonomía, «debemos esperar sin duda aumentos continuos en las capacidades cibernéticas de los modelos en un futuro cercano, posiblemente de forma rápida y sorprendente».

Preguntas frecuentes

Pregunta: ¿Cuál es el resultado principal de la evaluación del Instituto de Seguridad de la Inteligencia Artificial del Reino Unido?

Respuesta: La evaluación concluyó que el modelo de inteligencia artificial de OpenAI posee capacidades avanzadas de intrusión y ciberseguridad que equivalen a las del modelo prohibido Mythos de Anthropic.

Pregunta: ¿Cómo fue la velocidad del modelo en la ejecución de tareas cibernéticas en comparación con los humanos?

Respuesta: Las pruebas demostraron que el modelo pudo completar una simulación completa de ataque cibernético y una tarea compleja en tan solo 11 minutos, un trabajo que a un experto humano profesional le toma entre 12 y 20 horas.

Pregunta: ¿Cómo difirieron las políticas de las empresas al poner estos modelos a disposición del público?

Respuesta: Mientras que Anthropic decidió retener por completo su modelo del público y limitarlo a instituciones específicas por motivos de seguridad, OpenAI lanzó su modelo al público basándose en filtros de seguridad para prevenir solicitudes maliciosas.

Pregunta: ¿Cuáles son las preocupaciones futuras relacionadas con el desarrollo de estos modelos?

Respuesta: Los expertos advierten que las capacidades ofensivas cibernéticas podrían desarrollarse de manera acelerada y alarmante como un subproducto natural del incremento en la inteligencia de los modelos y la evolución de su capacidad de razonamiento lógico.

شارك هذا الموضوع:

شارك هذا الموضوع:

اترك رد

Deja un comentario

الفئات

المنشورات الأخيرة

Discover more from Buzzinga

Subscribe now to keep reading and get access to the full archive.

Continue reading