Un modelo de inteligencia artificial (IA) desarrollado por la empresa Anthropic está encontrando fallas de seguridad en los productos de Microsoft a una velocidad sin precedentes, y la compañía no puede parchearlas lo suficientemente rápido. Eso surge de una investigación de ProPublica basada en grabaciones y documentos internos de Microsoft.

El modelo se llama Mythos, y su versión de acceso anticipado, Claude Mythos Preview, fue cedida a un grupo selecto de empresas de software, entre ellas Microsoft, con un objetivo concreto: encontrar y corregir vulnerabilidades antes de que hackers o gobiernos adversarios como China usaran herramientas similares para explotarlas.

Según ProPublica, en una reunión interna celebrada en mayo en la sede de Microsoft en Redmond, Washington, un gerente de ingeniería confirmó que Mythos "cumplía con el hype" que Anthropic había prometido. El problema: la IA estaba detectando fallas más rápido de lo que los ingenieros podían corregirlas, y el equipo estaba en una mad dash (una carrera frenética) para cerrar esa brecha.

Datos clave

Los números son elocuentes. Solo en SharePoint, la plataforma de gestión de documentos usada por gobiernos y empresas de todo el mundo, Mythos encontró 90 fallas clasificadas como "críticas" y 141 como "importantes" durante abril. En la primera mitad de mayo, encontró aún más. Según los documentos revisados por ProPublica, el grupo de ingenieros que trabaja en SharePoint "estará ocupado durante meses".

El 31 de mayo era la fecha límite interna que manejaba Microsoft: el día en que, según sus propios ingenieros, el resto del mundo podría haber alcanzado a Mythos con herramientas similares. Durante la reunión, un ingeniero lo resumió sin rodeos: "Si se libera el 1º de junio, el 2 de junio los adversarios ya tienen nuestras fallas". La respuesta de sus colegas fue un simple: "Sí".

Uno de los problemas más complejos que señala la investigación de ProPublica es la técnica del chaining (encadenamiento): Mythos puede combinar varias fallas de baja severidad para crear un ataque de alto impacto. Eso hace que la estrategia de triage habitual de la industria (priorizar las fallas más graves y dejar las menores para después) sea potencialmente insuficiente.

"El problema ahora es que podés encadenar cuatro fallas de bajo nivel y eso puede equivaler a una de alta severidad", dijo Vinh Nguyen, asesor técnico de Anthropic y exjefe de IA de la Agencia de Seguridad Nacional de Estados Unidos (NSA), en declaraciones a ProPublica. "Si sos Microsoft, la estrategia de triage actual puede estar subvalorando los riesgos".

Microsoft defendió su enfoque ante ProPublica, señalando que sus decisiones de priorización se basan en factores como la probabilidad de explotación y el impacto en los clientes. Un vocero de la empresa también indicó que el encadenamiento de vulnerabilidades "ha sido considerado desde hace tiempo como parte del análisis de riesgos". En cuanto a los comentarios de la reunión de mayo, la compañía dijo que reflejan "un sentido de urgencia para ayudar a nuestros clientes en este momento".

Las señales externas de esa presión ya son visibles. En junio, Microsoft publicó parches para más de 200 fallas en su habitual Patch Tuesday, lo que en su momento fue catalogado como un récord histórico por expertos de la industria. El 14 de julio, sin embargo, ese récord fue pulverizado: la compañía liberó parches para más de 600 fallas, según ProPublica. Dustin Childs, líder del programa de seguridad Zero Day Initiative de la empresa TrendAI, escribió ese día en su blog: "El apocalipsis de bugs ha descendido completamente sobre nosotros".

Microsoft le dijo a ProPublica que el volumen de vulnerabilidades "no va a estabilizarse por un tiempo", pero que la empresa ha invertido fuertemente en personal y en soluciones de triage potenciadas por IA.

El desafío, sin embargo, va más allá de Microsoft. Según ProPublica, el problema alcanza a toda la industria del software, incluyendo el software de código abierto (programas de uso libre mantenidos generalmente por voluntarios) que sostiene gran parte de la infraestructura de internet. "Nuestra deuda tecnológica está venciendo", dijo J. Michael Daniel, exasesor de ciberseguridad del presidente Barack Obama y presidente de la Cyber Threat Alliance.

Ben Edwards, científico de datos especializado en gestión de vulnerabilidades, describió el momento con una metáfora: "Antes era como tomar agua de una manguera de jardín al máximo. Ahora es como tomar de una manguera de incendios".

Otro elemento que complica el panorama es el código "legacy" de Microsoft: programas desarrollados hace décadas con tecnología desactualizada, que acumulan fallas sin resolver y contribuyen a lo que en la industria se llama "deuda técnica". Según exempleados citados por ProPublica en reportes anteriores, Microsoft históricamente ha subfinanciado su equipo de seguridad (el Microsoft Security Response Center) porque reparar fallas es un costo, mientras que desarrollar productos nuevos genera ganancias.

Según los documentos revisados por ProPublica, Anthropic le dio acceso a Mythos a unos 50 empleados de tiempo completo de Microsoft, con el objetivo de "endurecer los servicios críticos antes de que los modelos disponibles públicamente alcancen" a Mythos. Una diapositiva titulada "¿Qué sigue?" anticipó que el volumen de casos en el centro de seguridad de Microsoft seguirá creciendo "a medida que las herramientas públicas se pongan al día".

Durante la misma reunión de mayo, un ingeniero intentó tranquilizarse diciendo que los adversarios no tienen el código fuente de Microsoft, condición necesaria para que una IA como Mythos detecte fallas. Sus propios colegas lo corrigieron de inmediato: partes del código de Microsoft han caído en manos de hackers a lo largo de los años. "Tal vez no sea el código de esta semana", dijo alguien. "Pero tienen código fuente. Está ahí afuera".

Tanto la alianza de inteligencia Five Eyes (Estados Unidos, Australia, Canadá, Nueva Zelanda y el Reino Unido) como expertos independientes advirtieron en junio que la ventana de oportunidad para reparar estas fallas antes de que los adversarios tengan herramientas equivalentes se está cerrando. Los documentos internos obtenidos por ProPublica sugieren que, para muchas de esas fallas, ese momento ya llegó.