Cómo la percepción del proyecto supera a la antrópica a la mitad del costo: dentro de la nueva IA de ciberseguridad de Microsoft

22

Microsoft lanzó una bomba el lunes. Afirman que su nuevo modelo de ciberseguridad de IA, MAI-Cyber-1-Fast, destruye la competencia. Y cuesta la mitad del precio de las soluciones existentes.

Esto no es sólo una tontería de marketing. Cuando se combina con el sistema de seguridad agente MDASH y GPT-5.4 de OpenAI, la pila supera a Claude Mythos 5 de Anthropic. ¿La diferencia de puntuación? Unos sólidos 12 puntos.

El discurso de Microsoft es simple pero brutal: utilizar la IA para defenderse de la IA. Están entrando en la carrera armamentista con una combinación de armas. Se llama Percepción del Proyecto.

Victorias en los puntos de referencia: Project Perception vs. Claude Mythos 5

Los números están publicados para que todos los vean. En el punto de referencia CyberGym, la pila de Microsoft alcanzó el 96%. Mythos 5 de Anthropic quedó rezagado en un 84%.

Esa diferencia de 12 puntos importa en un juego donde los márgenes son estrechos.

“MAI-Cyber-1-1-1 maneja alrededor del 90% de las consultas. Detecta vulnerabilidades. Las parchea. Las envía. Prueba la solución. Luego difiere el 10% a GPT-5.4”.

Mustafa Suleyman, director ejecutivo de Microsoft AI, lo dejó claro durante una sesión informativa. El traspaso es perfecto. MAI-Cyber-1 hace el trabajo pesado. Es rápido. Es eficiente. Luego, GPT-5.4 se hace cargo de los casos complejos. Es diez veces más grande. Resuelve lo que el modelo más pequeño no puede.

¿Juntos? Mejor rendimiento. Menor costo.

Precios: Explicación de las unidades informáticas de seguridad (SCU)

¿Cómo se paga por esto? Basado en el consumo.

Microsoft utiliza una métrica llamada Unidades de cómputo de seguridad (SCU). Cada escenario de agente de IA consume SCU. Más trabajo equivale a más facturas. Simple.

Pero aquí está el giro. Microsoft afirma ahorrar cerca del 50% de costos en comparación con la configuración MDASH actual. Si gasta dinero en agentes de seguridad heredados, esta nueva pila es una alternativa más económica que en realidad funciona mejor.

¿Por qué cuesta menos? Eficiencia. Al descargar el 90 % de las consultas rutinarias a un modelo más pequeño y especializado (MAI-Cyber-1 ), no está quemando tokens costosos en tareas sencillas. Reservas el gran poder GPT-5.4 para las amenazas reales.

¿Cuándo se lanza Project Perception?

La vista previa pública comienza el 3 de agosto. Está integrado directamente en Microsoft Defender.

Se lanza con MDASH, que se lanzó en mayo. A partir de ahí, Microsoft lo implementará lentamente en todos los productos de seguridad. Esta no es una prueba beta en el vacío. Está entrando en los entornos de producción de las empresas a nivel mundial.

Por qué Microsoft cree que ganan

Suleyman señaló la historia. Microsoft ha administrado datos gubernamentales y empresariales durante décadas.

“Son esos datos combinados con la experiencia… lo que hemos podido impulsar este modelo combinado”, dijo Suleyman.

No empiezan de cero. Han acumulado una cantidad fenomenal de datos. Expertos en ciberseguridad de talla mundial construyeron los modelos. Anthropic, por el contrario, enfrentó una reacción violenta. Su lanzamiento de Claude Fable 5 el mes pasado fue cancelado. ¿Por qué? El gobierno de Estados Unidos dijo que el modelo podría “eliminar” los límites. Era tan potente que podría “romper Internet”.

Microsoft está evitando ese lío. Están jugando más seguro. Más lento. Más controlado.

Mythos 5 de Anthropic se lanzó inicialmente solo para agencias seleccionadas y profesionales de la tecnología. Ahora Microsoft está abriendo las compuertas.

“En conjunto… lo hacen al 50% del costo”.

Suleyman calificó el resultado de CyberGym como “bastante notable”.

¿Notable o simplemente esperado? Dado el foso de recursos y datos de Microsoft, tal vez no sea sorprendente. Pero la industria estará observando. ¿Cuántas empresas cambiarán? ¿Podrá Anthropic retomar la corona?

La respuesta aún no está clara. La tecnología está ahí. El precio es correcto. ¿Pero confianza? Eso lleva más tiempo que un ciclo de parche.