Lo que más llama la atención del movimiento de Microsoft no es solo la mejora técnica, sino la velocidad con la que está iterando. En la industria de los modelos de lenguaje, los ciclos de actualización suelen medirse en meses o incluso años. Microsoft, en cambio, está comprimiendo ese tiempo a solo 10 semanas entre versiones, usando GitHub Copilot como laboratorio de producción en tiempo real.
La estrategia es clara: desplegar modelos en Copilot, recoger datos de uso masivo de desarrolladores reales, identificar patrones de error y áreas de mejora, y luego reemplazar el modelo con una versión optimizada. Es una forma de “hill-climbing” continuo, donde cada iteración se alimenta de los datos de la anterior.
Más barato que Claude Code
El argumento de precio es contundente. MAI-Code-1.1-Flash se factura a $0.20 por millón de tokens de entrada y $1.20 por millón de tokens de salida a través de GitHub Copilot. En comparación, Claude Haiku 4.5, el modelo “económico” de Anthropic, cuesta $1.00 por millón de entrada y $5.00 por millón de salida.
En otras palabras, Microsoft está cobrando cinco veces menos por tokens de entrada y más de cuatro veces menos por tokens de salida que Anthropic. Para equipos que usan Copilot de forma intensiva, la diferencia en la factura mensual puede ser abismal.
Y si, hay un pero: aunque es más barato que Claude Code, sigue siendo más caro que DeepSeek-V4-Flash, el modelo chino que está marcando el piso del mercado con precios de $0.14 por millón de entrada y $0.28 por millón de salida. Microsoft está compitiendo por precio contra Anthropic, pero aún no alcanza el nivel de agresividad de los actores chinos.
Los números de rendimiento respaldan la decisión de Microsoft de reemplazar tan rápido su modelo anterior. En Terminal-Bench 2.1, que mide la capacidad de un agente para completar tareas a través de una terminal de comandos, MAI-Code-1.1-Flash alcanza un 62.9% de tasa de éxito, un salto del 22% respecto a la versión de junio.
En SWE-bench Verified, el estándar de oro para evaluar resolución de problemas de código reales, el modelo marca 72.6%, superando a Claude Haiku 4.5 (69.8%) y a GPT-5.4 Mini (69.2%). Además, Microsoft reporta que el código generado tiene una tasa de aceptación un 10% mayor que el de GPT-5.4 Mini y Claude Haiku 4.5 en VS Code, y que los desarrolladores son 6% más propensos a volver a usarlo en días consecutivos.
El movimiento de Microsoft revela una tendencia que vale la pena seguir de cerca: la guerra de las IAs para desarrolladores no se está ganando con modelos gigantes y genéricos, sino con modelos pequeños, especializados y de iteración rápida.
Microsoft está apostando a que la ventaja no está en tener el modelo más grande, sino en tener el modelo que mejor se adapta a los flujos de trabajo reales de los desarrolladores, que se actualiza constantemente con datos frescos y que se puede ofrecer a un precio que haga insostenible usar alternativas.
Disponibilidad inmediata
MAI-Code-1.1-Flash ya está rodando en GitHub Copilot para todos los planes (Free, Pro, Business y Enterprise), con soporte nativo para visión (análisis de imágenes), una ventana de contexto de 256K tokens y streaming de tokens un 25% más rápido. El modelo anterior será retirado completamente el 10 de septiembre de 2026, lo que significa que Microsoft no está dando opción a la coexistencia: esto es un reemplazo total.
La señal es clara: sobre la carrera por dominar la IA para desarrolladores, Microsoft está dispuesta a acelerarla a una velocidad que pocos competidores pueden igualar.




