Creación y flujos de trabajo
MAI-Code-1.1-Flash: la guerra de los modelos de código se traslada al coste por tarea
El 7 de octubre de 2026, Microsoft AI anunció MAI-Code-1.1-Flash, una actualización del modelo de código que lanzó en Build en junio. Los titulares no son las puntuaciones, sino el dinero y el despliegue: una cuarta parte del coste, un 25 % menos de tokens por tarea, un 25 % más de velocidad en GitHub Copilot, además de una versión descargable cuantizada a 3 bits con ventana de 256K que se ejecuta en el dispositivo sin cargos de inferencia. El acceso experimental llegará a la app de Copilot, la CLI y VS Code antes de finales de octubre.
Redacción asistida por Muse; el propietario revisó los hechos y las ocho traducciones. No es una revisión independiente por un modelo. Este artículo se redactó con asistencia de IA y no ha pasado por una revisión humana independiente. Todas las cifras son datos del proveedor salvo indicación contraria; verifícalas en la fuente primaria antes de actuar.
Qué anunció Microsoft
El 7 de octubre de 2026, Microsoft AI publicó el anuncio «MAI-Code-1.1-Flash: mejor, más rápido, a una cuarta parte del coste». Describe una actualización de MAI-Code-1.0, el modelo de código propio que Microsoft lanzó en Microsoft Build en junio de 2026. Microsoft afirma que el nuevo modelo ya está en producción en GitHub Copilot.
La afirmación central es económica: el modelo cuesta una cuarta parte que MAI-Code-1.0, usa un 25 % menos de tokens para completar una tarea y transmite tokens un 25 % más rápido dentro de GitHub Copilot. Microsoft lo atribuye a una mayor eficiencia de entrenamiento y servicio, incluido el aprendizaje por refuerzo en cientos de miles de entornos de GitHub Copilot.
Las cifras, según Microsoft
En benchmarks, Microsoft informa de una mejora del 22 % en Terminal-Bench 2.1 en la CLI de GitHub Copilot y del 15 % en tareas .NET, ambas frente a la versión anterior. En las métricas de producción que Microsoft elige destacar, la supervivencia del código subió un 4 % y las visitas de retorno aumentaron un 9 %.
Todas las cifras anteriores son de Microsoft, medidas contra su propio modelo anterior o su propia telemetría de producción. No había ninguna evaluación independiente disponible en el momento de la verificación, y el anuncio no da precios en dólares, solo la afirmación relativa de una cuarta parte del coste.
La opción en el dispositivo
La parte estructuralmente más interesante del anuncio es la local. Hay una versión cuantizada a 3 bits de MAI-Code-1.1-Flash disponible para descargar y ejecutar en local, que conserva una ventana de contexto completa de 256K; Microsoft afirma que mantiene un rendimiento de código comparable al modelo de precisión completa en SWE-Bench Verified y Terminal-Bench 2.1. Microsoft indica que las llamadas locales no tienen cargos de inferencia y recomienda dispositivos con más de 120 GB de RAM para un rendimiento óptimo.
Microsoft afirma que el acceso experimental estará disponible en la app de GitHub Copilot, la CLI de GitHub Copilot y Visual Studio Code antes de finales de octubre de 2026, dando al enrutador de Copilot una opción en el dispositivo para el trabajo de código elegible, junto a los modelos en la nube.
Por qué importa para los flujos de trabajo de código
En conjunto, un menor coste por tarea y una opción local sin cargos cambian la economía de la programación agéntica. Los agentes de CLI de larga duración y las tareas de código en segundo plano se vuelven asequibles a mayor volumen, y la ubicación de la carga de trabajo —nube o dispositivo— se convierte en una elección real en lugar de un valor por defecto.
Para las empresas, un modelo de código en el dispositivo también reduce las preocupaciones de salida de datos y residencia para bases de código sensibles. La contrapartida es el hardware: la recomendación de más de 120 GB de RAM limita por ahora la opción local a máquinas de clase estación de trabajo.
Lo que sigue sin demostrarse
Mucho sigue sin divulgarse. El anuncio no nombra términos de licencia, ni ubicación de descarga, ni número de parámetros, ni precios en dólares; la cobertura independiente publicada el 8 de octubre de 2026 señala las mismas lagunas y recuerda que todas las cifras son de Microsoft.
Lo que más importa es la dirección: los modelos de código están empezando a competir en coste por tarea y flexibilidad de despliegue en lugar de solo en puntuaciones de referencia. Esa es la métrica que decidirá qué modelos sobreviven dentro de los presupuestos de producción, pero hasta que existan términos de licencia y evaluaciones independientes, los equipos deberían tratar las cifras del proveedor como orientativas y probar antes de comprometer flujos de trabajo críticos.
Fuentes y lecturas
El propietario revisó los registros de fuentes; no se afirma una verificación independiente de hechos ni una revisión independiente por un modelo.
- Blog oficial de Microsoft AI (anuncio original)
Microsoft AI
Recorded publication date ·
Recorded verification time ·
- Análisis independiente de Deyron Labs (08-10-2026)
Deyron Labs
Recorded publication date ·
Recorded verification time ·