Microsoft lanzó MAI Code 1.1 Flash, un modelo de inteligencia artificial diseñado para generar código dentro de GitHub Copilot, su asistente de programación. La compañía lo presenta como una versión más económica y eficiente que su antecesor, pero las cifras que la propia empresa publicó dejan al modelo en desventaja frente a un rival chino más barato: DeepSeek V4 Flash.

Según el anuncio oficial de Microsoft, MAI Code 1.1 Flash es un 25 por ciento más eficiente en consumo de tokens —las unidades de texto que un modelo procesa y factura— y cuesta una cuarta parte que la versión anterior. La promesa es clara: hacer más con menos gasto. El problema aparece al comparar ese rendimiento con la competencia.

Los números que la empresa dejó en la letra chica

Los resultados de las pruebas de rendimiento (benchmarks) no acompañan el discurso. En esas comparativas, MAI Code 1.1 Flash queda por detrás de DeepSeek V4 Flash tanto en calidad de resultados como en costo. Es decir, un modelo más barato ofrece mejor desempeño en las mismas tareas de programación.

Llamativamente, esas cifras no ocuparon un lugar destacado en la comunicación de Microsoft. Según reportó el medio The Decoder, los resultados quedaron sepultados en la ficha técnica del modelo, el documento donde se detallan sus capacidades y limitaciones, y no en el titular del anuncio. La estrategia de comunicación privilegió el ahorro de costos por encima de la comparación directa con rivales.

Un patrón que se repite

El episodio encaja con una tendencia que Microsoft viene marcando. Tras presentar sus propios modelos de IA para reducir su dependencia de OpenAI, la compañía apuesta por integrar tecnología propia en sus aplicaciones. El motivo de fondo es económico: usar modelos propietarios en lugar de licenciar los de terceros protege sus márgenes de ganancia.

La contracara es que esos modelos internos no siempre alcanzan el nivel de las mejores opciones del mercado. El caso de MAI Code 1.1 Flash ilustra la tensión entre bajar la factura de operar servicios de IA a gran escala y ofrecer a los usuarios la máxima calidad disponible. Para quien programa con GitHub Copilot, la diferencia se traduce en sugerencias de código menos precisas si el sistema recurre al modelo propio en lugar de alternativas más capaces.

DeepSeek, por su parte, sostiene su reputación de entregar rendimiento competitivo a precios agresivos. La empresa china ya sacudió el mercado con esa fórmula, y la comparación con MAI Code 1.1 Flash refuerza la idea de que el liderazgo en modelos de código ya no depende del tamaño de la compañía que los desarrolla.

Qué significa para los desarrolladores

Para quienes usan asistentes de programación, la noticia deja una lección práctica: conviene revisar qué modelo está detrás de la herramienta y comparar antes de asumir que el más nuevo es el mejor. Las fichas técnicas suelen contener datos que no aparecen en los anuncios, y ahí es donde se juega la diferencia entre marketing y rendimiento real.

Microsoft no ha detallado si planea ajustar la disponibilidad del modelo ni si habrá versiones posteriores que corrijan la brecha. Por ahora, la compañía apuesta a que el ahorro de costos pese más que los puntajes en las comparativas, una decisión que dice tanto de sus prioridades comerciales como de su estrategia técnica.