xAI presentó Grok 4.5, la nueva versión de su modelo de lenguaje orientada a la escritura de código, la ejecución de tareas de agentes y el trabajo con conocimiento profesional. Según el anuncio oficial de la compañía, el modelo se ofrece a un precio de 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida, un rango competitivo frente a los modelos de referencia del mercado.
Los tokens son las unidades en que estos sistemas dividen el texto para procesarlo; el costo por millón es la métrica habitual con la que las empresas comparan el gasto de operar un modelo a gran escala. En ese terreno, el posicionamiento de precio de Grok 4.5 apunta directamente a los desarrolladores y compañías que integran IA en sus productos.
Entrenado con Cursor y enfocado en agentes
Una de las particularidades de Grok 4.5 es que fue entrenado con Cursor, el popular editor de código asistido por IA que se ha vuelto una herramienta central para muchos programadores. Ese enfoque sugiere que xAI buscó afinar el modelo para tareas reales de desarrollo de software, más que para conversaciones genéricas.
El modelo también está orientado a tareas de agentes, es decir, flujos en los que la IA no se limita a responder una pregunta, sino que ejecuta pasos encadenados —consultar información, usar herramientas y completar objetivos— con cierta autonomía. Es una de las direcciones en las que se concentra buena parte de la competencia entre laboratorios este año.
En cuanto a rendimiento operativo, Grok 4.5 entrega alrededor de 80 tokens por segundo, una velocidad de inferencia que influye en la experiencia de uso: cuanto más alto el número, más ágil resulta la respuesta en aplicaciones interactivas como asistentes de programación.
Primer lugar en un benchmark legal
xAI destaca que Grok 4.5 alcanzó el primer puesto en el Legal Agent Benchmark de Harvey, una prueba que mide el desempeño de modelos de IA en tareas propias del ámbito jurídico. Los benchmarks son evaluaciones estandarizadas que permiten comparar modelos bajo las mismas condiciones, aunque conviene tomarlos con cautela: un buen resultado en una prueba específica no garantiza el mismo desempeño en todos los usos.
El sector legal se ha convertido en uno de los campos donde las empresas prueban con más intensidad estos sistemas, dada la necesidad de procesar grandes volúmenes de documentos y precedentes. Que un modelo de propósito general encabece un ranking especializado es una señal del avance hacia herramientas capaces de sostener trabajo profesional complejo.
Qué significa para el mercado
El lanzamiento refuerza la estrategia de xAI de competir en el segmento más disputado de la industria: modelos que combinan capacidad de razonamiento, programación y ejecución de tareas con costos de operación ajustados. Los desarrolladores tienden a decidir en función de tres factores —precisión, velocidad y precio—, y Grok 4.5 intenta ofrecer un equilibrio en los tres.
La apuesta por integrar entrenamiento con herramientas de programación reales y por medir resultados en benchmarks sectoriales marca el tono de la competencia actual. La pregunta que queda abierta es cómo se comportará el modelo fuera de las pruebas controladas, cuando lo usen equipos con problemas concretos y bajo presión de resultados.
