Grok 4.5 en Cursor: económico pero bloqueado en la UE
Desde esta semana está disponible en Cursor un nuevo modelo que cambia la cuestión de los costes en el día a día de la programación. Grok 4.5 de SpaceXAI, el proveedor anteriormente conocido como xAI, no presume del valor de benchmark más alto. Presume del consumo de tokens por tarea resuelta. El inconveniente para los equipos en la UE: al lanzamiento el modelo sigue bloqueado aquí.
Lo más importante en resumen
- Costes en lugar de récords. Según SpaceXAI, Grok 4.5 resuelve tareas en el benchmark SWE-Bench Pro con alrededor de 15.954 en lugar de 67.020 tokens de salida. Esto reduce la factura por tarea a aproximadamente un cuarto.
- Bloqueado en la UE. Al lanzamiento el modelo no es utilizable en la Unión Europea ni en los productos de SpaceXAI ni a través de la API. Se espera la disponibilidad para mediados de julio, falta una fecha concreta.
- Entrenado con Cursor. Grok 4.5 es el primer modelo que SpaceXAI ha entrenado conjuntamente con el editor Cursor. Allí se ejecuta desde el inicio como modelo First-Party.
Relacionado:Grok 4.5, GPT-5.6, Muse Spark: la semana del cambio de precios / Cursor Cloud-Agents: Codificar incluso cuando el portátil está apagado
Los costes por tarea superan a los récords
Trabajo todos los días con modelos de coding. La pregunta rara vez es cuál obtiene en el papel el valor más alto. Es cuál rinde lo suficiente para funcionar en el día a día, sin hacer estallar el presupuesto de inferencia. Exactamente aquí es donde se posiciona el nuevo modelo. SpaceXAI no pone en primer plano la tasa de acierto pura, sino el esfuerzo por tarea.
El proveedor proporciona la cifra clave. En SWE-Bench Pro, una prueba para cambios de software agénticos, Grok 4.5 consume por tarea alrededor de 15.954 tokens de salida. En Opus 4.8 son 67.020. Además indica que muchas tareas se completan en menos de la mitad de los pasos. Menos pasos significa menos estados intermedios que hay que revisar o revertir.
Para la operación esto se calcula directamente. Con precios de API de alrededor de 1,85 euros por millón de tokens de entrada y 5,55 euros por millón de tokens de salida, un cuarto del volumen de salida impacta notablemente en la factura mensual. El modelo funciona como Mixture-of-Experts con 500.000 tokens de contexto y según el proveedor alrededor de 80 tokens por segundo. En flujos agénticos que necesitan muchos pasos seguidos, este ritmo cuenta más que un punto de benchmark individual.
Por qué se entrenaron juntos Cursor y Grok
El contexto detrás del modelo explica mucho. SpaceXAI es la empresa que antes se llamaba xAI. SpaceX había adquirido xAI en febrero de 2026, incluyendo Grok y la plataforma X. El rebranding oficial siguió el 6 de julio. El dominio y la API siguen funcionando bajo x.ai.
A mediados de junio SpaceXAI anunció la adquisición de Cursor, el editor de código con IA de Anysphere. Según informes el valor se situó en alrededor de 55.000 millones de euros. Grok 4.5 es el primer modelo que bajo esta constelación se entrenó conjuntamente con Cursor. Desde el lanzamiento está disponible allí como modelo First-Party: para Tab-Completion, Inline-Edits, Chat y el Composer sobre múltiples archivos. En la primera semana hay un contingente doble. No es una conexión API posterior, sino soporte nativo en el editor.
Un detalle pertenece a la clasificación honesta. Cursor ha revelado por sí mismo que un snapshot anterior de su propia base de código terminó inadvertidamente en el entrenamiento. Por eso el valor de benchmark afectado se retiró de las gráficas públicas. El caso muestra dos cosas: los datos de entrenamiento de uso real del editor juegan un papel. Y tales fallos se documentan hoy, en lugar de quedarse bajo la mesa.
En Europa la puerta permanece cerrada por ahora
Aquí viene la parte que más pesa para los lectores de esta revista. Al lanzamiento Grok 4.5 está bloqueado en la Unión Europea. Ni a través de los productos de SpaceXAI ni a través de la API pueden acceder los desarrolladores en la UE. Fuera de la UE el modelo está listo para usar inmediatamente. La razón son las obligaciones de compliance del EU AI Act para modelos especialmente potentes.
Para los equipos en Alemania, Austria y Suiza eso significa esperar. La disponibilidad esperada está a mediados de julio. SpaceXAI no menciona una fecha vinculante, ni un motivo detallado. Quien quiera integrar firmemente el modelo en sus flujos de trabajo debe planificar este hueco o quedarse por ahora con otro modelo.
Esto es más que una nota al margen. Quien alinea sus flujos de trabajo con un modelo que en su propio espacio legal aún no está disponible asume un riesgo de disponibilidad. La mayoría de las organizaciones seguirán ejecutando otros modelos en paralelo y esperarán la disponibilidad antes de iniciar cambios mayores. Soberanía significa en este punto simplemente: no depender de una fecha de lanzamiento que no se conoce.
Qué dicen realmente los benchmarks
Las cifras sitúan al modelo en la parte alta, sin colocarlo en la cima. En Terminal-Bench Grok 4.5 está casi al nivel de los proveedores más fuertes. En SWE-Bench Pro queda por detrás de Opus 4.8. Al líder Fable no lo alcanza en ninguno de los dos tests.
| Benchmark | Grok 4.5 | Opus 4.8 | GPT-5.5 | Fable |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 83,3 | 78,9 | 83,4 | 84,3 |
| SWE-Bench Pro | 64,7 | 69,2 | 58,6 | 80,4 |
Tasa de éxito en porcentaje en benchmarks de codificación agénticos, Grok 4.5 destacado. Todos los valores según SpaceXAI.
Todas estas cifras son reportadas por el proveedor. Provienen de tests que SpaceXAI ha ejecutado o publicado. Sirven como orientación aproximada. No sustituyen una medición propia sobre el código relevante. Para la práctica, de todos modos, el consumo de tokens suele ser más significativo que la tasa de acierto pura. Un modelo que con una tasa de éxito similar genera notablemente menos output, cambia la estructura de costes a alto volumen más que unos puntos porcentuales adicionales.
Para quién vale ahora la pena el cambio
Cuatro preguntas ayudan en la decisión. Primero: ¿Se ejecuta de todos modos la mayor parte del trabajo diario en Cursor? Entonces el beneficio es mayor en cuanto llegue la disponibilidad en la UE, porque la integración First-Party y el entrenamiento conjunto reducen la fricción. Segundo: ¿Son los costes de tokens una partida real en el presupuesto? Entonces vale la pena contrastar las indicaciones de eficiencia con mediciones propias.
Tercero: ¿Está el equipo en la UE? Entonces el inicio previsto a mediados de julio pertenece firmemente a la planificación, no a la esperanza. Cuarto: ¿Ejecuta la organización de todos modos evaluaciones propias regularmente? Entonces Grok 4.5 pertenece a la lista tan pronto como el acceso esté disponible.
Quien con otro modelo fuerte logra hoy resultados estables y no tiene presión de costes aguda, no necesita precipitarse. La ventaja se muestra sobre todo a alto volumen y en tareas con muchos pasos de iteración. En Cursor el modelo está incluido a través de la suscripción existente como parte del pool First-Party. Esto desplaza el cálculo una vez más frente al uso puro de API.
- El consumo de output se reduce a alrededor de un cuarto y baja los costes operativos a alto volumen
- La integración nativa First-Party en Cursor ahorra esfuerzo de configuración para los equipos del editor
- El caso revelado de los datos de entrenamiento da una mirada honesta a la situación de los datos
- En la UE al lanzamiento bloqueado, falta una fecha de disponibilidad vinculante
- Todos los valores de eficiencia y benchmark son reportados por el proveedor, no verificados de forma independiente
- El comportamiento en proyectos internos complejos a lo largo del tiempo sigue sin estar claro
Preguntas frecuentes
¿Qué es Cursor?
Cursor es el editor de código con IA de Anysphere. Amplía una interfaz de editor familiar con completado de código, edición basada en chat y cambios agénticos a través de múltiples archivos. SpaceXAI adquirió la empresa a mediados de junio de 2026. Grok 4.5 se ejecuta allí desde el lanzamiento como modelo First-Party.
¿Por qué no está disponible Grok 4.5 en la UE?
SpaceXAI ha bloqueado Grok 4.5 al lanzamiento en la UE. La razón son los requisitos de compliance del EU AI Act para modelos especialmente potentes. Se espera una disponibilidad para mediados de julio de 2026. El proveedor no ha indicado una fecha fija.
¿Qué significa token-eficiente en concreto?
Significa que el modelo genera notablemente menos tokens de salida para tareas comparables. En SWE-Bench Pro son según SpaceXAI alrededor de 15.954 tokens por tarea en lugar de 67.020 en Opus 4.8. Esto corresponde aproximadamente a un cuarto del consumo y a cadenas de procesamiento más cortas. Menos tokens significan costes más bajos por tarea resuelta.
¿Cuándo llega Grok 4.5 a la UE?
Se espera la disponibilidad para mediados de julio de 2026. No existe una fecha de lanzamiento fija. Los equipos en Alemania, Austria y Suiza deben recurrir a otros modelos hasta entonces.
Recomendaciones de lectura de la redacción
- Claude Code supera a Copilot en el flujo de trabajo en equipo
- Casi a nivel de élite, más económico y entrenado en tres continentes
- La conexión de IA se vuelve lista para enterprise: El Model Context Protocol bajo la Linux Foundation
Más del MBF Media Netzwerk
Más de la red MBF Media
MyBusinessFutureDinero dejado de lado: lo que revela un chequeo de IADigital ChiefsCómo utilizan realmente los decisores la IA en 2026SecurityTodayEl AI Act es en realidad una ley de seguridadFuente imagen de portada: generada por IA (julio 2026)

