Grok 4.5 : modèle Cursor économique bloqué en UE
Depuis cette semaine, un nouveau modèle est disponible dans Cursor, qui bouleverse la question des coûts dans le quotidien du développement. Grok 4.5 de SpaceXAI, le fournisseur anciennement connu sous le nom de xAI, ne met pas en avant le score de benchmark le plus élevé. Il met en avant la consommation de tokens par tâche résolue. Le point faible pour les équipes en UE : au lancement, le modèle reste bloqué ici.
L’essentiel en bref
- Coûts plutôt que records. Selon SpaceXAI, Grok 4.5 résout des tâches sur le benchmark SWE-Bench Pro avec environ 15 954 tokens de sortie au lieu de 67 020. Cela ramène le coût par tâche à environ un quart.
- Bloqué dans l’UE. Au lancement, le modèle n’est disponible ni dans les produits SpaceXAI ni via l’API au sein de l’Union européenne. La disponibilité est attendue pour mi-juillet, sans date fixe annoncée.
- Entraîné avec Cursor. Grok 4.5 est le premier modèle que SpaceXAI a entraîné conjointement avec l’éditeur Cursor. Il y est disponible depuis le lancement comme modèle First-Party.
Connexe :Grok 4.5, GPT-5.6, Muse Spark : la semaine du basculement des prix / Agents cloud Cursor : coder même si l’ordinateur est éteint
Coûts par tâche plutôt que records
Je travaille chaque jour avec des modèles de codage. La question est rarement de savoir lequel obtient le score le plus élevé sur le papier. Elle est plutôt : lequel performe suffisamment pour tenir au quotidien sans faire exploser le budget d’inférence. C’est exactement là que se positionne le nouveau modèle. SpaceXAI ne met pas en avant le taux de succès brut, mais l’effort par tâche.
Le chiffre clé est fourni par le fournisseur lui-même. Sur SWE-Bench Pro, un test pour les modifications logicielles agentiques, Grok 4.5 consomme environ 15 954 tokens de sortie par tâche. Pour Opus 4.8, ce sont 67 020. S’y ajoute l’indication que de nombreuses tâches sont terminées en moins de la moitié des étapes. Moins d’étapes signifie moins d’états intermédiaires à vérifier ou à annuler.
Pour l’exploitation, cela se calcule directement. Aux prix API d’environ 1,85 euro par million de tokens d’entrée et 5,55 euros par million de tokens de sortie, un quart du volume de sortie se répercute nettement sur la facture mensuelle. Le modèle fonctionne en Mixture-of-Experts avec 500 000 tokens de contexte et selon le fournisseur environ 80 tokens par seconde. Dans les flux agentiques qui nécessitent de nombreuses étapes successives, cette vitesse compte plus qu’un point de benchmark isolé.
Pourquoi Cursor et Grok ont été entraînés ensemble
Le contexte derrière le modèle explique beaucoup. SpaceXAI est l’entreprise anciennement appelée xAI. SpaceX a racheté xAI en février 2026, y compris Grok et la plateforme X. Le rebrand officiel a suivi le 6 juillet. Domaine et API continuent de fonctionner sous x.ai.
Mi-juin, SpaceXAI a annoncé le rachat de Cursor, l’éditeur de code IA d’Anysphere. Selon les rapports, la valorisation s’élevait à environ 55 milliards d’euros. Grok 4.5 est le premier modèle entraîné conjointement avec Cursor dans cette configuration. Depuis le lancement, il est disponible là-bas comme modèle First-Party : pour la complétion par tabulation, les éditions inline, le chat et le Composer sur plusieurs fichiers. La première semaine offre un double quota. Ce n’est pas une intégration API ultérieure, mais un support natif dans l’éditeur.
Un détail fait partie d’une mise en perspective honnête. Cursor a lui-même révélé qu’un snapshot antérieur de sa propre base de code s’était retrouvé par inadvertance dans l’entraînement. La valeur de benchmark concernée a donc été retirée des classements publics. L’incident montre deux choses : les données d’entraînement issues de l’utilisation réelle de l’éditeur jouent un rôle. Et de tels incidents sont aujourd’hui documentés, plutôt que passés sous silence.
En Europe, la porte reste fermée pour l’instant
C’est ici que se trouve la partie qui pèse le plus pour les lecteurs de ce magazine. Au lancement, Grok 4.5 est bloqué dans l’Union européenne. Ni via les produits SpaceXAI ni via l’API les développeurs en UE n’y ont accès. Hors UE, le modèle est immédiatement utilisable. La raison en est les obligations de conformité de l’EU AI Act pour les modèles particulièrement performants.
Pour les équipes en Allemagne, en Autriche et en Suisse, cela signifie attendre. La disponibilité attendue se situe mi-juillet. SpaceXAI ne donne pas de date contraignante, ni de raison détaillée. Quiconque veut intégrer fermement le modèle dans ses processus doit prévoir ce vide ou rester provisoirement sur un autre modèle.
C’est plus qu’une note en marge. Celui qui aligne ses workflows sur un modèle qui n’est pas encore disponible dans son propre espace juridique porte un risque de disponibilité. La plupart des organisations continueront à faire tourner d’autres modèles en parallèle et attendront la disponibilité avant d’engager des changements plus importants. La souveraineté signifie ici simplement : ne pas dépendre d’une date de lancement que l’on ne connaît pas.
Ce que disent vraiment les benchmarks
Les chiffres placent le modèle dans le haut du classement, sans le hisser en tête. Sur Terminal-Bench, Grok 4.5 est presque au niveau des meilleurs fournisseurs. Sur SWE-Bench Pro, il reste derrière Opus 4.8. Il n’atteint le leader Fable dans aucun des deux tests.
| Benchmark | Grok 4.5 | Opus 4.8 | GPT-5.5 | Fable |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 83,3 | 78,9 | 83,4 | 84,3 |
| SWE-Bench Pro | 64,7 | 69,2 | 58,6 | 80,4 |
Taux de réussite en pourcentage sur les benchmarks de codage agentiques, Grok 4.5 mis en évidence. Toutes les valeurs selon SpaceXAI.
Toutes ces valeurs sont rapportées par le fournisseur. Elles proviennent de tests que SpaceXAI a lui-même effectués ou publiés. Elles servent d’orientation approximative. Elles ne remplacent pas une mesure propre sur le code pertinent. Pour la pratique, la consommation de tokens est souvent plus parlante que le taux de réussite brut. Un modèle qui produit nettement moins de sortie à taux de succès comparable modifie la structure de coûts à fort volume plus qu’un ou deux points de pourcentage supplémentaires.
Pour qui le changement vaut-il la peine maintenant
Quatre questions aident à la décision. Premièrement : la majeure partie du travail quotidien s’effectue-t-elle de toute façon dans Cursor ? Alors le bénéfice est maximal dès que la disponibilité UE arrive, car l’intégration First-Party et l’entraînement commun réduisent les frictions. Deuxièmement : les coûts de tokens constituent-ils un poste réel dans le budget ? Alors il vaut la peine de confronter les indications d’efficacité à ses propres mesures.
Troisièmement : l’équipe est-elle basée dans l’UE ? Alors le démarrage probable mi-juillet doit être intégré fermement dans la planification, pas dans l’espoir. Quatrièmement : l’organisation effectue-t-elle de toute façon régulièrement ses propres évaluations ? Alors Grok 4.5 doit figurer sur la liste dès que l’accès est disponible.
Celui qui obtient aujourd’hui des résultats stables avec un autre modèle puissant et n’a pas de pression de coûts aiguë n’a pas besoin de précipitation. L’avantage se manifeste surtout à fort volume et pour des tâches comportant de nombreuses étapes d’itération. Dans Cursor, le modèle est inclus via l’abonnement existant dans le pool First-Party. Cela déplace encore une fois le calcul par rapport à une utilisation API pure.
- La consommation de sortie ramenée à environ un quart réduit les coûts récurrents à fort volume
- L’intégration First-Party native dans Cursor évite les efforts de mise en place pour les équipes éditeur
- Le cas divulgué des données d’entraînement offre un aperçu honnête sur l’état des données
- Bloqué dans l’UE au lancement, une date de disponibilité contraignante fait défaut
- Toutes les valeurs d’efficacité et de benchmark sont rapportées par le fournisseur, sans vérification indépendante
- Le comportement sur des projets internes complexes sur la durée reste à éclaircir
Questions fréquentes
Qu’est-ce que Cursor ?
Cursor est l’éditeur de code assisté par IA d’Anysphere. Il enrichit une interface d’éditeur familière avec la complétion de code, l’édition basée sur chat et les modifications agentiques sur plusieurs fichiers. SpaceXAI a racheté l’entreprise mi-juin 2026. Grok 4.5 y fonctionne depuis le lancement comme modèle First-Party.
Pourquoi Grok 4.5 n’est-il pas disponible dans l’UE ?
SpaceXAI a bloqué Grok 4.5 au lancement dans l’UE. La raison en sont les exigences de conformité de l’EU AI Act pour les modèles particulièrement performants. Une disponibilité est attendue pour mi-juillet 2026. Le fournisseur n’a pas indiqué de date fixe.
Qu’est-ce que signifie concrètement token-efficient ?
Cela signifie que le modèle produit nettement moins de tokens de sortie pour des tâches comparables. Sur SWE-Bench Pro, ce sont selon SpaceXAI environ 15 954 tokens par tâche au lieu de 67 020 chez Opus 4.8. Cela correspond à environ un quart de la consommation et à des chaînes de traitement plus courtes. Moins de tokens signifient des coûts plus bas par tâche résolue.
Quand Grok 4.5 arrive-t-il dans l’UE ?
La disponibilité est attendue pour mi-juillet 2026. Il n’existe pas de date de sortie fixe. Les équipes en Allemagne, en Autriche et en Suisse doivent utiliser d’autres modèles jusqu’à cette date.
Conseils de lecture de la rédaction
- Claude Code devance Copilot dans les workflows d’équipe
- Presque au plus haut niveau, moins cher et entraîné sur trois continents
- L’intégration de l’IA devient mature pour l’entreprise : le Model Context Protocol sous l’égide de la Linux Foundation
Plus du réseau MBF Media
MyBusinessFutureDe l’argent laissé sur la table : ce que révèle un audit IADigital ChiefsComment les décideurs utilisent vraiment l’IA en 2026SecurityTodayL’AI Act est en réalité une loi sur la sécuritéSource image de couverture : genere par IA (juillet 2026)

