SpaceXAI a publié Grok 4.5 le 8 juillet. C’est le premier modèle de la société depuis la fusion entre xAI et SpaceX finalisée en février 2026. Et son argument principal n’est pas la performance brute : c’est le rapport qualité/prix.
Un modèle MoE formé sur des vrais développeurs
Grok 4.5 est une architecture mixture-of-experts (MoE), développée conjointement par xAI et Cursor, l’IDE IA que SpaceXAI est en train d’acquérir pour 60 milliards de dollars. Les données d’entraînement proviennent de sessions réelles d’utilisateurs Cursor, c’est-à-dire de la manière dont les développeurs travaillent concrètement, et non de bases de code finies et nettoyées. L’entraînement a été réalisé sur des dizaines de milliers de GPU NVIDIA GB300.
Elon Musk a décrit Grok 4.5 comme « un modèle de classe Opus, mais plus rapide, plus économe en tokens et moins cher ». Plus précisément, il se situe au niveau de Claude Opus 4.7 (l’ancien flagship d’Anthropic), pas du Opus 4.8 actuel. Ce positionnement calibré est important pour comprendre les benchmarks.
Les chiffres : premier sur SWE Marathon, quatrième sur SWE Bench Pro
SpaceXAI a publié cinq comparaisons. Sur SWE Bench Pro (résolution de bugs réels), Grok 4.5 obtient 64,7 %, derrière Opus 4.8 à 69,2 % et Claude Fable 5 à 80,4 %. Sur Terminal Bench 2.1, il marque 83,3 %, un dixième de point sous GPT 5.5. Résultat honnête, sans coup d’éclat.
Mais le cinquième benchmark change la lecture. Sur SWE Marathon, qui mesure la résolution de tâches longues en mode agent, Grok 4.5 finit premier à 29,0 %. Opus 4.8 suit à 26,0 %, Fable 5 à 24,0 %. C’est la seule métrique où Grok 4.5 bat tout le monde, et c’est précisément celle qui compte pour les workflows agentiques qui tournent des heures sans intervention humaine.
L’efficacité en tokens comme argument commercial
Grok 4.5 génère en moyenne 15 954 tokens de sortie pour résoudre une tâche SWE Bench Pro. Opus 4.8 en consomme 67 020 au même exercice, soit 4,2 fois plus. Combiné au prix affiché (2 dollars par million de tokens en entrée, 6 dollars en sortie), contre 5 et 25 pour Opus 4.8, la facture devient très différente à grande échelle.
Le modèle est disponible dès maintenant dans Grok Build, dans Cursor sur tous les abonnements et via l’API SpaceXAI. Il n’est pas encore accessible dans l’Union européenne : SpaceXAI évoque une disponibilité européenne pour mi-juillet. La fenêtre de contexte est fixée à 500 000 tokens, avec une vitesse de génération d’environ 80 tokens par seconde.
Une semaine chargée pour les LLMs
La sortie de Grok 4.5 n’est pas un événement isolé. GPT 5.6 Sol d’OpenAI a été lancé le lendemain, le 9 juillet. Gemini 3.5 Pro de Google est attendu le 17 juillet. Le marché des grands modèles de langage entre dans une phase de compression des prix et de diversification des usages. La grande question n’est plus « quel modèle est le plus puissant » mais « lequel est le plus rentable pour mon cas d’usage précis ».
