Grok 4.5 : on a testé le 1er modèle post-IPO de SpaceXAI (avis 2026)
SpaceXAI (l’ex-xAI, fusionnée avec SpaceX depuis février 2026) a mis en ligne Grok 4.5 le 8 juillet 2026. C’est le premier modèle sorti après l’entrée en bourse historique de SpaceX le 12 juin 2026 — 1 770 milliards de dollars de valorisation, la plus grosse IPO de l’histoire. Elon Musk a présenté Grok 4.5 comme « un modèle de classe Opus, mais plus rapide, plus économe en tokens et moins cher ».
Le problème : au moment où on écrit ces lignes, six jours après le lancement mondial, Grok 4.5 reste bloqué dans les 27 pays de l’Union européenne. Pas d’accès via grok.com, pas d’app X, pas de console API SpaceXAI. On a quand même réussi à le tester depuis la France, et on explique comment.
Le verdict en 30 secondes
Grok 4.5 tient sa promesse sur le rapport qualité-prix et la vitesse, moins sur la précision brute en code face à Opus 4.8. Sur SWE-Bench Pro (résolution de tâches d’ingénierie logicielle réelles), il obtient 64,7 %, devant GPT-5.5 (58,6 %) mais derrière Claude Opus 4.8 (69,2 %) et Claude Fable 5 (80,4 %). Là où il se distingue vraiment : il consomme environ 4 fois moins de tokens de sortie qu’Opus 4.8 pour résoudre le même type de tâche, et il facture ses appels API 2 à 4 fois moins cher que la concurrence directe.
Pour un utilisateur français aujourd’hui : accès compliqué (pas de version grand public en UE), mais testable via Cursor sans aucune restriction géographique. Si vous codez déjà avec cet éditeur, c’est la voie la plus directe pour vous faire un avis.
Grok 4.5, c’est quoi exactement
Le modèle repose sur une nouvelle fondation baptisée V9, avec environ 1 500 milliards de paramètres. Sa particularité : il a été entraîné en partie avec des données issues de Cursor, l’éditeur de code IA, dans le cadre d’un partenariat annoncé au lancement. L’entraînement a mobilisé des dizaines de milliers de GPU Nvidia GB300, avec une phase d’apprentissage par renforcement construite sur des centaines de milliers de tâches d’ingénierie logicielle réelles.
Côté specs techniques : fenêtre de contexte de 500 000 tokens, débit d’environ 80 tokens par seconde, et un paramètre reasoning_effort exposé aux développeurs (low, medium, high — high par défaut) pour arbitrer entre vitesse et profondeur de raisonnement selon la tâche.
Le positionnement affiché par SpaceXAI cible trois usages : le code (génération et debug), les tâches agentiques (appel d’outils en chaîne, exécution autonome), et le travail de connaissance au sens large, avec une extension explicite vers les cas d’usage juridiques et financiers.
Pourquoi on ne peut pas encore l’utiliser sur grok.com en France
C’est le point que la plupart des articles anglophones passent sous silence ou glissent en fin de papier. Grok 4.5 est classé par le règlement européen sur l’IA (AI Act) comme modèle à usage général présentant un risque systémique — une catégorie qui s’applique aux modèles entraînés au-delà d’un certain seuil de calcul. Avant toute mise à disposition dans l’UE, SpaceXAI doit boucler des évaluations de modèle, des tests contradictoires (red teaming), des procédures de signalement d’incidents et des audits de cybersécurité, le tout soumis au contrôle des autorités européennes.
SpaceXAI a annoncé une ouverture « courant juillet » sans donner de date ferme. Résultat concret pour un utilisateur en France : grok.com refuse l’accès au modèle, l’app X ne le propose pas, et la console API SpaceXAI le bloque également. Aucun abonnement SuperGrok ou X Premium+ ne permet de contourner ce blocage tant que la conformité UE n’est pas actée.
Deux portes restent ouvertes, sans contournement technique douteux ni VPN :
- Cursor : le modèle y est disponible depuis le jour du lancement, sur desktop, web, iOS, en CLI et via le SDK, sur tous les plans (y compris gratuit), sans restriction géographique mentionnée. C’est la voie la plus simple pour un développeur.
- Les passerelles API : OpenRouter, Vercel, Cloudflare, Snowflake et Databricks référencent tous Grok 4.5. Pour quelqu’un qui ne code pas, OpenRouter reste l’option la plus accessible — une interface de chat basique branchée sur l’API du modèle.
Une fois l’accès UE ouvert, la voie grand public se fera via SuperGrok (30 $/mois, Grok 4.5 explicitement inclus) ou X Premium+ (40 $/mois), les deux facturés séparément par SpaceXAI.
Ce que montrent les premiers retours sur le terrain
En l’absence d’accès direct via grok.com depuis la France, notre avis s’appuie sur un test via Cursor (code, sans restriction) complété par les retours croisés des premiers testeurs internationaux et des benchmarks indépendants publiés depuis le 8 juillet.
Sur le code. Via Cursor, Grok 4.5 répond vite — le débit annoncé de 80 tokens/seconde se ressent concrètement sur des tâches de refactoring ou de génération de fonctions. Sur des bugs réels (benchmark DeepSWE 1.1, qui mesure la résolution de tickets soumis par de vrais développeurs), il obtient 53 %, derrière Opus 4.8 (59 %) et GPT-5.5 (67 %). Le modèle est net sur la lisibilité de son raisonnement intermédiaire, un point souvent salué dans les premiers retours anglophones.
Sur les tâches agentiques. C’est là que Grok 4.5 se distingue vraiment : consommation de tokens divisée par 4 environ face à Opus 4.8 pour un résultat comparable sur SWE-Bench Pro (environ 15 950 tokens de sortie contre 67 000 pour Opus 4.8 sur les mêmes tâches). Pour un usage professionnel à volume — un agent qui tourne en continu sur un pipeline CI, par exemple — cet écart pèse directement sur la facture.
Sur le raisonnement général et la rédaction. Les benchmarks publiés le placent en position intermédiaire, devant GPT-5.5 sur certains tests de code mais derrière sur d’autres domaines. Rien dans les retours actuels ne suggère une avance nette sur la rédaction en français — logique, puisque ce n’est pas l’angle marketing choisi par SpaceXAI pour ce lancement.
Grok 4.5 face à Claude Opus 4.8, Gemini 3.5 et GPT-5.5
| Modèle | SWE-Bench Pro | Prix (entrée/sortie par M tokens) | Contexte | Point fort |
|---|---|---|---|---|
| Grok 4.5 | 64,7 % | 2 $ / 6 $ | 500K tokens | Coût et efficacité tokens sur tâches agentiques |
| Claude Opus 4.8 | 69,2 % | 5 $ / 25 $ | — | Précision et fiabilité sur code complexe |
| GPT-5.5 | 58,6 % | — | — | Polyvalence multimodale et agentique |
| Claude Fable 5 | 80,4 % | — | — | Meilleur score brut, mais accès restreint aux US |
Pour situer Grok 4.5 face aux modèles déjà couverts sur ce site : il reste derrière Claude Opus 4.8 en précision de code, mais coûte 2 à 4 fois moins cher à l’usage API. Face à Gemini 3.5, la comparaison penche selon l’usage — Gemini garde l’avantage sur l’intégration à l’écosystème Google, Grok sur le coût par tâche agentique. Notre comparatif Opus 4.8 vs Gemini 3.5 donne le détail des scores sur cette paire, utile pour situer où Grok 4.5 se glisse entre les deux.
Le choix dépend surtout du budget et du volume : un studio qui fait tourner un agent de code en continu sur des centaines de tâches par jour verra l’écart de prix compenser un score de résolution légèrement inférieur. Un usage ponctuel sur des tâches complexes justifie encore de payer plus cher pour Opus 4.8 ou Fable 5.
Prix, limites et ce qui manque encore
Tarification API : 2 $ par million de tokens en entrée, 6 $ en sortie, 0,50 $ par million de tokens en entrée mis en cache. C’est nettement sous le tarif de Claude Opus 4.8 (5 $ / 25 $ par million de tokens), ce qui explique une bonne partie du buzz autour du lancement.
Accès grand public : SuperGrok à 30 $/mois (Grok 4.5 inclus) ou X Premium+ à 40 $/mois, une fois l’accès UE débloqué — pas de date ferme au moment de la publication.
Limites identifiées à ce stade :
- Blocage complet en Europe, y compris sur les canaux consommateur. Pas de contournement légal simple hors Cursor et gateways API.
- Score de résolution de bugs réels (DeepSWE 1.1) en retrait face à Opus 4.8 et GPT-5.5.
- Aucun retour consolidé sur la qualité rédactionnelle en français à cette date — le modèle n’a pas été conçu autour de cet usage.
- Dépendance à l’écosystème X/SuperGrok pour l’accès consommateur, avec un abonnement facturé à part de X Premium classique.
Le pari de SpaceXAI est clair : sacrifier un peu de précision brute pour gagner sur le coût et la vitesse, avec Cursor comme partenaire de lancement pour cibler en priorité les développeurs. Reste à voir si l’ouverture européenne, une fois actée, s’accompagne d’une offre consommateur aussi agressive sur le prix que l’offre API actuelle.
FAQ
Peut-on utiliser Grok 4.5 gratuitement en France ?
Pas via grok.com ni l’app X pour l’instant, le modèle y étant bloqué. Via Cursor, les plans gratuits donnent accès à un usage limité de Grok 4.5 sans coût.
Grok 4.5 est-il inclus dans mon abonnement X Premium actuel ?
Non. L’accès à Grok 4.5 nécessite SuperGrok (30 $/mois) ou X Premium+ (40 $/mois), facturés séparément par SpaceXAI, et de toute façon indisponibles en UE au moment de la publication.
Pourquoi Grok 4.5 est-il bloqué en Europe alors que d’autres modèles récents ne le sont pas ?
Parce qu’il est classé modèle à risque systémique par l’AI Act, ce qui impose des évaluations et audits de sécurité avant toute mise à disposition dans l’UE. D’autres modèles récents (Opus 4.8, Gemini 3.5) ont déjà bouclé cette conformité au moment de leur lancement en Europe.
Grok 4.5 est-il meilleur que Claude Opus 4.8 pour coder ?
Sur la précision brute, non — Opus 4.8 le devance sur SWE-Bench Pro et DeepSWE 1.1. Sur le coût par tâche et la vitesse d’exécution, Grok 4.5 prend l’avantage, surtout sur des volumes agentiques élevés.
Existe-t-il des alternatives gratuites en attendant l’ouverture UE ?
Pour du code, Cursor donne accès à Grok 4.5 sans passer par grok.com, sur tous les plans y compris gratuit. Pour un usage généraliste, Mammouth agrège plusieurs modèles et pourrait intégrer Grok 4.5 une fois l’accès européen ouvert. En attendant, notre avis sur GPT-5.5 reste une bonne référence pour comparer un modèle déjà disponible en France.
Comparez aussi les abonnements IA disponibles en France dans notre guide des meilleurs abonnements IA 2026, et découvrez comment ChatGPT se compare à Claude sur les mêmes critères de prix et de performance.
