Grok 4.5 est sorti : premiers retours d'utilisateurs et premiers benchmarks
Grok 4.5 est ouvert au public depuis le 9 juillet. Les premiers benchmarks indépendants et les retours d'utilisateurs tombent : rapide et très bon marché, mais pas tout à fait « niveau Opus ».

La veille, ce n'était qu'une promesse. Le 9 juillet 2026, Grok 4.5 est effectivement ouvert au public : le modèle apparaît dans le sélecteur de grok.com, dans l'interface Grok Build et via l'API. Et cette fois, on ne juge plus sur parole — les premiers benchmarks indépendants et les premiers retours d'utilisateurs sont là.
Le verdict à chaud est plus nuancé que le « niveau Opus » martelé par Elon Musk lors de l'annonce. Grok 4.5 impressionne par sa vitesse et surtout par son prix, se hisse dans le peloton de tête sur l'intelligence générale, mais reste derrière les meilleurs modèles d'Anthropic et d'OpenAI sur les épreuves de code les plus dures. Voici ce que l'on sait au soir du lancement.

Les premiers benchmarks indépendants sont là
C'était le grand absent de l'annonce : un chiffre public. Il est arrivé dès le soir du lancement. Artificial Analysis a publié son évaluation et place Grok 4.5 au 4ᵉ rang de son Intelligence Index (v4.1) avec un score de 54, juste derrière Fable 5, GPT-5.5 et Opus 4.8 — soit un bond de 16 points par rapport à Grok 4.3, et devant tous les modèles à poids ouverts ainsi que les Gemini de Google.
Grok 4.5 de SpaceXAI obtient un score de 54 et se classe quatrième de l'Artificial Analysis Intelligence Index, derrière seulement Fable 5, GPT-5.5 et Opus 4.8. Il fait jeu égal avec GPT-5.5 (Codex) sur notre Coding Agent Index, dans le harnais Grok Build, pour un coût bien inférieur.Voir le post sur X
Sur les épreuves plus spécialisées, l'image se précise — et se nuance. D'après les scores compilés par the-decoder, Grok 4.5 fait jeu égal sur les tâches en ligne de commande mais décroche nettement sur la résolution de vrais tickets GitHub :
| Épreuve | Grok 4.5 | GPT-5.5 | Meilleur Anthropic |
|---|---|---|---|
| Terminal Bench 2.1 (ligne de commande) | 83,3 % | 83,4 % | 84,3 % (Fable 5) |
| DeepSWE 1.1 (tickets GitHub réels) | 53 % | 67 % | 70 % (Fable 5) |
| SWE-bench Pro (ingénierie logicielle) | 64,7 % | 58,6 % | 80,4 % (Fable 5) |
Autrement dit : sur les tâches courtes et outillées, Grok 4.5 talonne les meilleurs ; sur les tâches d'ingénierie longues et autonomes, l'écart se creuse. Sur SWE-bench Pro, il devance GPT-5.5 mais reste derrière Opus 4.8 (69,2 %) et loin de Fable 5. (Sources : Artificial Analysis, the-decoder, 8 juillet 2026.)
Elon Musk lui-même a d'ailleurs révisé sa formule. Après avoir présenté le modèle comme « de classe Opus », il a précisé sur X que l'évaluation interne le situe un cran en dessous de l'Opus 4.8 actuel d'Anthropic :
Notre évaluation interne situe Grok 4.5 à peu près au niveau d'Opus 4.7, mais bien plus rapide. C'est la combinaison des capacités, de la vitesse supérieure et du coût inférieur qui le rend compétitif. Nous bouclons la boucle sur l'utilité en conditions réelles, pas sur les benchmarks. Les ingénieurs les plus pointus de Tesla et SpaceX trouvent Grok 4.5 réellement utile — et c'est ça qui compte vraiment.Voir le post sur X
Ce que disent les premiers utilisateurs
Au-delà des tableaux, les retours de terrain, sur X et sur Reddit, dessinent trois camps.
Les enthousiastes insistent moins sur le code que sur la finesse d'écriture et la gestion de la nuance. Sur r/grok, un utilisateur résume l'effet ressenti :
Ce n'est même pas une question de code. Sa capacité à tourner autour d'une idée sans la faire s'effondrer aussitôt ni la trancher d'emblée est bluffante. C'est le premier modèle Grok à l'aise avec l'ambiguïté quand on lui donne les bonnes instructions.Relevant_Witness_264, r/grok, 8 juillet 2026
Un signal plus sérieux vient d'un ingénieur se présentant comme membre de Snorkel AI, qui dit avoir eu un accès anticipé et fait tourner les trois modèles sur ~2 000 tâches professionnelles réelles (leur benchmark maison GDPval+). À prendre avec prudence — c'est une évaluation d'éditeur, pas encore répliquée publiquement — mais le résultat est frappant.
Grok 4.5 obtient un taux de réussite moyen de 29 %, devant GPT 5.5 (22 %) et Claude Opus 4.8 (21 %). Il domine dans de nombreux secteurs, avec les plus gros écarts là où le jugement professionnel compte, comme le juridique (40 % contre 27–28 %) ou l'assurance qualité.Top_Restaurant7554 (Snorkel AI), r/grok, 8 juillet 2026
Les déçus pointent surtout les quotas d'usage, jugés étouffants, notamment sur l'offre d'entrée. Un abonné raconte avoir été coupé en pleine tâche :
J'ai installé Grok Build et envoyé un prompt. Même pas deux minutes plus tard, à 105 k/500 k tokens, il s'arrête en plein milieu : limite d'usage atteinte. Mort de rire.SteveHuffmanyballs, r/grok, 9 juillet 2026
Plusieurs fils titrés « try for free is a joke » ou « paying $30 for this shit is insane » traduisent la même frustration : la version gratuite se heurte vite à un mur, et l'expérience complète suppose un abonnement.
Les indécis, enfin, hésitent à quitter Claude pour Grok, précisément à cause de ces limites. Un développeur qui sature régulièrement son forfait Claude Max s'interroge sur r/grok — et une réponse résume l'argument commercial de xAI :
Les limites de code de Grok 4.5 sont excellentes sur leur offre à 30 $, et ils viennent de lancer un deal à 99 $ pour trois mois sur leur formule la plus chère (habituellement 300 $).Réponse sur r/grok, 9 juillet 2026
Le vrai argument reste le prix
C'est là que Grok 4.5 frappe le plus fort. Sur le papier, l'API est deux à cinq fois moins chère que la concurrence directe :
| Modèle | Entrée ($/M tokens) | Sortie ($/M tokens) |
|---|---|---|
| Grok 4.5 | 2 $ | 6 $ |
| Opus 4.8 | 5 $ | 25 $ |
| GPT-5.5 / 5.6 | 5 $ | 30 $ |
| Fable 5 | 10 $ | 50 $ |
Ramené à une tâche de code d'agent, Artificial Analysis chiffre le coût à 2,49 $ pour Grok 4.5, contre 5,07 $ pour GPT-5.5 et 11,80 $ pour Fable 5 — pour un score « Coding Agent Index » quasi identique à celui de GPT-5.5 (76 points). C'est tout le pari de xAI : à qualité comparable sur la plupart des usages, diviser la facture par deux ou plus.
L'analyse relayée par the-decoder pointe un revers : le taux d'hallucination bondit de 25 % à 54 % sur les mesures suivies. Formule de l'analyste : « le modèle en sait plus, mais il est aussi plus sûr de lui quand il se trompe ». Pour de la rédaction longue ou du juridique, la relecture humaine reste indispensable.
En France, il faudra patienter
Un détail qui change tout pour les lecteurs européens : au 9 juillet, Grok 4.5 n'est pas encore disponible dans l'Union européenne, ni dans les produits SpaceXAI ni via la console API. L'information, relayée sur Reddit, cite une ouverture UE attendue « à la mi-juillet ».
Grok 4.5 n'est pas encore disponible dans l'UE, dans aucun produit SpaceXAI ni dans la console API. La disponibilité européenne est attendue pour la mi-juillet.DanceAndLetDance, r/grok, 9 juillet 2026
Le calendrier n'a par ailleurs rien d'anodin : la sortie de Grok 4.5 télescope celle de GPT-5.6, lancé au grand public le même jour. Deux annonces majeures le 9 juillet, ce qui n'est probablement pas un hasard — et laisse aux utilisateurs français, privés des deux nouveautés dans l'immédiat, le temps d'attendre les premiers verdicts avant de trancher.
Si vous codez et surveillez vos coûts, Grok 4.5 mérite un test dès son ouverture en Europe — son rapport prix/perf est difficile à battre. Mais pour un travail exigeant en français ou une rédaction où l'exactitude prime, comparez-le à Claude sur l'une de vos tâches réelles avant de basculer : sur le code difficile et la fiabilité, l'écart n'est pas qu'une histoire de prix.
Questions fréquentes
Grok 4.5 est-il vraiment « de niveau Opus » ?
Partiellement. Artificial Analysis le classe 4ᵉ de son Intelligence Index (score 54), derrière Fable 5, GPT-5.5 et Opus 4.8. Musk a lui-même revu sa formule, le situant « au niveau d'Opus 4.7 » plutôt que de l'Opus 4.8 actuel.
Combien coûte l'API de Grok 4.5 ?
2 $ par million de tokens en entrée et 6 $ en sortie, selon Artificial Analysis et the-decoder — soit deux à cinq fois moins que Opus 4.8 (5 $/25 $), GPT-5.5 (5 $/30 $) ou Fable 5 (10 $/50 $).
Grok 4.5 est-il bon pour coder ?
Correct, surtout au regard du prix : il fait jeu égal avec GPT-5.5 sur l'index « Coding Agent ». Mais sur les épreuves de code difficiles (DeepSWE, SWE-bench Pro), il reste derrière GPT-5.5 et surtout les modèles d'Anthropic.
Grok 4.5 est-il disponible en France ?
Pas encore au 9 juillet 2026 : le modèle n'est pas ouvert dans l'Union européenne, ni via l'app ni via l'API. Une disponibilité UE à la mi-juillet est évoquée dans les premiers retours d'utilisateurs, sans confirmation officielle de SpaceXAI.
Grok 4.5 est-il gratuit ?
L'accès gratuit existe mais avec des quotas très resserrés, dont plusieurs utilisateurs se plaignent dès le premier jour. L'usage soutenu passe par un abonnement payant (à partir de 30 $/mois d'après les retours). Voir notre fiche Grok.


