Lancement du modèle Grok 4 par xAI
Du lancement de Grok 4 en juillet 2025 à Grok 4.5 en 2026 : faits confirmés, feuille de route réelle, usages agentiques, benchmarks et limites.

Grok 4 a marqué, en juillet 2025, le passage de xAI vers un modèle de raisonnement doté d’une recherche en temps réel et d’un usage natif des outils. L’annonce initiale a cependant été entourée de démonstrations, de comparaisons promotionnelles et d’un calendrier très ambitieux. Cette rétrospective revient aux éléments officiels, puis suit l’évolution de Grok jusqu’à Grok 4.5 au 2 août 2026.
Note de mise à jour du 2 août 2026 : le titre et l’URL d’origine restent inchangés. La première version de cet article datait du 14 juillet 2025. Le corps a été reconstruit afin de séparer les affirmations connues lors du lancement, les feuilles de route évoquées à l’époque et les produits effectivement publiés depuis.
En bref
- La page officielle de xAI date le lancement de Grok 4 au 9 juillet 2025.
- Le modèle associait raisonnement, appels d’outils, recherche web en temps réel et recherche dans X.
- xAI proposait Grok 4 aux abonnés SuperGrok et Premium+, ainsi que dans son API, et lançait un niveau SuperGrok Heavy.
- Les superlatifs de xAI et les classements partagés au lancement sont des affirmations du fournisseur, pas une preuve universelle de supériorité.
- Le calendrier initial n’a pas été exécuté sous les noms annoncés. xAI a plutôt publié Grok Code Fast 1, Grok 4 Fast, Grok 4.1, Grok 4.1 Fast, Grok Build et, le 16 juillet 2026, Grok 4.5.
- Au 2 août 2026, Grok 4.5 est présenté par xAI comme son modèle le plus capable pour le code, les tâches agentiques et le travail de connaissance.
Ce que xAI a officiellement lancé en juillet 2025
La page de lancement décrivait Grok 4 comme un modèle entraîné avec l’infrastructure Colossus de xAI, annoncée à 200 000 GPU. xAI expliquait avoir fortement augmenté l’apprentissage par renforcement afin d’améliorer le raisonnement. Le modèle pouvait choisir ses requêtes, chercher sur le web, explorer X par mots-clés ou recherche sémantique et consulter des médias.
Ce point était plus important que les démonstrations spectaculaires. Grok 4 n’était pas seulement une interface de conversation : il s’inscrivait dans une architecture où un modèle planifie des recherches et utilise des outils. Le guide Promptique des agents IA et de MCP explique pourquoi la qualité finale dépend aussi de l’orchestration, des permissions et des sources.
xAI annonçait en parallèle Grok 4 Heavy, accessible dans un abonnement distinct. La page officielle le présentait comme la version la plus puissante, mais détaillait peu son architecture. Il est donc préférable de ne pas transformer une description de présentation en certitude sur le nombre d’agents, leur spécialisation ou leur méthode d’agrégation.
Ce que l’article initial devait nuancer
| Affirmation de 2025 | Lecture fiable en 2026 |
|---|---|
| Grok 4 « surpasse » tous ses concurrents | Les résultats dépendaient des benchmarks, réglages et outils. Ils ne démontraient pas une supériorité pour tous les usages. |
| Grok 4 Heavy est une architecture multi-agent définie | xAI annonçait une version Heavy, sans fournir sur sa page de lancement une spécification suffisante pour généraliser son architecture. |
| Un modèle de code arriverait en août 2025 | Grok Code Fast 1 a effectivement été annoncé le 28 août 2025, sous un nom et un positionnement précis. |
| Un agent multimodal arriverait en septembre | xAI a publié Grok 4 Fast le 19 septembre, puis Grok 4.1 et 4.1 Fast en novembre. La trajectoire réelle ne correspond pas mot pour mot à la formule initiale. |
| Une génération vidéo arriverait en octobre | La vidéo a évolué dans la gamme Grok Imagine, avec notamment Video 1.5 annoncé en juin 2026. La date initiale ne doit plus servir de référence. |
| Un prix fixe pouvait être comparé à Claude | Plans, variantes, cache, outils et tarifs API ont changé. Il faut consulter la tarification active avant toute comparaison. |
La chronologie réelle de la gamme Grok
Août et septembre 2025 : spécialisation et efficacité
xAI a annoncé Grok Code Fast 1 le 28 août 2025 comme un modèle de raisonnement rapide et économique pour le code agentique. Le 19 septembre, Grok 4 Fast a déplacé l’attention vers le rapport entre capacité, vitesse et coût. Ces sorties confirmaient l’intérêt de xAI pour les outils de développement, mais pas l’ensemble de la feuille de route attribuée au lancement.
Novembre 2025 : Grok 4.1 et l’API d’outils
Grok 4.1, publié le 17 novembre, visait une meilleure qualité de conversation, de création et de compréhension de l’intention. xAI indique l’avoir déployé silencieusement du 1er au 14 novembre pour comparer les préférences en production. Deux jours plus tard, Grok 4.1 Fast et l’Agent Tools API ont ajouté une fenêtre de deux millions de tokens et des outils serveur pour le web, X, le code et les documents.
Ces chiffres sont ceux de xAI. Une fenêtre maximale ne prouve pas que chaque information sera retrouvée avec la même fiabilité, ni que le coût ou la latence seront adaptés à un produit donné. Les tests doivent utiliser vos documents et vos trajectoires.
Mai à juillet 2026 : Grok Build et Grok 4.5
Le 25 mai 2026, xAI a ouvert une bêta de Grok Build, un agent de code en ligne de commande. Le produit inclut un mode plan, une validation avant exécution et l’affichage des modifications. Son harnais et son interface terminal ont ensuite été publiés en open source le 15 juillet. Il faut distinguer cette ouverture de celle des poids du modèle Grok, qui restent servis comme un produit propriétaire.
Le 16 juillet 2026, xAI a lancé Grok 4.5 pour le code, les tâches agentiques et le travail de connaissance. La société indique qu’il a été entraîné avec Cursor et publie des résultats sur plusieurs évaluations d’ingénierie. Au 2 août, cette version constitue la suite la plus directe de l’ambition technique de Grok 4.
Comment lire les benchmarks sans se tromper
Un score dépend du modèle, mais aussi du niveau de raisonnement, du harnais, des outils, du nombre d’essais, des limites de tokens et de la date. Comparer une version Heavy avec un modèle rapide, ou un agent doté de recherche avec un modèle sans outil, mélange des systèmes différents.
Les évaluations annoncées par un éditeur restent utiles si leur protocole est lisible. Elles doivent être complétées par des cas réels, un budget identique et une mesure des erreurs. Le comparatif Promptique des principaux assistants aide à comparer expérience, données et fonctionnalités, tandis que le guide du prompt engineering détaille la construction d’un jeu d’évaluation.
Les impacts pratiques pour une équipe
- Recherche en temps réel : utile pour une information récente, mais la citation et la lecture des sources restent indispensables.
- Données issues de X : elles apportent de la fraîcheur, avec des risques de rumeur, manipulation, représentativité et suppression.
- Code agentique : Grok Build et les modèles spécialisés peuvent accélérer une tâche, mais doivent travailler dans un dépôt isolé avec revue des diffs.
- Long contexte : il réduit certains découpages, sans supprimer les erreurs de récupération ou les instructions contradictoires.
- API d’outils : les droits et validations doivent être imposés par l’application, pas laissés à la décision textuelle du modèle.
Pour des usages collectifs ou sensibles, le guide sur l’IA générative en entreprise, le RGPD et l’AI Act fournit le cadre de gouvernance complémentaire.
Limites et points de vigilance
xAI reconnaît dans ses publications que les modèles rapides avec recherche peuvent produire des erreurs factuelles. Grok 4.1 a précisément fait l’objet d’un travail annoncé sur la réduction des hallucinations. Une amélioration relative ne constitue jamais un taux d’erreur nul.
La proximité avec X crée un avantage d’accès, mais aussi une dépendance à une plateforme et à ses règles. Les entreprises doivent contrôler conservation, confidentialité, régions de traitement et conditions contractuelles. Elles doivent enfin prévoir un arrêt humain pour les messages publics, paiements, suppressions, déploiements et décisions affectant une personne.
FAQ
Grok 4 était-il le meilleur modèle du monde ?
C’était la formule promotionnelle de xAI. Aucun benchmark ne démontre une supériorité universelle sur toutes les langues, tâches, coûts et contraintes.
Grok 4 Heavy utilisait-il plusieurs agents ?
Des présentations ont associé Heavy à davantage de calcul. La page officielle de lancement ne fournit pas assez de détails pour en faire une description générale et durable de l’architecture.
Grok Build est-il open source ?
xAI a publié le harnais et l’interface terminal de Grok Build en juillet 2026. Cela ne signifie pas que les poids de Grok 4.5 sont ouverts.
Faut-il migrer de Grok 4 vers 4.5 ?
Testez d’abord les tâches, outils, coûts et politiques qui vous concernent. Un nouveau modèle peut améliorer certains scénarios tout en modifiant latence, style ou comportement.
Sources officielles
- xAI, Grok 4, 9 juillet 2025.
- xAI, Grok Code Fast 1, 28 août 2025.
- xAI, Grok 4 Fast, 19 septembre 2025.
- xAI, Grok 4.1, 17 novembre 2025.
- xAI, Grok 4.1 Fast et Agent Tools API, 19 novembre 2025.
- xAI, lancement de Grok Build, 25 mai 2026.
- xAI, Grok Imagine Video 1.5, 16 juin 2026.
- xAI, ouverture de Grok Build, 15 juillet 2026.
- xAI, Grok 4.5, 16 juillet 2026.
- xAI, fiche modèle Grok 4.1, 17 novembre 2025.
Avertissement : les fonctionnalités, tarifs et modèles disponibles peuvent évoluer. Cette rétrospective ne constitue ni une recommandation d’achat, ni un audit de sécurité. Vérifiez les pages contractuelles et techniques actives avant un déploiement.