AI Tools

Grok 4.6 : date de sortie, prix, benchmarks et nouveautés

Grok 4.6 est disponible. Découvrez ses tarifs API, ses scores face à GPT-5.6 et Claude Opus 5, sa fenêtre de contexte et son intérêt.

Photo de profil de Long Nguyen

Long Nguyen

Développeur fullstack · Ingénieur IA · Chercheur

• • 3 min de lecture •

xAI, qui opère désormais sous sa maison mère SpaceXAI, a lancé Grok 4.6 le 12 août 2026. Sa promesse principale est simple : une nette progression par rapport à Grok 4.5 en programmation et en performances agentiques, pour un tarif API inchangé. La validité de cette promesse dépend toutefois du chiffre que l’on examine — voici donc une analyse détaillée, sans le battage médiatique du lancement.

Qu’est-ce que Grok 4.6 ?

Grok 4.6 est le dernier modèle de langage de pointe de xAI. Il repose sur la même base de 1,5 trillion de paramètres que Grok 4.5, plutôt que sur un modèle de base plus volumineux. Les progrès viennent presque entièrement du post-entraînement : un fine-tuning supervisé amélioré et un apprentissage par renforcement, notamment grâce au « Grok Build », le framework de programmation de xAI qui entraîne le modèle sur des tâches de développement concrètes.

Il s’agit d’un choix stratégique notable. Plutôt que d’augmenter le nombre de paramètres, xAI cherche à déterminer jusqu’où le post-entraînement peut pousser un modèle — et les premiers résultats suggèrent que cette approche peut aller très loin.

Le modèle accepte des entrées textuelles et des images, mais génère uniquement du texte. Il dispose d’une fenêtre de contexte de 500 000 tokens, de l’appel de fonctions, de sorties structurées et d’un niveau de raisonnement configurable. Il est désormais accessible via l’API xAI, Grok Build, Cursor, Grok Bot, OpenRouter, Vercel et Cloudflare.

Benchmarks de Grok 4.6 : quel est son véritable classement ?

Sur l’Artificial Analysis Intelligence Index — l’un des agrégats indépendants de benchmarks les plus cités — Grok 4.6 obtient un score de 61. Il se situe donc à peu près au niveau de GPT-5.6 Sol et environ cinq points au-dessus de Grok 4.5. Il arrive juste derrière Claude Opus 5 et Fable 5 d’Anthropic, qui occupent actuellement les deux premières places du même index.

Voici quelques éléments à retenir :

  • Grok 4.6 arrive en tête sur CursorBench, FrontierCode et AA-Briefcase, mais reste derrière GPT-5.6 Sol sur DeepSWE et quelques autres évaluations spécialisées dans le développement.
  • Pour les tâches agentiques, Grok 4.6 terminerait des workflows complexes en plusieurs étapes en environ 53 étapes, contre près de 103 pour Claude Opus 5 — à un coût par tâche nettement inférieur.
  • Certains premiers testeurs font état d’un score ELO proche de 1753 dans des confrontations directes entre modèles, même si la confirmation indépendante de LMSYS Chatbot Arena et d’Artificial Analysis était encore attendue peu après le lancement.

La réserve essentielle : ces résultats de benchmarks sont en grande partie communiqués par les fournisseurs ou issus d’une sélection interne. xAI précise que ses comparaisons avec des services tiers utilisent les meilleurs scores publics disponibles pour les modèles concurrents. Les conditions de test, les paramètres de raisonnement et l’accès aux outils ne sont donc pas forcément identiques partout. Considérez ces chiffres comme des indicateurs de tendance, et non comme un classement définitif.

Prix de Grok 4.6 : le point souvent mal compris des comparaisons

Le tarif API annoncé est de 2 $ par million de tokens en entrée et 6 $ par million de tokens en sortie — des prix inchangés par rapport à Grok 4.5, et environ 60 % moins élevés que ceux de Claude Opus 5 (5 $ / 25 $) ou de GPT-5.6 Sol (5 $ / 30 $) au tarif catalogue.

Mais ce tarif de 2 $ / 6 $ ne s’applique qu’aux prompts de moins de 200 000 tokens. Dès qu’une requête dépasse ce seuil, la tarification long contexte de xAI entre en vigueur et double les prix : 4 $ par million de tokens en entrée et 12 $ par million en sortie. Surtout, le tarif supérieur s’applique à tous les tokens de la requête, et pas uniquement à ceux qui dépassent le seuil.

  Standard (moins de 200K tokens) Long contexte (200K+ tokens)
Entrée 2 $ / 1M tokens 4 $ / 1M tokens
Entrée mise en cache 0,50 $ / 1M tokens 1 $ / 1M tokens
Sortie 6 $ / 1M tokens 12 $ / 1M tokens

Le tarif des entrées mises en cache est lui aussi passé discrètement de 0,30 $ à 0,50 $ par million de tokens sur l’offre standard par rapport à Grok 4.5 — un détail absent de l’annonce de lancement. Si vos usages reposent sur de longs documents ou de gros dépôts de code, calculez le coût de l’offre long contexte avant de conclure que la promesse d’un prix « deux fois inférieur à celui des modèles de pointe » s’applique à votre cas.

Pour les particuliers, Grok reste disponible via X/Grok Bot avec plusieurs formules, l’offre haut de gamme SuperGrok Heavy étant proposée aux alentours de 300 $ par mois.

Grok 4.6 vs GPT-5.6 Sol vs Claude Opus 5

Voici comment ces trois modèles se comparent selon les données publiques disponibles :

Modèle Artificial Analysis Intelligence Index Prix entrée / sortie (par million de tokens) Fenêtre de contexte
Grok 4.6 61 2 $ / 6 $ 500K
GPT-5.6 Sol 61 5 $ / 30 $ —
Claude Opus 5 ~63–65 (classé n°1) 5 $ / 25 $ —

Grok 4.6 égale GPT-5.6 Sol sur le score d’intelligence brut, tout en étant nettement moins cher. Il devance également le modèle open-weight Kimi K3. Claude Opus 5 et Fable 5 restent en tête de l’index général. Le « meilleur modèle » et le « meilleur rapport qualité-prix » ne désignent donc pas forcément le même choix : tout dépend de la sensibilité de votre usage au coût ou de votre recherche de performances maximales.

Passer à Grok 4.6 : est-ce que cela en vaut la peine ?

Voici quelques enseignements pratiques si vous envisagez de basculer un workload vers Grok 4.6 :

  • Les workflows de programmation et agentiques sont ceux où la mise à niveau est la plus visible : le framework Grok Build de xAI a été entraîné spécifiquement sur des tâches de développement concrètes, et l’efficacité mesurée en nombre d’étapes dans les benchmarks agentiques constitue une différence réelle.
  • Les usages intensifs sensibles au coût profitent le plus de l’écart tarifaire, à condition de rester sous le seuil de 200K tokens qui déclenche la tarification long contexte.
  • Les traitements de longs documents ou de grandes bases de code doivent faire l’objet d’un calcul séparé avec l’offre long contexte : le tarif doublé s’applique rétroactivement à l’ensemble de la requête, ce qui modifie rapidement le calcul.
  • Les déploiements en entreprise ou dans des secteurs réglementés doivent prendre en compte l’historique du fournisseur en plus des scores de benchmarks : les équipes achats qui évaluent un modèle examinent généralement la gouvernance et la fiabilité dans la durée, au-delà des seuls chiffres de capacité.

La suite : Grok 4.7

xAI a déjà indiqué qu’un modèle plus volumineux de 2,1 trillions de paramètres, Grok 4.7, devrait sortir dans les semaines suivant le lancement de la version 4.6. Grok 5 est quant à lui attendu avant la fin de 2026. Si ce calendrier se confirme, Grok 4.6 pourrait rester relativement peu de temps sur le marché, plutôt que de servir longtemps de modèle phare à xAI. Un point à garder à l’esprit si vous prévoyez votre infrastructure autour d’une version précise du modèle, plutôt que d’un endpoint API que xAI continuera de faire évoluer en arrière-plan.

FAQ

Questions fréquentes

Quand Grok 4.6 est-il sorti ?

Le 12 août 2026, via l’API xAI, Grok Build, Cursor et Grok Bot.

Quel est le prix de l’API Grok 4.6 ?

2 $ par million de tokens en entrée et 6 $ par million de tokens en sortie pour les prompts de moins de 200 000 tokens. Au-delà de ce seuil, le tarif double et passe à 4 $ / 12 $ par million de tokens pour l’ensemble de la requête.

Quelle est la fenêtre de contexte de Grok 4.6 ?

500 000 tokens, avec une tarification long contexte qui s’applique au-delà de 200 000 tokens.

Grok 4.6 est-il meilleur que GPT-5.6 Sol ?

Les deux modèles sont à peu près à égalité sur l’Artificial Analysis Intelligence Index, avec un score d’environ 61. Grok 4.6 est nettement moins cher et plus efficace en nombre d’étapes agentiques, tandis que GPT-5.6 Sol domine certains benchmarks de programmation comme DeepSWE.

Grok 4.6 est-il meilleur que Claude Opus 5 ?

Non. Claude Opus 5 est actuellement mieux classé sur l’Intelligence Index, mais Grok 4.6 coûte nettement moins cher par token, ce qui peut changer la décision pour les usages sensibles au coût ou à fort volume.

Restez informé avec Netalith

Recevez des ressources de développement, des mises à jour produit et des offres spéciales directement dans votre boîte mail.