Mis à jour le 12 août 2026
xAI a sorti le 7 août 2026 une nouvelle version de son générateur d’images, Grok Imagine Image 2.0, avec de l’édition au pinceau magique et de la composition à partir de cinq images de référence. Face à lui, ChatGPT Image 2 tient la première place mondiale depuis avril. Nous les avons mis face à face sur nos propres consignes, images à l’appui, et recoupé le tout avec les tests indépendants déjà publiés.
🔎 Notre méthode, en toute transparence
Nous avons généré nos propres images sur les deux outils le 12 août 2026, avec des consignes strictement identiques, sans retouche et sans relancer pour obtenir mieux. Elles sont publiées plus bas avec le texte complet des consignes, pour que vous puissiez refaire l’essai. Nous ne republions en revanche aucune image créée par d’autres personnes : elles appartiennent à leurs auteurs.
Nous nous appuyons ensuite sur deux protocoles de test indépendants et publics, sur les classements par vote humain à l’aveugle, et sur l’annonce officielle de xAI. Chaque résultat cité est consultable en ligne.
Nous signalons enfin ce qui n’est pas mesuré à ce jour, car c’est là que se cachent les mauvaises surprises.
Ce que Grok Imagine 2.0 apporte vraiment
La vraie nouveauté n’est pas la beauté des images, c’est la possibilité de retoucher une zone précise sans tout régénérer. Jusqu’ici, changer un détail obligeait à relancer une génération complète, avec le risque de perdre le reste de l’image. Voici ce que xAI a livré le 7 août :
- Le pinceau magique et la segmentation : vous désignez une zone, vous décrivez la modification, le reste ne bouge pas.
- La suppression de fond avec export en transparence.
- La composition multi-références : jusqu’à cinq images d’entrée dans une seule génération, par exemple une pour le visage, une pour le style, une pour le décor.
- Le redimensionnement intelligent sur neuf formats, du 1:2 au 16:9.
- Des modèles prêts à l’emploi pour les photos de produit, les portraits professionnels, les icônes et les éléments de jeu.
Le tout est accessible sous le nom « Quality Mode » sur grok.com/imagine et dans les applications iOS et Android. xAI revendique la deuxième place mondiale en génération et en édition d’images.
ChatGPT Image 2, le tenant du titre
En face, GPT Image 2 occupe la première place depuis sa sortie en avril 2026. Il est arrivé le 21 avril dans l’API et le 22 avril dans ChatGPT, sous le nom ChatGPT Images 2.0.
Sa particularité tient à son architecture : le modèle raisonne avant de générer, et il hérite des connaissances de la famille GPT. En pratique, cela se voit sur deux terrains précis. D’abord le texte dans l’image, y compris dans des alphabets non latins, un exercice sur lequel les générateurs se cassent les dents depuis des années. Ensuite le respect des consignes complexes du type « sept objets, celui-ci à gauche de celui-là, sans tel élément ». Il monte jusqu’en 2K et produit jusqu’à huit images par requête.
Six épreuves identiques, sans tricher
ChatGPT Image 2 remporte quatre épreuves sur six. Le laboratoire Atlas Cloud a soumis les deux modèles aux mêmes consignes, avec une seule génération par essai et des critères de réussite définis à l’avance. Autrement dit : pas de sélection de la plus jolie image parmi cinq essais, ce qui est le péché mignon des comparatifs sponsorisés.
| Épreuve | Vainqueur | Ce qui s’est passé |
|---|---|---|
| Compter et placer 7 objets | ChatGPT | Grok a dessiné 5 tasses au lieu de 3. Aucun des deux n’a réussi la consigne complète |
| Peau, mains et lumière | Match nul | Grok signe la meilleure main (cinq doigts corrects) et une peau avec de vrais pores. ChatGPT gère mieux la physique de la lumière |
| Affiche bilingue | ChatGPT, nettement | Grok a écrit en chinois traditionnel alors que le simplifié était demandé. ChatGPT n’a raté aucun caractère |
| Faire pivoter un sujet de 45° | Partagé | Grok préserve mieux le visage, ChatGPT préserve mieux les vêtements |
| Trois retouches précises | ChatGPT | Le verre ajouté par Grok avait des reflets incohérents, avec un effet « collé » discret mais visible |
| Fusionner 3 références | ChatGPT, nettement | Aquarelle demandée, photo rendue par Grok. Se tromper de technique est éliminatoire |
Nos deux tests, en images
Sur des consignes purement esthétiques, l’écart annoncé par les classements ne se voit pas. Nous avons soumis aux deux outils exactement la même consigne, le 12 août 2026, sans retouche et sans relancer pour obtenir un meilleur résultat. Voici les quatre images, telles quelles.
Test 1 : une scène anime au coucher du soleil
Consigne envoyée aux deux outils
a beautiful sunset, with 3 brothers who are chilling on a little cloud. anime style


Les deux respectent la consigne : trois personnages, un petit nuage, un coucher de soleil, un style anime. Le choix de mise en scène diffère nettement. Grok cadre les trois frères de face, visages visibles, avec des vêtements détaillés et un ciel violet piqué d’étoiles. ChatGPT les place de dos, épaule contre épaule, dans une lumière orangée beaucoup plus chaude.
Aucun des deux ne se trompe, et départager relève du goût personnel. Notez tout de même que Grok a livré un format portrait quand ChatGPT a rendu un carré, alors que rien n’était précisé. Si le format compte pour vous, demandez-le explicitement.
Test 2 : une photo sous-marine réaliste
Consigne envoyée aux deux outils (extrait)
Photorealistic cinematic underwater scene featuring a swimmer enjoying a peaceful moment in a crystal-clear swimming pool. The swimmer has medium-length brown hair that naturally floats… A small friendly pet cat is playfully approaching from above, entering the water near the surface… realistic reflections and caustic light patterns, subtle suspended particles, authentic bubbles, cinematic depth of field…
La consigne se terminait par trois exigences explicites : no suggestive elements, no dramatic posing, no emphasis on the body. Elle ne précisait à aucun moment le genre du nageur.


Ce test est plus instructif que le premier, car la consigne contenait des contraintes vérifiables. Les deux outils réussissent l’essentiel : eau crédible, bulles cohérentes, réseaux de lumière au fond du bassin, chat qui entre dans l’eau par le haut, expression joyeuse. La physique de l’eau tient debout des deux côtés.
Deux différences méritent l’attention. D’abord, la consigne ne précisait aucun genre : Grok a produit une femme, ChatGPT un homme. C’est un bon rappel que ces modèles comblent les silences d’une consigne par leurs propres habitudes, et que le seul moyen de contrôler ce point est de l’écrire noir sur blanc.
Ensuite, sur l’instruction « ne pas mettre le corps en avant », ChatGPT est plus fidèle : il cadre serré sur le visage, en selfie, et le corps reste secondaire. Grok choisit un plan plus large qui expose davantage la silhouette. Sur ce point précis, qui relève du respect de la consigne et non du goût, ChatGPT applique mieux la demande.
Sur le rendu photographique en revanche, notre test nuance les classements. Le cliché de ChatGPT évoque davantage une vraie photo prise au caisson étanche, avec des reflets lumineux sur l’épaule et un grain crédible, là où l’image de Grok paraît un peu plus lissée. C’est l’inverse de ce que rapporte le test en six épreuves, qui donnait l’avantage à Grok sur la peau. Deux images ne font pas une statistique : retenez surtout que l’écart dépend beaucoup du sujet.
Une réserve honnête : un compte gratuit ne donne pas forcément accès au mode Quality, celui qui fait tourner Image 2.0. Nos images Grok sont donc représentatives de ce qu’obtient un utilisateur sans abonnement, ce qui est précisément le cas de la majorité des lecteurs, mais elles ne prouvent pas à elles seules le niveau maximal du nouveau modèle.
Reste la question la plus concrète : combien d’images pouvez-vous générer chez chacun, et à partir de quand faut-il payer ?
Combien d’images pouvez-vous générer gratuitement ?
Grok Imagine est le plus généreux des deux en gratuit : quatre images par jour, contre deux à trois chez ChatGPT. Nous l’avons vérifié sur un compte gratuit le 12 août 2026, sans le moindre abonnement.
Le fonctionnement de Grok mérite une explication, car l’application ne l’affiche nulle part clairement. Vous disposez de deux consignes par jour, et chaque consigne produit deux images différentes. Vous repartez donc avec quatre images quotidiennes, mais seulement deux idées. La nuance compte : si votre première consigne est mal formulée, vous avez consommé la moitié de votre journée. Chez ChatGPT, chaque demande donne une image, ce qui laisse deux à trois tentatives réellement indépendantes.
⚠️ Méfiez-vous des informations périmées : beaucoup d’articles en ligne affirment encore qu’un compte Grok gratuit ne peut plus générer aucune image depuis mars 2026. Ce n’est plus exact. Les images que vous verrez plus bas ont été produites sans aucun abonnement. Les quotas de Grok ont changé plusieurs fois cette année, alors vérifiez toujours sur votre propre compte plutôt que de vous fier à un comparatif daté.
| Grok Imagine 2.0 | ChatGPT Image 2 | |
|---|---|---|
| En gratuit | ✅ 2 consignes par jour, soit 4 images | ✅ 2 à 3 images par 24 h |
| Volume sur offre payante | ❌ Aucun chiffre publié par xAI | ✅ Étendu dès l’offre Plus |
| Entrée payante la moins chère | SuperGrok Lite, environ 10 $ par mois | ChatGPT Go, environ 8 € par mois |
| Offre confortable | SuperGrok, environ 30 $ par mois | ChatGPT Plus, environ 23 € par mois |
| Accès par API | Annoncée, tarif non publié | ✅ Disponible et tarifée |
| Disponibilité en France | Variable selon les comptes | ✅ Sans particularité |
Bon à savoir : les tarifs Grok sont affichés en dollars et l’accès à Imagine dépend du forfait X ou SuperGrok que vous détenez déjà. Plusieurs utilisateurs français rapportent voir ou non l’onglet Imagine selon leur compte. Vérifiez sur le vôtre avant de souscrire quoi que ce soit.
Faut-il vraiment payer pour générer plus d’images ?
Pour la quasi-totalité des usages, non. L’offre ChatGPT Plus, autour de 24 € par mois, inclut déjà la génération d’images rapide et performante : c’est écrit noir sur blanc sur la facture, au milieu des autres fonctions. Vous n’avez donc pas besoin d’un forfait plus cher pour créer des visuels au quotidien.
Si votre question est « lequel des deux éditeurs autorise le plus gros volume », la vraie différence tient en un mot : la clarté. OpenAI est le seul à écrire ses limites. Sur ses offres payantes, la génération d’images va de « étendue » à « illimitée » selon le forfait, dans la limite d’un usage raisonnable. xAI, de son côté, ne publie aucun quota, pour aucune de ses offres. Les chiffres qui circulent (50, 200 ou 600 images par jour selon les sites) sont des estimations d’utilisateurs, jamais confirmées, et nous refusons de les présenter comme des faits.
| Sur une offre payante | ChatGPT | Grok |
|---|---|---|
| Volume d’images annoncé | Étendu dès Plus, illimité au-dessus | Aucun chiffre publié |
| Source de l’info | Page tarifaire officielle | Estimations d’utilisateurs |
| Entrée payante | Plus, environ 24 € par mois | SuperGrok, environ 30 $ par mois |
| Risque de blocage surprise | Faible, règles écrites | Inconnu, donc à surveiller |
Notre conseil est donc simple. Un abonnement ChatGPT Plus couvre la quasi-totalité des besoins, images comprises, avec des dizaines de créations par jour et aucune mauvaise surprise. Ne visez un forfait plus cher que si vous produisez réellement des dizaines d’images chaque jour pour votre activité. Côté Grok, tant que xAI garde ses quotas secrets, testez d’abord en gratuit avant d’engager le moindre euro.
Ce que chacun fait le mieux
Aucun des deux n’est meilleur partout. Voici la répartition qui ressort des tests.
| Vous voulez… | Le meilleur choix |
|---|---|
| Du texte lisible et juste dans l’image (affiche, packaging, infographie) | ChatGPT Image 2 |
| Respecter une consigne compliquée à la lettre | ChatGPT Image 2 |
| Garder le même personnage d’une image à l’autre | ChatGPT Image 2 |
| Un vrai fond transparent exploitable | ChatGPT Image 2 |
| Un portrait photoréaliste, peau et mains crédibles | Grok Imagine 2.0 |
| Retoucher une zone au pinceau sans tout refaire | Grok Imagine 2.0 |
| Composer à partir de plusieurs photos de référence | Grok Imagine 2.0 |
| Décliner un visuel validé en neuf formats | Grok Imagine 2.0 |
Où voir les résultats vous-même
Ne nous croyez pas sur parole, les images sont en ligne. Voici les cinq endroits où juger sur pièces, du plus rigoureux au plus spectaculaire.
- Le test en six épreuves, images côte à côte : le comparatif d’Atlas Cloud. C’est le plus honnête méthodologiquement, avec une seule génération par consigne.
- Le test en quinze ateliers : Kingy, avec Nano Banana 2 en troisième larron. Utile pour situer Google dans l’histoire.
- Les exemples officiels de xAI : la page d’annonce d’Imagine Image 2.0. Ce sont des images choisies par l’éditeur, à regarder avec le recul qui s’impose.
- Les démonstrations en vidéo : « Grok Imagine Image 2.0 New Editing Tools Are Insane » montre le pinceau magique et le redimensionnement en action, et « Grok Image Imagine 2.0 Is ABSURDLY Good » donne le point de vue enthousiaste. Regardez les deux, l’écart de ton est instructif.
- Le classement à l’aveugle : le tableau Arena de génération d’images. Vous pouvez y voter vous-même et découvrir après coup quel modèle vous avez préféré. C’est le meilleur exercice pour se faire une opinion sans se laisser influencer par une marque.
Les limites dont on parle peu
Trois zones d’ombre méritent d’être connues avant de bâtir un projet sur Grok Imagine 2.0.
Aucun chiffre officiel sur le texte. xAI met en avant une typographie plus nette, mais n’a publié ni taux d’exactitude, ni résolution native, ni test de référence sur les polices. Or c’est précisément le terrain où le test indépendant a relevé une erreur d’alphabet.
Le redimensionnement intelligent invente. Passer une image en neuf formats ne relève pas du recadrage : le modèle génère la matière manquante. Il faut donc relire chaque déclinaison, sous peine de découvrir un objet en trop ou un texte décalé.
Les retouches locales débordent, des deux côtés. Le test indépendant note que les deux modèles régénèrent parfois des pixels en dehors de la zone visée. Pour une correction au pixel près, un logiciel de retouche classique reste plus sûr.
Comment choisir en 4 questions
- Y a-t-il du texte dans votre image ? Si oui, prenez ChatGPT Image 2 sans hésiter. C’est l’écart le plus net des tests.
- Combien d’images vous faut-il par jour ? Jusqu’à quatre, restez en gratuit chez Grok. Au-delà, ChatGPT Plus à environ 24 € couvre la quasi-totalité des besoins ; inutile de viser plus cher tant que vous ne produisez pas des dizaines d’images par jour.
- Devez-vous retoucher une image existante zone par zone ? Le pinceau magique de Grok est son meilleur argument, et ChatGPT n’a pas d’équivalent aussi direct.
- S’agit-il d’un travail livré à un client ? Prévoyez une relecture humaine dans tous les cas, et vérifiez chaque caractère de texte présent dans l’image.
Notre avis
Grok Imagine 2.0 est une vraie mise à jour, mais l’enthousiasme des vidéos dépasse ce que montrent les tests. La montée à la deuxième place mondiale est méritée, l’édition au pinceau est excellente, et sur la peau et les mains il tient tête au leader. Ce sont des progrès concrets, pas du marketing. Bonne surprise au passage : son offre gratuite est plus généreuse que celle de ChatGPT, quatre images par jour contre deux ou trois.
Cela dit, ChatGPT Image 2 reste devant sur ce qui casse un visuel : le texte, le respect des consignes, la cohérence d’un personnage. Une belle peau ne sauve pas une affiche dont le titre comporte une faute. Et sur le test indépendant le plus rigoureux publié à ce jour, il gagne largement.
À votre place, voici ce que nous ferions. Si vous ne payez rien aujourd’hui, utilisez les deux le même jour : quatre images chez Grok, deux ou trois chez ChatGPT, cela fait sept visuels quotidiens sans sortir un centime, et vous comparez sur vos propres sujets. Si vous devez choisir un seul abonnement, prenez ChatGPT Plus à environ 23 € : c’est le meilleur rapport entre la qualité, le volume et la clarté des règles. Si vous produisez des visuels pour votre activité, la vraie réponse reste d’avoir les deux, ChatGPT pour tout ce qui porte du texte, Grok pour retoucher une zone et décliner les formats.
Notre réserve principale ne porte pas sur la qualité mais sur la transparence. Tant que xAI ne publie ni ses quotas d’images, ni sa résolution native, ni ses chiffres de précision sur le texte, il faut le croire sur parole. Ce n’est pas notre méthode, et c’est ce qui, à nos yeux, empêche encore Grok Imagine de passer devant.
En résumé
ChatGPT Image 2 garde la couronne sur le texte, le respect des consignes et la cohérence, et ses offres payantes sont les seules à afficher clairement leurs limites. Grok Imagine 2.0 s’installe solidement en deuxième position, avec les meilleurs outils d’édition du moment et, contre toute attente, l’offre gratuite la plus généreuse des deux. Le bon réflexe n’est pas de choisir un camp mais d’ouvrir les deux, puisque tester ne coûte rien.
Sources
- xAI, annonce officielle de Grok Imagine Image 2.0 (7 août 2026)
- OpenAI, présentation de ChatGPT Images 2.0
- OpenAI, page tarifaire officielle (détail des offres et de la génération d’images incluse)
- Nos propres générations réalisées le 12 août 2026 sur un compte Grok gratuit et sur ChatGPT, consignes reproduites dans l’article
- Atlas Cloud, comparatif en six épreuves sans sélection d’images
- Kingy, comparatif en quinze ateliers avec notation à l’aveugle
- Omniart, analyse critique de ce que contient réellement Image 2.0
- Arena, classement de génération d’images par vote humain