8news

Tech • IA • Robotique

VIDÉO
ENFR
Aujourd'huiShortsÀ la unePour vousTopicsToutes les vidéosChaînes YTArchivesRechercheFavoris

ChatGPT Image 2.5 vient de sortir (analyse complète)

5/10
IABrock Mesarich | AI for Non Techies9 septembre 2026 à 01:139:43
Lecteur audio
0:00 / 0:00

INTRO

OpenAI a lancé GPT Image 2.5, en ajoutant la création d’images dans le chat, le prompting à partir d’esquisses et une meilleure cohérence lors des retouches en plusieurs étapes, avec de premiers essais comparatifs suggérant une qualité visuelle supérieure à Gemini Nano Banana Pro, mais une génération plus lente.

POINTS CLÉS

Nouveaux points d’accès et variantes du modèle

GPT Image 2.5 peut être utilisé dans l’interface web, l’application de bureau, les workflows développeur et via l’API. Deux variantes API ont été mises en avant: GPT Image 2.5 Flare pour une génération plus rapide et GPT Image 2.5 Sunburst pour un travail créatif plus détaillé avec des temps de rendu plus longs. Cette sortie étend la génération d’images au-delà d’une simple zone de prompt, vers un workflow plus large d’édition et de création d’assets.

Espace image dédié et modèles prêts à l’emploi

L’interface mise à jour comprend une section Images avec des modèles et des prompts tendance, en plus de la génération classique dans le chat. Cela marque un virage vers une création visuelle plus structurée, où les utilisateurs peuvent partir de formats prédéfinis ou passer directement à des demandes personnalisées pour des assets, illustrations et éléments de design.

Génération d’image à partir d’esquisses

Un nouvel outil sketch permet aux utilisateurs de dessiner directement avec une souris ou le doigt, puis de transformer des formes grossières en images finalisées. Lors d’un test, un dessin sommaire de coucher de soleil avec collines et ciel a d’abord été converti en scène de style cartoon, puis, après une demande de suivi, en paysage plus réaliste. Le résultat suggère une meilleure interprétation d’entrées visuelles de faible qualité et un affinage plus fluide via prompt.

Contrôles d’édition intégrés

Les images peuvent désormais être modifiées via un ensemble d’outils visuels incluant des commentaires sur des zones sélectionnées, l’effacement d’éléments, la suppression de l’arrière-plan, le redimensionnement et l’annotation. Un test simple a supprimé des nuages d’une zone entourée dans un paysage généré tout en préservant le reste de la composition, montrant un workflow d’inpainting plus direct et accessible.

Accent sur la cohérence sur plusieurs tours

L’amélioration centrale concerne la cohérence d’édition sur plusieurs tours. Les anciens modèles d’image s’éloignaient souvent du sujet ou de la composition d’origine après plusieurs révisions, mais GPT Image 2.5 est conçu pour conserver les modifications précédentes sur des chaînes d’édition plus longues sans dégradation visible de la qualité. C’est important pour l’itération répétée d’assets, surtout dans des pipelines de production automatisés ou à base d’agents.

Stabilité sur de longues séquences d’images

Dans un benchmark partagé pour le lancement, une séquence de 150 images générées a montré la différence entre l’ancien et le nouveau comportement. L’ancien modèle produisait une dérive de mouvement notable dans une animation de cube, tandis que GPT Image 2.5 restait bien plus proche de la pose attendue, donnant un résultat plus fluide. Un second exemple avec des bougies s’allumant une par une montrait très peu de changements indésirables d’une image à l’autre.

Comparaison avec Gemini Nano Banana Pro sur les miniatures

Dans des tests côte à côte face à Gemini Nano Banana Pro, GPT Image 2.5 a été jugé meilleur pour des images de type miniature. Lorsqu’on lui demandait d’améliorer une miniature existante, il produisait un résultat avec des couleurs plus vives, un éclairage plus fort et un rendu global plus soigné. Avec le même prompt sur les deux systèmes, le nouveau modèle d’OpenAI semblait aussi produire une texture de peau plus convaincante et une apparence moins synthétique, même si certains indices typiques d’images IA restaient visibles.

Meilleur respect des prompts pour un rendu de type infographie

Une seconde comparaison portait sur une infographie réaliste avec des monuments et du texte informatif. GPT Image 2.5 aurait suivi les instructions de plus près, en produisant un résultat au réalisme plus clair et avec des détails de monuments plus complets que la version Nano Banana Pro. Dans ce test, la sortie d’OpenAI a été notée à environ 8/10 contre 6/10 pour le modèle concurrent.

Le gain en qualité s’accompagne d’un compromis sur la vitesse

Malgré des annonces de performances plus rapides par rapport à l’ancien modèle GPT Image, la comparaison en conditions réelles suggérait que Nano Banana Pro restait plus rapide sur certains essais côte à côte. En pratique, GPT Image 2.5 semble améliorer la qualité et la cohérence, mais les utilisateurs devront parfois accepter un délai plus long pour certaines générations.

CONCLUSION

GPT Image 2.5 semble être une amélioration significative en matière de fiabilité d’édition, de respect des prompts et de finition visuelle, plutôt qu’une rupture totale avec les précédents modèles d’image. Sa plus grande valeur pourrait se situer dans les workflows qui dépendent de révisions répétées sans perdre la cohérence du sujet.

Explique-moi
Transcription complète

Sur le même sujet : IA