
Tech • IA • Robotique
OpenAI a commencé à déployer ChatGPT Images 2.5, avec l’ajout du prompting par croquis, une génération d’images plus rapide, des outils d’édition d’image plus puissants, une meilleure cohérence avec les photos de référence et de nouveaux modèles créatifs.
ChatGPT Images 2.5 est en cours de déploiement sur l’application web, avec des indices comme une étiquette Images mise à jour et l’apparition de nouveaux modèles tels que logos. La sortie semble viser une large disponibilité, y compris au-delà des offres premium.
Un nouvel outil Sketch permet aux utilisateurs de dessiner des mises en page sommaires avant de décrire une image en texte. Même des formes très simples peuvent être transformées en scènes cohérentes, comme un salon avec un canapé, de grandes fenêtres, une télévision murale et un chien. La fonctionnalité vise à convertir la composition, le placement des objets et l’intention générale en une image aboutie, sans exiger de savoir dessiner.
L’un des changements les plus visibles est la vitesse de génération. Les images semblent se rendre plus rapidement que dans les versions précédentes, rendant l’usage itératif plus pratique pour le design occasionnel, les maquettes conceptuelles et les retouches successives.
La mise à jour étend l’édition dans l’image avec des outils d’annotation permettant d’entourer une zone et de demander des modifications, comme ajouter un chat dans une scène de pièce. Elle prend aussi en charge plusieurs commentaires en un seul passage, ce qui permet plusieurs retouches à la fois, notamment des changements de couleur de mur, des ajouts extérieurs comme un arc-en-ciel, ou des modifications d’objets comme changer une plante.
Les résultats montrent une meilleure précision que les outils précédents, sans être parfaits dans le ciblage des objets. Lors d’un test, une demande visant à rendre une plante précise morte a modifié une autre plante à la place. Cela suggère que le modèle gère mieux les retouches localisées, mais peut encore mal interpréter les scènes chargées ou les objets qui se chevauchent.
Une option erase permet de surligner des objets à supprimer au lieu d’effacer manuellement des pixels. Le système reconstruit ensuite la scène intelligemment. Un background remover est aussi inclus et fonctionne mieux lorsque le sujet est clairement séparé de l’arrière-plan, comme pour un portrait, tandis que des intérieurs plus complexes peuvent donner des résultats plus faibles.
OpenAI affirme que le nouveau modèle est plus performant pour transformer des images importées tout en préservant l’identité et la structure. Parmi les exemples: convertir des portraits en variantes stylisées et fusionner des photos séparées en une seule composition. Lors d’un test, une ancienne photo d’enfance a été nettoyée, les reflets supprimés, et le sujet placé dans un costume tout en conservant de très près son apparence d’origine.
Le modèle peut aussi servir à la planification visuelle. Une photo de jardin arrière a été transformée en version avec un rock garden, produisant une image conceptuelle crédible qui pourrait être affinée. Cela suggère des usages en aménagement paysager, en aperçu de rénovation et en idéation pour l’habitat.
De nouveaux modèles offrent des points de départ pour des rendus courants comme logos, posters, illustrations et interior design. Les résultats sont mitigés: certains modèles accélèrent le flux de travail, tandis que d’autres peuvent nécessiter des consignes de suivi pour correspondre aux attentes. Dans un test de design d’intérieur, le rendu initial n’a pas respecté le format voulu et a nécessité un prompt correctif.
L’une des améliorations les plus importantes est la cohérence à travers les modifications. En travaillant à partir de photos de deux chiens, le modèle a préservé leurs traits distinctifs au fil de plusieurs changements, notamment en les repositionnant pour qu’ils paraissent blottis ensemble sur une couverture, puis en retirant leurs harnais. Une cohérence similaire a été observée lors de retouches répétées d’un sujet humain, un domaine où beaucoup de modèles d’image se dégradent avec le temps.
ChatGPT Images 2.5 semble constituer une amélioration importante, centrée sur la vitesse, une édition plus simple et une meilleure préservation de l’identité. Son impact principal pourrait venir du fait qu’il rend la création d’images itérative plus pratique pour les utilisateurs du quotidien et pour des usages professionnels légers.
Explique-moi