---
Résumé en langage simple
OpenAI a récemment mis à jour son outil de création d'images par intelligence artificielle, GPT Image 2.5, tôt le matin. Cette mise à jour ne comporte aucune technologie révolutionnaire ; elle se concentre entièrement sur le problème majeur que les utilisateurs déploraient auparavant : la modification des images. Auparavant, lorsque les utilisateurs créaient des images avec l'IA, ils risquaient de dégrader la qualité de l'image entière après quelques modifications. Le nouveau modèle résout la plupart de ces problèmes et augmente considérablement la vitesse de génération des images. Le plus important, c'est que le prix est resté le même que pour la version précédente.
Cependant, il est intéressant de noter que toutes les fonctionnalités clés de modification d'images ont déjà été développées par des entreprises telles que Google, Tencent (en Chine) et Tongyi Wanxiang il y a plus d'un an. OpenAI rattrape donc un retard. Mais avec des centaines de millions d'utilisateurs de ChatGPT, cette mise à jour abaisse considérablement le seuil d'utilisation de ces outils. Les gens ordinaires n'ont plus besoin de générer des dizaines d'images au hasard ; ils peuvent obtenir des résultats utilisables après seulement deux ou trois modifications, ce qui a un impact bien plus important qu'on ne le pense.
---
Analyse détaillée
1. Il s'agit pas d'une innovation, mais plutôt d'un remboursement d'une dette envers les utilisateurs
Beaucoup critiquent OpenAI en disant qu'il a « copié les autres avec un an de retard », mais ce n'est pas juste :
Que ce soit l'ancienne version de GPT ou d'autres produits similaires, la création d'images par IA reposait sur un modèle « une fois payé, une fois utilisé ». Si vous modifiiez l'image après avoir fourni une description écrite, tout dans l'image pouvait changer (les personnages, le fond, la composition, etc.), rendant les modifications inefficaces. Google avait déjà intégré la possibilité de modifier plusieurs éléments sans dégrader l'image il y a plus d'un an, et quatre mois plus tard, il a ajouté une interface permettant de sélectionner des zones spécifiques pour modification. D'autres entreprises chinoises offraient également des fonctionnalités de dessin et de modification avancées. OpenAI a maintenant intégré ces fonctionnalités éprouvées dans son propre système, ce qui représente plutôt un renforcement de ses capacités que l'ouverture d'un nouveau domaine.
2. Une véritable amélioration : la modification des images ne dégrade plus l'image entière
L'augmentation de la praticité est réelle. Deux fonctionnalités majeures ciblent les problèmes des utilisateurs :
- Modification ciblée : vous pouvez modifier un élément spécifique de l'image sans affecter le reste. Par exemple, si vous voulez changer deux mots dans le texte d'un produit sur une affiche, le fond, le logo de la marque ou l'apparence du produit ne seront pas modifiés. Auparavant, de petites modifications pouvaient entraîner de graves perturbations dans l'image.
- Qualité de l'image stable : après plusieurs modifications, la qualité de l'image ne se détériorerait pas. Vous pouvez créer un brouillon, modifier la couleur des vêtements des personnages, le fond, etc., et même après dix modifications, les ajustements précédents resteront intacts.
OpenAI a également divisé son modèle en deux versions : l'une axée sur la vitesse (presque instantanée) et l'autre sur la qualité de l'image, adaptée aux utilisateurs professionnels (publicités, photos de produits). Les frais pour ces deux versions sont les mêmes que pour la version précédente, ce qui équivaut à une mise à niveau gratuite pour tous les anciens utilisateurs. Les tests montrent que les capacités de modification avancées de ce nouveau modèle ont été améliorées de plus de 80 %. De nombreux utilisateurs constatent que cela leur permet de gagner des heures de travail, par exemple pour créer des animations ou des images transparentes.
3. Deux fonctionnalités discrètes pour transformer l'outil d'IA en outil de collaboration sociale
En plus des fonctionnalités de modification, OpenAI a ajouté deux petites fonctionnalités qui peuvent transformer l'outil d'IA en un outil de collaboration :
- Génération de brouillons : vous pouvez dessiner rapidement une esquisse sur l'écran, et l'IA créera une image complète à partir de celle-ci, sans avoir à réfléchir aux mots à utiliser.
- Partage avec des paramètres : vous pouvez partager les paramètres utilisés pour générer l'image, permettant à d'autres utilisateurs de modifier l'image avec leurs propres photos et de créer des variations. Ces fonctionnalités existent déjà chez d'autres entreprises, mais avec ChatGPT, des centaines de millions d'utilisateurs peuvent les utiliser directement sans avoir à installer de nouveaux applis, transformant ainsi l'outil d'IA en un outil de création collaborative.
4. Pas de miracle : la compétition dans le domaine de la création d'images par IA est encore loin d'être terminée
Bien que GPT Image 2.5 soit considéré comme très performant, ses défauts restent : certains problèmes (comme la difficulté de modifier précisément des éléments) n'ont pas encore été résolus, et les modèles d'IA peuvent parfois mal interpréter des instructions complexes. Pour les applications exigeantes (comme la création de photos de produits), les modèles de Google sont encore plus fiables. Cependant, cette mise à jour marque un changement dans la compétition : le focus est maintenant sur l'expérience utilisateur, c'est-à-dire sur la facilité d'utilisation des outils dans le quotidien des professionnels. Celui qui proposera le meilleur outil pour faciliter la modification des images gagnera plus d'utilisateurs payants. Même si OpenAI a utilisé des fonctionnalités déjà existantes, il offre désormais à des millions d'utilisateurs la possibilité de modifier facilement des images, ce qui augmentera certainement leur fréquence d'utilisation.
---
En résumé, OpenAI a amélioré significativement l'outil GPT Image 2.5, en se concentrant sur les problèmes majeurs des utilisateurs et en intégrant des fonctionnalités éprouvées par d'autres entreprises. Cette mise à jour réduit considérablement les obstacles à l'utilisation de l'IA pour la création d'images, ce qui devrait entraîner une augmentation de son utilisation par le grand public.