Présentation de la mise à jour 2.5
OpenAI a lancé ChatGPT Images 2.5, évolution de la version 2.0 annoncée en avril. La nouvelle itération promet des rendus visuels avec un éclairage plus naturel et des textures plus riches, tout en réduisant le temps de calcul. Selon le communiqué, le service crée des images jusqu’à 50 % plus rapidement, ce qui se traduit par une latence perceptible réduite pour les utilisateurs sur desktop, mobile et web.
Architecture et variantes de modèle
Deux variantes sont proposées : GPT‑Image‑2.5 Flare et GPT‑Image‑2.5 Sunburst. Flare, modèle par défaut, génère des images entre deux et quatre fois plus vite que le précédent GPT‑Image‑2, tout en supportant les fonds transparents, un atout pour les actifs de marque. Sunburst, à l’inverse, sacrifie une partie de la vitesse afin d’accroître la fidélité des détails, ciblant les professionnels qui exigent une précision pixel‑par‑pixel, notamment pour les photos produits.
Fonctionnalités d'édition et de préservation des détails
La mise à jour introduit le mode Sketch, qui accepte un dessin à la main comme point de départ. L’utilisateur trace une composition grossière sur l’écran tactile, puis le modèle affine le rendu en respectant la structure esquissée. Cette approche bénéficie aux stylets comme l’Apple Pencil, où la saisie directe était auparavant peu fiable. En outre, ChatGPT Images 2.5 conserve les traits distinctifs d’un sujet (par exemple, les caractéristiques faciales) à travers plusieurs tours de conversation, évitant la dégradation observée avec la version 2.0 lors d’éditions ciblées. Les nouvelles fonctions de commentaires en ligne permettent de spécifier des zones à modifier, tandis que les modèles de gabarits (flyers, photos produit) accélèrent la création de formats récurrents.
Sécurité, métadonnées et accès développeur
OpenAI a intégré des garde‑fous sur les invites et les sorties afin de bloquer la génération de contenu nuisible. Chaque image porte des métadonnées C2PA et un filigrane invisible, facilitant l’identification de l’origine et limitant les risques de deepfake ou de réutilisation non autorisée. Les deux variantes de modèle sont exposées via des API distinctes, disponibles pour les développeurs sur les plateformes ChatGPT, ChatGPT Work et Codex. Cette exposition permet d’intégrer la génération d’images 2.5 dans des flux de travail automatisés tout en conservant les contrôles de sécurité décrits.