Axiris

GPT Image

Génération et édition d'image avec OpenAI

GPT Image désigne la famille de modèles d'OpenAI destinée à la génération et à l'édition d'images.

Ces modèles peuvent utiliser du texte et des images comme contexte afin de créer ou modifier un visuel.

Du prompt à la conversation visuelle

L'intérêt d'un modèle multimodal ne se limite pas à produire une image à partir d'une phrase.

Il permet de construire un processus itératif :

générer → observer → demander une modification → conserver → corriger

Cette logique est proche du fonctionnement recherché dans un workflow de direction artistique.

Références visuelles

Des images peuvent également servir d'entrée au modèle afin de fournir davantage de contexte.

Cela permet de travailler à partir :

  • d'une photographie ;
  • d'un concept ;
  • d'une composition ;
  • d'éléments graphiques ;
  • de références existantes.

GPT Image dans un pipeline

Selon le projet, GPT Image peut constituer une étape parmi plusieurs.

Une production peut ensuite être reprise dans Photoshop, ComfyUI ou d'autres outils de création et de finition.

Le moteur ne remplace pas le workflow.

Sources officielles