OpenAI
BasicPro

GPT-4o

gpt-4o

Multimodal complet avec vision et génération d'images DALL-E 3 — le créateur visuel d'OpenAI.

Génération imageVision imageConversation

Spécifications techniques

Identifiant APIgpt-4o
ForfaitsBasic Pro
Contexte maximum128 000 tokens
Vision (images)✓ Oui
Génération d'image✓ DALL-E 3
Accès web natifNon
Coût entrée$2.50 / M tokens
Coût sortie$10.00 / M tokens

Présentation

GPT-4o est le modèle multimodal phare d'OpenAI, combinant vision et génération d'images via DALL-E 3. C'est le modèle de référence de Mingo pour toutes les requêtes impliquant la création visuelle. Il peut analyser des images et en générer de nouvelles dans la même conversation, offrant une expérience multimodale complète en Basic et Pro.


Forces

Génération DALL-E 3Vision avancéeMultimodal complet

Cas d'usage

Génération d'illustrations

Création d'images, logos, illustrations et visuels à partir de descriptions textuelles.

Analyse et création

Analyser une image existante puis en créer une variante ou une amélioration.

Contenu visuel marketing

Production de visuels pour réseaux sociaux, présentations et supports marketing.

Tarification

Tokens d'entrée
$2.50
par million de tokens
Tokens de sortie
$10.00
par million de tokens

Questions fréquentes

Quelle est la qualité des images générées par GPT-4o ?
GPT-4o utilise DALL-E 3, le générateur d'images le plus avancé d'OpenAI, produisant des images haute qualité avec une bonne compréhension des instructions complexes.
Peut-on utiliser GPT-4o pour analyser ET créer des images dans la même session ?
Oui, GPT-4o est entièrement multimodal : il peut analyser une image transmise, puis générer une nouvelle image basée sur l'analyse, dans une seule conversation.

Créer des images avec GPT-4o sur Mingo

Disponible en Basic et Pro — générez des images DALL-E 3 directement dans votre conversation.

Essayer Mingo