88API88API
User GuideAI ApplicationsAPI ReferenceHelp & Support
Image

Format d'image OpenAI (Image)

Documentation officielle

📝Présentation

Étant donné une invite de texte et/ou une image d'entrée, le modèle générera de nouvelles images. OpenAI fournit plusieurs modèles de génération d'images puissants qui peuvent créer, éditer et modifier des images basées sur des descriptions en langage naturel. Les modèles actuellement pris en charge incluent:

ModèleDescriptif
Série DALL·EComprend les versions DALL·E 2 et DALL·E 3, qui présentent des différences significatives en termes de qualité d'image, d'expression créative et de précision
GPT-Image-1Le dernier modèle d'image d'OpenAI, prenant en charge les capacités d'édition multi-images, capable de créer de nouvelles images composites basées sur plusieurs images d'entrée

💡 Exemples de requêtes

Créer une image ✅

# Basic image generation
curl https://88api.ai/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "dall-e-3",
    "prompt": "A cute little sea otter",
    "n": 1,
    "size": "1024x1024"
  }'

# High-quality image generation
curl https://88api.ai/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "dall-e-3",
    "prompt": "A cute little sea otter",
    "quality": "hd",
    "style": "vivid",
    "size": "1024x1024"
  }'

# Using base64 response format
curl https://88api.ai/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "dall-e-3",
    "prompt": "A cute little sea otter",
    "response_format": "b64_json"
  }'

Response Example:

{
  "created": 1589478378,
  "data": [
    {
      "url": "https://...",
      "revised_prompt": "A cute little sea otter playing in the water, with round eyes and fluffy fur"
    }
  ]
}

Modifier l'image ✅

# dall-e-2 image editing
curl https://88api.ai/v1/images/edits \
  -H "Authorization: Bearer $API_KEY" \
  -F image="@otter.png" \
  -F mask="@mask.png" \
  -F prompt="A cute little sea otter wearing a beret" \
  -F n=2 \
  -F size="1024x1024"

# gpt-image-1 multi-image editing example
curl https://88api.ai/v1/images/edits \
  -H "Authorization: Bearer $API_KEY" \
  -F "model=gpt-image-1" \
  -F "image[]=@body-lotion.png" \
  -F "image[]=@bath-bomb.png" \
  -F "image[]=@incense-kit.png" \
  -F "image[]=@soap.png" \
  -F "prompt=Create an elegant gift basket containing these four items" \
  -F "quality=high"

Response Example (dall-e-2):

{
  "created": 1589478378,
  "data": [
    {
      "url": "https://..."
    },
    {
      "url": "https://..."
    }
  ]
}

Response Example (gpt-image-1):

{
  "created": 1713833628,
  "data": [
    {
      "b64_json": "..."
    }
  ],
  "usage": {
    "total_tokens": 100,
    "input_tokens": 50,
    "output_tokens": 50,
    "input_tokens_details": {
      "text_tokens": 10,
      "image_tokens": 40
    }
  }
}

Générer des variations d'image ✅

curl https://88api.ai/v1/images/variations \
  -H "Authorization: Bearer $API_KEY" \
  -F image="@otter.png" \
  -F n=2 \
  -F size="1024x1024"

Response Example:

{
  "created": 1589478378,
  "data": [
    {
      "url": "https://..."
    },
    {
      "url": "https://..."
    }
  ]
}

📮 Demande

Points de terminaison

Créer une image

POST /v1/images/generations

Créez des images basées sur des invites textuelles.

Modifier l'image

POST /v1/images/edits

Créez des images modifiées ou étendues basées sur une ou plusieurs images et invites originales. Ce point de terminaison prend en charge les modèles dall-e-2 et gpt-image-1.

Générer des variantes

POST /v1/images/variations

Créez des variations d'une image donnée.

Méthode d'authentification

Incluez les éléments suivants dans l'en-tête de la demande pour l'authentification par clé API:

Authorization: Bearer $API_KEY

$API_KEY est votre clé API.

Paramètres du corps de la requête

Créer une image

prompt
  • Type : Chaîne
  • Obligatoire : Oui
  • Description: Description textuelle de l'image souhaitée à générer.
  • la longueur maximale de dall-e-2 est de 1 000 caractères
  • la longueur maximale du dall-e-3 est de 4 000 caractères
  • Conseils:
  • Utiliser des descriptions spécifiques et détaillées
  • Inclure des éléments visuels clés
  • Préciser le style artistique attendu
  • Décrire la composition et la perspective
model
  • Type : Chaîne
  • Obligatoire: Non
  • Par défaut: dall-e-2
  • Description : Modèle utilisé pour la génération d'images.
n
  • Type: Entier ou nul
  • Obligatoire: Non
  • Par défaut : 1
  • Description : Nombre d'images à générer. Doit être compris entre 1 et 10. dall-e-3 ne prend en charge que n=1.
quality
  • Type : Chaîne
  • Obligatoire: Non
  • Par défaut : standard
  • Description : Qualité de l'image générée. L'option hd générera des images plus détaillées et cohérentes. Seul Dall-e-3 prend en charge ce paramètre.
response_format
  • Type: chaîne ou null
  • Obligatoire: Non
  • Par défaut: url
  • Description : Format de l'image générée à retourner. Doit être url ou b64_json. L'URL est valide pendant 60 minutes après la génération.
size
  • Type: chaîne ou null
  • Obligatoire: Non
  • Par défaut : 1024x1024
  • Description : Taille de l'image générée. dall-e-2 doit être l'un des formats 256x256, 512x512 ou 1024x1024. dall-e-3 doit être l'un des formats 1024x1024, 1792x1024 ou 1024x1792.
style
  • Type: chaîne ou null
  • Obligatoire: Non
  • Par défaut: vif
  • Description : Style de l'image générée. Doit être vif ou naturel. Vivid a tendance à générer des images surréalistes et dramatiques, tandis que Natural a tendance à générer des images plus naturelles et moins surréalistes. Seul Dall-e-3 prend en charge ce paramètre.
user
  • Type : Chaîne
  • Obligatoire: Non
  • Description: identifiant unique de l'utilisateur final, qui peut aider OpenAI à surveiller et à détecter les abus.

Modifier l'image

image
  • Type: Fichier ou tableau de fichiers
  • Obligatoire : Oui
  • Description : Image à modifier.
  • Pour dall-e-2: Il doit s'agir d'un fichier PNG valide, de moins de 4 Mo, et carré. Si aucun masque n'est fourni, l'image doit avoir une transparence, qui servira de masque.
  • Pour gpt-image-1: plusieurs images peuvent être fournies sous forme de tableau, chaque image doit être un fichier PNG, WEBP ou JPG de moins de 25 Mo.
prompt
  • Type : Chaîne
  • Obligatoire : Oui
  • Description: Description textuelle de l'image souhaitée à générer.
  • la longueur maximale de dall-e-2 est de 1 000 caractères
  • La longueur maximale de gpt-image-1 est de 32 000 caractères
mask
  • Type : Fichier
  • Obligatoire: Non
  • Description: Image supplémentaire dont les zones entièrement transparentes (par exemple les zones avec un zéro alpha) indiquent les positions à modifier. Si plusieurs images sont fournies, le masque sera appliqué à la première image. Il doit s'agir d'un fichier PNG valide, de moins de 4 Mo et de la même taille que l'image.
model
  • Type : Chaîne
  • Obligatoire: Non
  • Par défaut: dall-e-2
  • Description : Modèle utilisé pour la génération d'images. Prend en charge dall-e-2 et gpt-image-1. Si les paramètres spécifiques à gpt-image-1 ne sont pas utilisés, la valeur par défaut est dall-e-2.
quality
  • Type: chaîne ou null
  • Obligatoire: Non
  • Par défaut: auto
  • Description : Qualité de l'image générée.
  • gpt-image-1 prend en charge les niveaux élevé, moyen et faible
  • dall-e-2 ne prend en charge que le standard
  • Par défaut, auto
size
  • Type: chaîne ou null
  • Obligatoire: Non
  • Par défaut : 1024x1024
  • Description : Taille de l'image générée.
  • gpt-image-1 doit être l'un des formats 1024x1024, 1536x1024 (horizontal), 1024x1536 (vertical) ou auto (par défaut)
  • dall-e-2 doit être l'un des formats 256x256, 512x512 ou 1024x1024

Les autres paramètres sont les mêmes que ceux de l'interface Créer une image.

Générer des variantes

image
  • Type : Fichier
  • Obligatoire : Oui
  • Description : Image à utiliser comme base pour les variations. Il doit s'agir d'un fichier PNG valide, de moins de 4 Mo et carré.

Les autres paramètres sont les mêmes que ceux de l'interface Créer une image.

📥 Réponse

Réponse réussie

Les trois points de terminaison renvoient une réponse contenant une liste d’objets image.

created

  • Type : Entier
  • Description : Horodatage de la création de la réponse

data

  • Type : Tableau
  • Description : Liste des objets image générés

usage (uniquement pour gpt-image-1)

  • Type : Objet
  • Description: Utilisation du jeton pour l'appel API
  • total_tokens: Total de jetons utilisés
  • input_tokens: jetons utilisés pour la saisie
  • output_tokens: Tokens utilisés pour la sortie
  • input_tokens_details: informations détaillées sur les jetons d'entrée (jetons de texte et jetons d'image)

Objet image

b64_json

  • Type : Chaîne
  • Description: Si Response_format est b64_json, il contient le JSON encodé en base64 de l'image générée.

url

  • Type : Chaîne
  • Description : Si réponse_format est url (par défaut), il contient l'URL de l'image générée

revised_prompt

  • Type : Chaîne
  • Description: si l'invite a été modifiée, elle contient l'invite modifiée utilisée pour la génération d'images.

Exemple d'objet image:

{
  "url": "https://...",
  "revised_prompt": "A cute little sea otter playing in the water, with round eyes and fluffy fur"
}

🌟 Bonnes pratiques

Conseils d'écriture rapides

  1. Utilisez des descriptions claires et spécifiques
  2. Spécifiez les détails visuels importants
  3. Décrire le style et l'atmosphère artistiques attendus
  4. Faites attention aux instructions de composition et de perspective

Conseils pour la sélection des paramètres

  1. Sélection du modèle
  • dall-e-3: Convient aux scènes nécessitant une haute qualité et des détails précis
  • dall-e-2: convient aux prototypes rapides ou à la génération d'images simples
  1. Sélection de la taille
  • 1024x1024: Meilleur choix de scène générale
  • 1792x1024/1024x1792 : Convient aux scènes horizontales/verticales
  • Tailles plus petites: convient aux vignettes ou aux aperçus rapides
  1. Qualité et style
  • quality=hd : Pour les images nécessitant des détails fins
  • style=vivid : Convient aux effets créatifs et artistiques
  • style=natural : Convient pour une reproduction réaliste de scènes

Questions courantes

  1. La génération d'images a échoué
  • Vérifiez si l'invite est conforme aux politiques de contenu
  • Confirmer le format de fichier et les limites de taille
  • Vérifier les autorisations de la clé API
  1. Les résultats ne correspondent pas aux attentes
  • Optimiser la description rapide
  • Ajuster les paramètres de qualité et de style
  • Pensez à utiliser les fonctionnalités d'édition ou de variation d'images