Format d'image OpenAI (Image)
Documentation officielle
📝Présentation
Étant donné une invite de texte et/ou une image d'entrée, le modèle générera de nouvelles images. OpenAI fournit plusieurs modèles de génération d'images puissants qui peuvent créer, éditer et modifier des images basées sur des descriptions en langage naturel. Les modèles actuellement pris en charge incluent:
| Modèle | Descriptif |
|---|---|
| Série DALL·E | Comprend les versions DALL·E 2 et DALL·E 3, qui présentent des différences significatives en termes de qualité d'image, d'expression créative et de précision |
| GPT-Image-1 | Le dernier modèle d'image d'OpenAI, prenant en charge les capacités d'édition multi-images, capable de créer de nouvelles images composites basées sur plusieurs images d'entrée |
💡 Exemples de requêtes
Créer une image ✅
# Basic image generation
curl https://88api.ai/v1/images/generations \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_KEY" \
-d '{
"model": "dall-e-3",
"prompt": "A cute little sea otter",
"n": 1,
"size": "1024x1024"
}'
# High-quality image generation
curl https://88api.ai/v1/images/generations \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_KEY" \
-d '{
"model": "dall-e-3",
"prompt": "A cute little sea otter",
"quality": "hd",
"style": "vivid",
"size": "1024x1024"
}'
# Using base64 response format
curl https://88api.ai/v1/images/generations \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_KEY" \
-d '{
"model": "dall-e-3",
"prompt": "A cute little sea otter",
"response_format": "b64_json"
}'Response Example:
{
"created": 1589478378,
"data": [
{
"url": "https://...",
"revised_prompt": "A cute little sea otter playing in the water, with round eyes and fluffy fur"
}
]
}Modifier l'image ✅
# dall-e-2 image editing
curl https://88api.ai/v1/images/edits \
-H "Authorization: Bearer $API_KEY" \
-F image="@otter.png" \
-F mask="@mask.png" \
-F prompt="A cute little sea otter wearing a beret" \
-F n=2 \
-F size="1024x1024"
# gpt-image-1 multi-image editing example
curl https://88api.ai/v1/images/edits \
-H "Authorization: Bearer $API_KEY" \
-F "model=gpt-image-1" \
-F "image[]=@body-lotion.png" \
-F "image[]=@bath-bomb.png" \
-F "image[]=@incense-kit.png" \
-F "image[]=@soap.png" \
-F "prompt=Create an elegant gift basket containing these four items" \
-F "quality=high"Response Example (dall-e-2):
{
"created": 1589478378,
"data": [
{
"url": "https://..."
},
{
"url": "https://..."
}
]
}Response Example (gpt-image-1):
{
"created": 1713833628,
"data": [
{
"b64_json": "..."
}
],
"usage": {
"total_tokens": 100,
"input_tokens": 50,
"output_tokens": 50,
"input_tokens_details": {
"text_tokens": 10,
"image_tokens": 40
}
}
}Générer des variations d'image ✅
curl https://88api.ai/v1/images/variations \
-H "Authorization: Bearer $API_KEY" \
-F image="@otter.png" \
-F n=2 \
-F size="1024x1024"Response Example:
{
"created": 1589478378,
"data": [
{
"url": "https://..."
},
{
"url": "https://..."
}
]
}📮 Demande
Points de terminaison
Créer une image
POST /v1/images/generationsCréez des images basées sur des invites textuelles.
Modifier l'image
POST /v1/images/editsCréez des images modifiées ou étendues basées sur une ou plusieurs images et invites originales. Ce point de terminaison prend en charge les modèles dall-e-2 et gpt-image-1.
Générer des variantes
POST /v1/images/variationsCréez des variations d'une image donnée.
Méthode d'authentification
Incluez les éléments suivants dans l'en-tête de la demande pour l'authentification par clé API:
Authorization: Bearer $API_KEYOù $API_KEY est votre clé API.
Paramètres du corps de la requête
Créer une image
prompt
- Type : Chaîne
- Obligatoire : Oui
- Description: Description textuelle de l'image souhaitée à générer.
- la longueur maximale de dall-e-2 est de 1 000 caractères
- la longueur maximale du dall-e-3 est de 4 000 caractères
- Conseils:
- Utiliser des descriptions spécifiques et détaillées
- Inclure des éléments visuels clés
- Préciser le style artistique attendu
- Décrire la composition et la perspective
model
- Type : Chaîne
- Obligatoire: Non
- Par défaut: dall-e-2
- Description : Modèle utilisé pour la génération d'images.
n
- Type: Entier ou nul
- Obligatoire: Non
- Par défaut : 1
- Description : Nombre d'images à générer. Doit être compris entre 1 et 10. dall-e-3 ne prend en charge que n=1.
quality
- Type : Chaîne
- Obligatoire: Non
- Par défaut : standard
- Description : Qualité de l'image générée. L'option hd générera des images plus détaillées et cohérentes. Seul Dall-e-3 prend en charge ce paramètre.
response_format
- Type: chaîne ou null
- Obligatoire: Non
- Par défaut: url
- Description : Format de l'image générée à retourner. Doit être url ou b64_json. L'URL est valide pendant 60 minutes après la génération.
size
- Type: chaîne ou null
- Obligatoire: Non
- Par défaut : 1024x1024
- Description : Taille de l'image générée. dall-e-2 doit être l'un des formats 256x256, 512x512 ou 1024x1024. dall-e-3 doit être l'un des formats 1024x1024, 1792x1024 ou 1024x1792.
style
- Type: chaîne ou null
- Obligatoire: Non
- Par défaut: vif
- Description : Style de l'image générée. Doit être vif ou naturel. Vivid a tendance à générer des images surréalistes et dramatiques, tandis que Natural a tendance à générer des images plus naturelles et moins surréalistes. Seul Dall-e-3 prend en charge ce paramètre.
user
- Type : Chaîne
- Obligatoire: Non
- Description: identifiant unique de l'utilisateur final, qui peut aider OpenAI à surveiller et à détecter les abus.
Modifier l'image
image
- Type: Fichier ou tableau de fichiers
- Obligatoire : Oui
- Description : Image à modifier.
- Pour dall-e-2: Il doit s'agir d'un fichier PNG valide, de moins de 4 Mo, et carré. Si aucun masque n'est fourni, l'image doit avoir une transparence, qui servira de masque.
- Pour gpt-image-1: plusieurs images peuvent être fournies sous forme de tableau, chaque image doit être un fichier PNG, WEBP ou JPG de moins de 25 Mo.
prompt
- Type : Chaîne
- Obligatoire : Oui
- Description: Description textuelle de l'image souhaitée à générer.
- la longueur maximale de dall-e-2 est de 1 000 caractères
- La longueur maximale de gpt-image-1 est de 32 000 caractères
mask
- Type : Fichier
- Obligatoire: Non
- Description: Image supplémentaire dont les zones entièrement transparentes (par exemple les zones avec un zéro alpha) indiquent les positions à modifier. Si plusieurs images sont fournies, le masque sera appliqué à la première image. Il doit s'agir d'un fichier PNG valide, de moins de 4 Mo et de la même taille que l'image.
model
- Type : Chaîne
- Obligatoire: Non
- Par défaut: dall-e-2
- Description : Modèle utilisé pour la génération d'images. Prend en charge dall-e-2 et gpt-image-1. Si les paramètres spécifiques à gpt-image-1 ne sont pas utilisés, la valeur par défaut est dall-e-2.
quality
- Type: chaîne ou null
- Obligatoire: Non
- Par défaut: auto
- Description : Qualité de l'image générée.
- gpt-image-1 prend en charge les niveaux élevé, moyen et faible
- dall-e-2 ne prend en charge que le standard
- Par défaut, auto
size
- Type: chaîne ou null
- Obligatoire: Non
- Par défaut : 1024x1024
- Description : Taille de l'image générée.
- gpt-image-1 doit être l'un des formats 1024x1024, 1536x1024 (horizontal), 1024x1536 (vertical) ou auto (par défaut)
- dall-e-2 doit être l'un des formats 256x256, 512x512 ou 1024x1024
Les autres paramètres sont les mêmes que ceux de l'interface Créer une image.
Générer des variantes
image
- Type : Fichier
- Obligatoire : Oui
- Description : Image à utiliser comme base pour les variations. Il doit s'agir d'un fichier PNG valide, de moins de 4 Mo et carré.
Les autres paramètres sont les mêmes que ceux de l'interface Créer une image.
📥 Réponse
Réponse réussie
Les trois points de terminaison renvoient une réponse contenant une liste d’objets image.
created
- Type : Entier
- Description : Horodatage de la création de la réponse
data
- Type : Tableau
- Description : Liste des objets image générés
usage (uniquement pour gpt-image-1)
- Type : Objet
- Description: Utilisation du jeton pour l'appel API
total_tokens: Total de jetons utilisésinput_tokens: jetons utilisés pour la saisieoutput_tokens: Tokens utilisés pour la sortieinput_tokens_details: informations détaillées sur les jetons d'entrée (jetons de texte et jetons d'image)
Objet image
b64_json
- Type : Chaîne
- Description: Si Response_format est b64_json, il contient le JSON encodé en base64 de l'image générée.
url
- Type : Chaîne
- Description : Si réponse_format est url (par défaut), il contient l'URL de l'image générée
revised_prompt
- Type : Chaîne
- Description: si l'invite a été modifiée, elle contient l'invite modifiée utilisée pour la génération d'images.
Exemple d'objet image:
{
"url": "https://...",
"revised_prompt": "A cute little sea otter playing in the water, with round eyes and fluffy fur"
}🌟 Bonnes pratiques
Conseils d'écriture rapides
- Utilisez des descriptions claires et spécifiques
- Spécifiez les détails visuels importants
- Décrire le style et l'atmosphère artistiques attendus
- Faites attention aux instructions de composition et de perspective
Conseils pour la sélection des paramètres
- Sélection du modèle
- dall-e-3: Convient aux scènes nécessitant une haute qualité et des détails précis
- dall-e-2: convient aux prototypes rapides ou à la génération d'images simples
- Sélection de la taille
- 1024x1024: Meilleur choix de scène générale
- 1792x1024/1024x1792 : Convient aux scènes horizontales/verticales
- Tailles plus petites: convient aux vignettes ou aux aperçus rapides
- Qualité et style
- quality=hd : Pour les images nécessitant des détails fins
- style=vivid : Convient aux effets créatifs et artistiques
- style=natural : Convient pour une reproduction réaliste de scènes
Questions courantes
- La génération d'images a échoué
- Vérifiez si l'invite est conforme aux politiques de contenu
- Confirmer le format de fichier et les limites de taille
- Vérifier les autorisations de la clé API
- Les résultats ne correspondent pas aux attentes
- Optimiser la description rapide
- Ajuster les paramètres de qualité et de style
- Pensez à utiliser les fonctionnalités d'édition ou de variation d'images