88API88API
User GuideAI ApplicationsAPI ReferenceHelp & Support
Image

Định dạng hình ảnh OpenAI (Hình ảnh)

Tài liệu chính thức

📝 Giới thiệu

Với lời nhắc văn bản và/hoặc hình ảnh đầu vào, mô hình sẽ tạo ra hình ảnh mới. OpenAI cung cấp nhiều mô hình tạo hình ảnh mạnh mẽ có thể tạo, chỉnh sửa và sửa đổi hình ảnh dựa trên mô tả ngôn ngữ tự nhiên. Các mô hình hiện được hỗ trợ bao gồm:

Người mẫuMô tả
DALL·E SeriesBao gồm các phiên bản DALL·E 2 và DALL·E 3, có sự khác biệt đáng kể về chất lượng hình ảnh, khả năng thể hiện sáng tạo và độ chính xác
GPT-Hình ảnh-1Mẫu hình ảnh mới nhất của OpenAI, hỗ trợ khả năng chỉnh sửa đa ảnh, có thể tạo ảnh tổng hợp mới dựa trên nhiều ảnh đầu vào

💡 Yêu cầu Ví dụ

Tạo hình ảnh ✅

# Basic image generation
curl https://88api.ai/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "dall-e-3",
    "prompt": "A cute little sea otter",
    "n": 1,
    "size": "1024x1024"
  }'

# High-quality image generation
curl https://88api.ai/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "dall-e-3",
    "prompt": "A cute little sea otter",
    "quality": "hd",
    "style": "vivid",
    "size": "1024x1024"
  }'

# Using base64 response format
curl https://88api.ai/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "dall-e-3",
    "prompt": "A cute little sea otter",
    "response_format": "b64_json"
  }'

Response Example:

{
  "created": 1589478378,
  "data": [
    {
      "url": "https://...",
      "revised_prompt": "A cute little sea otter playing in the water, with round eyes and fluffy fur"
    }
  ]
}

Chỉnh sửa hình ảnh ✅

# dall-e-2 image editing
curl https://88api.ai/v1/images/edits \
  -H "Authorization: Bearer $API_KEY" \
  -F image="@otter.png" \
  -F mask="@mask.png" \
  -F prompt="A cute little sea otter wearing a beret" \
  -F n=2 \
  -F size="1024x1024"

# gpt-image-1 multi-image editing example
curl https://88api.ai/v1/images/edits \
  -H "Authorization: Bearer $API_KEY" \
  -F "model=gpt-image-1" \
  -F "image[]=@body-lotion.png" \
  -F "image[]=@bath-bomb.png" \
  -F "image[]=@incense-kit.png" \
  -F "image[]=@soap.png" \
  -F "prompt=Create an elegant gift basket containing these four items" \
  -F "quality=high"

Response Example (dall-e-2):

{
  "created": 1589478378,
  "data": [
    {
      "url": "https://..."
    },
    {
      "url": "https://..."
    }
  ]
}

Response Example (gpt-image-1):

{
  "created": 1713833628,
  "data": [
    {
      "b64_json": "..."
    }
  ],
  "usage": {
    "total_tokens": 100,
    "input_tokens": 50,
    "output_tokens": 50,
    "input_tokens_details": {
      "text_tokens": 10,
      "image_tokens": 40
    }
  }
}

Tạo các biến thể hình ảnh ✅

curl https://88api.ai/v1/images/variations \
  -H "Authorization: Bearer $API_KEY" \
  -F image="@otter.png" \
  -F n=2 \
  -F size="1024x1024"

Response Example:

{
  "created": 1589478378,
  "data": [
    {
      "url": "https://..."
    },
    {
      "url": "https://..."
    }
  ]
}

📮 Yêu cầu

Điểm cuối

Tạo hình ảnh

POST /v1/images/generations

Tạo hình ảnh dựa trên lời nhắc văn bản.

Chỉnh sửa hình ảnh

POST /v1/images/edits

Tạo hình ảnh đã chỉnh sửa hoặc mở rộng dựa trên một hoặc nhiều hình ảnh gốc và lời nhắc. Điểm cuối này hỗ trợ cả mô hình dall-e-2 và gpt-image-1.

Tạo các biến thể

POST /v1/images/variations

Tạo các biến thể của một hình ảnh nhất định.

Phương thức xác thực

Bao gồm nội dung sau trong tiêu đề yêu cầu để xác thực khóa API:

Authorization: Bearer $API_KEY

Trong đó $API_KEY là khóa API của bạn.

Thông số nội dung yêu cầu

Tạo hình ảnh

prompt
  • Loại: Chuỗi
  • Bắt buộc: Có
  • Description: Văn bản mô tả hình ảnh mong muốn tạo ra.
  • dall-e-2 độ dài tối đa là 1000 ký tự
  • dall-e-3 có độ dài tối đa là 4000 ký tự
  • Lời khuyên:
  • Sử dụng mô tả cụ thể và chi tiết
  • Bao gồm các yếu tố hình ảnh quan trọng
  • Xác định phong cách nghệ thuật dự kiến
  • Trình bày bố cục, phối cảnh
model
  • Loại: Chuỗi
  • Bắt buộc: Không
  • Mặc định: dall-e-2
  • Mô tả: Mô hình dùng để tạo ảnh.
n
  • Kiểu: Số nguyên hoặc null
  • Bắt buộc: Không
  • Mặc định: 1
  • Mô tả: Số lượng ảnh cần tạo. Phải nằm trong khoảng từ 1-10. dall-e-3 chỉ hỗ trợ n=1.
quality
  • Loại: Chuỗi
  • Bắt buộc: Không
  • Mặc định: tiêu chuẩn
  • Mô tả: Chất lượng của hình ảnh được tạo ra. Tùy chọn hd sẽ tạo ra hình ảnh chi tiết và nhất quán hơn. Chỉ dall-e-3 hỗ trợ tham số này.
response_format
  • Kiểu: Chuỗi hoặc null
  • Bắt buộc: Không
  • Mặc định: url
  • Mô tả: Định dạng của ảnh được tạo ra sẽ trả về. Phải là url hoặc b64_json. URL có hiệu lực trong 60 phút sau khi tạo.
size
  • Kiểu: Chuỗi hoặc null
  • Bắt buộc: Không
  • Mặc định: 1024x1024
  • Mô tả: Kích thước của ảnh được tạo ra. dall-e-2 phải là một trong các kích thước 256x256, 512x512 hoặc 1024x1024. dall-e-3 phải là một trong các kích thước 1024x1024, 1792x1024 hoặc 1024x1792.
style
  • Kiểu: Chuỗi hoặc null
  • Bắt buộc: Không
  • Mặc định: sống động
  • Mô tả: Kiểu dáng của hình ảnh được tạo ra. Phải sống động hoặc tự nhiên. Sống động có xu hướng tạo ra hình ảnh siêu thực và ấn tượng, trong khi tự nhiên có xu hướng tạo ra hình ảnh tự nhiên hơn, ít siêu thực hơn. Chỉ dall-e-3 hỗ trợ tham số này.
user
  • Loại: Chuỗi
  • Bắt buộc: Không
  • Mô tả: Mã định danh duy nhất cho người dùng cuối, có thể giúp OpenAI giám sát và phát hiện hành vi lạm dụng.

Chỉnh sửa hình ảnh

image
  • Kiểu: File hoặc mảng file
  • Bắt buộc: Có
  • Mô tả: Hình ảnh cần chỉnh sửa.
  • Đối với dall-e-2: Phải là file PNG hợp lệ, nhỏ hơn 4MB, hình vuông. Nếu không cung cấp mặt nạ, hình ảnh phải có độ trong suốt, độ trong suốt này sẽ được sử dụng làm mặt nạ.
  • Đối với gpt-image-1: Có thể cung cấp nhiều hình ảnh dưới dạng mảng, mỗi hình ảnh phải là tệp PNG, WEBP hoặc JPG, nhỏ hơn 25MB.
prompt
  • Loại: Chuỗi
  • Bắt buộc: Có
  • Description: Văn bản mô tả hình ảnh mong muốn tạo ra.
  • dall-e-2 độ dài tối đa là 1000 ký tự
  • gpt-image-1 có độ dài tối đa là 32000 ký tự
mask
  • Loại: Tập tin
  • Bắt buộc: Không
  • Mô tả: Hình ảnh bổ sung, có các vùng trong suốt hoàn toàn (ví dụ: các vùng có số 0 alpha) cho biết các vị trí cần chỉnh sửa. Nếu nhiều hình ảnh được cung cấp, mặt nạ sẽ được áp dụng cho hình ảnh đầu tiên. Phải là tệp PNG hợp lệ, nhỏ hơn 4 MB và có cùng kích thước với hình ảnh.
model
  • Loại: Chuỗi
  • Bắt buộc: Không
  • Mặc định: dall-e-2
  • Mô tả: Mô hình dùng để tạo ảnh. Hỗ trợ dall-e-2 và gpt-image-1. Nếu các tham số cụ thể của gpt-image-1 không được sử dụng, nó sẽ mặc định là dall-e-2.
quality
  • Kiểu: Chuỗi hoặc null
  • Bắt buộc: Không
  • Mặc định: tự động
  • Mô tả: Chất lượng của hình ảnh được tạo ra.
  • gpt-image-1 hỗ trợ cao, trung bình và thấp
  • dall-e-2 chỉ hỗ trợ tiêu chuẩn
  • Mặc định là tự động
size
  • Kiểu: Chuỗi hoặc null
  • Bắt buộc: Không
  • Mặc định: 1024x1024
  • Mô tả: Kích thước của ảnh được tạo ra.
  • gpt-image-1 phải là một trong các kích thước 1024x1024, 1536x1024 (ngang), 1024x1536 (dọc) hoặc tự động (mặc định)
  • dall-e-2 phải là một trong các kích thước 256x256, 512x512 hoặc 1024x1024

Các thông số khác giống như giao diện Create Image.

Tạo các biến thể

image
  • Loại: Tập tin
  • Bắt buộc: Có
  • Mô tả: Hình ảnh được sử dụng làm cơ sở cho các biến thể. Phải là tệp PNG hợp lệ, nhỏ hơn 4MB và có hình vuông.

Các thông số khác giống như giao diện Create Image.

📥 Phản hồi

###Phản hồi thành công

Tất cả ba điểm cuối đều trả về phản hồi chứa danh sách các đối tượng hình ảnh.

created

  • Kiểu: Số nguyên
  • Mô tả: Dấu thời gian tạo phản hồi

data

  • Kiểu: Mảng
  • Mô tả: Danh sách các đối tượng ảnh được tạo ra

usage (chỉ dành cho gpt-image-1)

  • Loại: Đối tượng
  • Mô tả: Sử dụng token cho lệnh gọi API
  • total_tokens: Tổng số token đã sử dụng
  • input_tokens: Token dùng để nhập
  • output_tokens: Token dùng cho đầu ra
  • input_tokens_details: Thông tin chi tiết về các token đầu vào (token văn bản và token hình ảnh)

Đối tượng hình ảnh

b64_json

  • Loại: Chuỗi
  • Mô tả: Nếu reply_format là b64_json thì nó chứa JSON được mã hóa base64 của hình ảnh được tạo

url

  • Loại: Chuỗi
  • Mô tả: Nếu reply_format là url (mặc định) thì chứa URL của ảnh được tạo ra

revised_prompt

  • Loại: Chuỗi
  • Mô tả: Nếu lời nhắc đã được sửa đổi, nó chứa lời nhắc đã sửa đổi được sử dụng để tạo hình ảnh

Đối tượng hình ảnh ví dụ:

{
  "url": "https://...",
  "revised_prompt": "A cute little sea otter playing in the water, with round eyes and fluffy fur"
}

🌟 Các phương pháp hay nhất

Mẹo viết nhanh

  1. Sử dụng mô tả rõ ràng và cụ thể
  2. Chỉ định chi tiết hình ảnh quan trọng
  3. Mô tả phong cách và không khí nghệ thuật mong đợi
  4. Chú ý đến bố cục và hướng dẫn phối cảnh

Mẹo chọn tham số

  1. Lựa chọn mô hình
  • dall-e-3: Phù hợp với những cảnh quay đòi hỏi chất lượng cao và chi tiết chính xác
  • dall-e-2: Thích hợp cho các nguyên mẫu nhanh hoặc tạo hình ảnh đơn giản
  1. Lựa chọn kích thước
  • 1024x1024: Lựa chọn cảnh chung tốt nhất
  • 1792x1024/1024x1792: Thích hợp cho cảnh ngang/dọc
  • Kích thước nhỏ hơn: Thích hợp cho hình thu nhỏ hoặc xem trước nhanh
  1. Chất lượng và Phong cách
  • Quality=hd: Dành cho hình ảnh yêu cầu độ chi tiết cao
  • style=vivid: Thích hợp cho các hiệu ứng sáng tạo và nghệ thuật
  • style=natural: Phù hợp để tái tạo cảnh thực tế

Câu hỏi thường gặp

  1. Tạo hình ảnh không thành công
  • Kiểm tra xem lời nhắc có tuân thủ chính sách nội dung không
  • Xác nhận giới hạn định dạng và kích thước tệp
  • Xác minh quyền khóa API
  1. Kết quả không như mong đợi
  • Tối ưu hóa mô tả lời nhắc
  • Điều chỉnh các thông số về chất lượng và kiểu dáng
  • Cân nhắc sử dụng tính năng chỉnh sửa hoặc biến thể hình ảnh