GPT-Image-2 API: Generuj i edytuj obrazy od $0.02 — najtańszy dostęp

GPT-Image-2 API z 50% zniżką względem cen OpenAI. Generuj obrazy od $0.003, edytuj z multi-reference i mask inpainting, eksportuj PNG/JPEG/WebP do 4K. Endpoint zgodny z OpenAI, gotowy do podmiany.

S
Smart AIPI Team
7 min czytania ·
GPT-Image-2 API: Generuj i edytuj obrazy od $0.02 — najtańszy dostęp

TL;DR: GPT-Image-2 jest już dziś dostępny w Smart AIPI — tego samego dnia, w którym OpenAI go udostępniło. Używaj modelu gpt-image-2 na /v1/images/generations lub /v1/images/edits. Jest o 50% tańszy niż bezpośrednio w OpenAI, obsługuje multi-reference edits, mask inpainting, wyjście JPEG/WebP i rozdzielczości 4K. Nie wymaga zmiany konfiguracji — dowolny starszy model ID (dall-e, dall-e-3, gpt-image-latest) kieruje się bezpośrednio do gpt-image-2.

OpenAI właśnie udostępniło GPT-Image-2, swój nowy flagowy model do generowania i edycji obrazów. Dodaliśmy go do Smart AIPI tego samego dnia. Użyj modelu ID gpt-image-2 w dowolnym wywołaniu /v1/images/generations lub /v1/images/edits — bez zmian konfiguracji, bez redeploy, z tym samym API key.

Poniżej: co faktycznie zmieniło się względem gpt-image-1.5, dlaczego multi-reference edits + mask inpainting mają znaczenie w produkcji, dokładne ceny oraz działający kod w czterech językach.

Co wyróżnia GPT-Image-2

GPT-Image-2 to pierwszy model obrazu OpenAI, który da się praktycznie wdrożyć do poważnych workflow kreatywnych — nie tylko do jednorazowych demo. Cztery konkretne zmiany możliwości napędzają tę różnicę:

  • Natywna rozdzielczość 4K. GPT-Image-2 przyjmuje dowolne wymiary do 3840×2160 (4K landscape) lub 2160×3840 (4K portrait), zamiast limitu 1536×1024 w gpt-image-1.5. To skok 7.5× w maksymalnej liczbie pikseli wyjściowych. Teraz możesz generować gotowe do produkcji hero images, plakaty w jakości drukarskiej i kinowe kadry jednym wywołaniem toola.
  • Swobodne rozdzielczości. Poprzednie modele gpt-image blokowały trzy presety (square, landscape, portrait). GPT-Image-2 akceptuje dowolne WxH, jeśli oba boki są wielokrotnością 16, maksymalny bok ≤ 3840px, liczba pikseli mieści się między 655,360 a 8,294,400, a stosunek dłuższego do krótszego boku wynosi ≤ 3:1. To obejmuje tysiące proporcji — banery, kadry social, ikony aplikacji, okładki książek, kadry filmowe.
  • Domyślnie wysokiej jakości przetwarzanie referencji. Stary flag input_fidelity: "high" jest teraz zawsze włączony. Każdy obraz referencyjny, który podasz, jest przetwarzany w pełnym detalu — logotypy brandów pozostają ostre, tekstury produktów przetrwają edycje, twarze postaci pozostają rozpoznawalne między kolejnymi iteracjami. Nie ma tu kompromisu jakość/szybkość do strojenia.
  • Szybsze niskiej jakości drafty. quality: "low" przy 1024×1024 kosztuje $0.003 przez Smart AIPI i zwraca wynik w ok. 20–40 sekund. To na tyle tanie, że można to bez żalu wyrzucić — idealne do eksploracji promptów i podglądów UI przed przejściem na render wysokiej jakości za $0.10+.

Cennik: 50% taniej niż bezpośrednio w OpenAI

Cennik API OpenAI dla GPT-Image-2 przy 1024×1024 to $0.006 low / $0.053 medium / $0.211 high. Rozmiary inne niż kwadratowe (1024×1536, 1536×1024) kosztują 1.5× stawki dla square.

W Smart AIPI każdy poziom kosztuje dokładnie 50% ceny detalicznej OpenAI:

Jakość Rozdzielczość OpenAI direct Smart AIPI Oszczędzasz
Low1024×1024$0.006$0.00350%
Medium1024×1024$0.053$0.026550%
High1024×1024$0.211$0.105550%
Low1024×1536 / 1536×1024$0.005$0.0045~50%
Medium1024×1536 / 1536×1024$0.041$0.0398~50%
High1024×1536 / 1536×1024$0.165$0.1583~50%

Typowy cykl iteracji kreatywnej — 10 niskiej jakości draftów przy 1024×1024, a potem jeden finalny render wysokiej jakości 1536×1024 — kosztuje $0.19 przez Smart AIPI zamiast $0.38 bezpośrednio w OpenAI. Skaluj to do studia robiącego 100 takich cykli dziennie, a oszczędzasz $570 miesięcznie bez żadnego wysiłku.

Żaden inny provider nie oferuje GPT-Image-2 z takim rabatem. OpenRouter przekazuje ceny OpenAI direct plus marżę. Fal, Replicate i Vertex w ogóle nie hostują modeli OpenAI. Smart AIPI agreguje image capacity z subskrypcji ChatGPT Business i przekazuje oszczędności bezpośrednio dalej.

Multi-Reference Edits: kompozytowalne workflow kreatywne

Endpoint edycji GPT-Image-2 przyjmuje wiele obrazów referencyjnych w jednym wywołaniu. To funkcja, która odblokowuje prawdziwe workflow kreatywne — kompozyty produktowe, spójne z marką postacie w różnych scenach, generowanie kolaży.

Smart AIPI obsługuje każdy sposób, w jaki oficjalny OpenAI SDK je wysyła:

Python SDK (multipart z image[])

from openai import OpenAI
client = OpenAI(base_url="https://api.smartaipi.com/v1")

result = client.images.edit(
    model="gpt-image-2",
    image=[
        open("body-lotion.png", "rb"),
        open("bath-bomb.png",  "rb"),
        open("incense-kit.png","rb"),
        open("soap.png",       "rb"),
    ],
    prompt="Fotorealistyczny kosz prezentowy 'Relax & Unwind' z wstążką, zawierający elementy z obrazów referencyjnych.",
)

with open("gift-basket.png","wb") as f:
    f.write(base64.b64decode(result.data[0].b64_json))

JSON API (tablica stringów base64)

curl https://api.smartaipi.com/v1/images/edits \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "Kosz prezentowy zawierający wszystkie elementy z referencji",
    "image": ["<base64-png-1>", "<base64-png-2>", "<base64-png-3>"]
  }'

curl multipart (zarówno image[], jak i powtarzane image działają)

curl https://api.smartaipi.com/v1/images/edits \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "model=gpt-image-2" \
  -F "image[][email protected]" \
  -F "image[][email protected]" \
  -F "image[][email protected]" \
  -F "image[][email protected]" \
  -F "prompt=Kosz prezentowy ze wszystkimi wskazanymi elementami"

Mask Inpainting: precyzyjne edycje

Przekaż mask razem z image, aby ograniczyć edycje do konkretnego obszaru. Białe piksele na masce oznaczają obszary do przepisania; czarne piksele pozostają bez zmian.

curl https://api.smartaipi.com/v1/images/edits \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "model=gpt-image-2" \
  -F "image=@sunlit_lounge.png" \
  -F "[email protected]" \
  -F "prompt=Zamień basen na flamingo float"

Wymagania formatu maski: te same wymiary pikseli co obraz główny, PNG z kanałem alpha, ≤ 50MB. Jeśli źródłowa maska jest RGB bez przezroczystości, dokumentacja OpenAI zawiera 10-liniowy snippet PIL, który dodaje kanał alpha na podstawie wartości grayscale.

Generowanie: podstawowe zapytanie

curl https://api.smartaipi.com/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "Fotorealistyczny kubek do kawy na postarzanym stole dębowym",
    "size": "2048x2048",
    "quality": "high"
  }'

Odpowiedź ma standardowy kształt OpenAI — { "created": ..., "data": [{ "b64_json": "..." }] }. Zdekoduj Base64 z b64_json, aby uzyskać bajty PNG.

Formaty wyjściowe: PNG, JPEG, WebP

Użyj output_format, aby kontrolować kontener. JPEG zwraca się zauważalnie szybciej niż PNG i jest właściwym domyślnym wyborem, gdy latency ma większe znaczenie niż bezstratna jakość. Połącz JPEG lub WebP z output_compression (0–100), aby dostroić rozmiar pliku.

{
  "model": "gpt-image-2",
  "prompt": "Krajobraz filmowy, golden hour",
  "size": "3840x2160",
  "quality": "high",
  "output_format": "jpeg",
  "output_compression": 85
}

Obsługiwane parametry (v1/images/generations & v1/images/edits)

  • modelgpt-image-2 (domyślnie), gpt-image-1.5, gpt-image-1, gpt-image-1-mini. Starsze aliasy dall-e, dall-e-3, gpt-image, gpt-image-latest mapują się na gpt-image-2.
  • prompt — wymagane pole z instrukcją tekstową.
  • n — rozmiar batcha, 1–10. Smart AIPI wykonuje pętlę po stronie serwera, ponieważ Codex image tool generuje jeden obraz na wywołanie.
  • sizeauto lub dowolne WxH spełniające ograniczenia gpt-image-2 (wielokrotności 16, boki ≤ 3840, 655,360 ≤ piksele ≤ 8,294,400, long:short ≤ 3:1).
  • qualitylow / medium / high / auto (domyślnie medium).
  • output_formatpng (domyślnie) / jpeg / webp.
  • output_compression — 0–100, tylko jpeg/webp.
  • backgroundauto / opaque. Transparent nie jest obsługiwany przez gpt-image-2; użyj gpt-image-1.5, jeśli go potrzebujesz.
  • moderationauto (domyślnie) / low.
  • image (tylko edits) — pojedynczy string Base64 albo tablica stringów Base64 (JSON) / części multipart image lub image[].
  • mask (tylko edits) — pojedynczy string Base64 (JSON) / plik multipart. White=edytuj, black=zachowaj.

Kształt odpowiedzi

Identyczny jak odpowiedź OpenAI dla /v1/images. Opcjonalnie dodawane jest jedno pole: jeśli backend Codex zwróci revised_prompt, Smart AIPI pokazuje je przy każdym elemencie obrazu.

{
  "created": 1777064910,
  "data": [
    {
      "b64_json": "iVBORw0KGgo...",
      "revised_prompt": "Szczegółowy, fotorealistyczny kubek do kawy..."
    }
  ]
}

Zacznij

W zestawie darmowe kredyty. Każde nowe konto dostaje $5 darmowych kredytów — wystarczy to na ok. 1,650 niskiej jakości draftów, 188 renderów medium albo 47 wysokiej jakości hero images. Zarejestruj się na smartaipi.com/signup.

  1. Zarejestruj się na smartaipi.com/signup (darmowe kredyty, bez karty płatniczej)
  2. Utwórz API key w dashboardzie
  3. Ustaw base URL na https://api.smartaipi.com/v1
  4. Użyj modelu gpt-image-2

Ten sam kształt API zgodny z OpenAI, ten sam kod Python / JavaScript / curl, te same narzędzia do generowania obrazów — teraz z najnowszym flagowym modelem obrazu OpenAI, za połowę ceny.

GPT-Image-2 Image Generation Image Editing OpenAI Cheapest API Multi-Reference Mask
S
Autor
Smart AIPI

Brama API kompatybilna z OpenAI. Uzyskaj dostęp do frontier AI models przy koszcie niższym o 75%.

Zacznij za darmo

Wiadomość wysłana

Odpowiemy w ciągu 2 dni roboczych.

Kontakt z supportem

Masz pytanie albo potrzebujesz pomocy? Wyślij nam wiadomość, a odpowiemy w ciągu 2 dni roboczych.