GPT-Image-2 API: Generuj i edytuj obrazy od $0.02 — najtańszy dostęp
GPT-Image-2 API z 50% zniżką względem cen OpenAI. Generuj obrazy od $0.003, edytuj z multi-reference i mask inpainting, eksportuj PNG/JPEG/WebP do 4K. Endpoint zgodny z OpenAI, gotowy do podmiany.
TL;DR: GPT-Image-2 jest już dziś dostępny w Smart AIPI — tego samego dnia, w którym OpenAI go udostępniło. Używaj modelu gpt-image-2 na /v1/images/generations lub /v1/images/edits. Jest o 50% tańszy niż bezpośrednio w OpenAI, obsługuje multi-reference edits, mask inpainting, wyjście JPEG/WebP i rozdzielczości 4K. Nie wymaga zmiany konfiguracji — dowolny starszy model ID (dall-e, dall-e-3, gpt-image-latest) kieruje się bezpośrednio do gpt-image-2.
OpenAI właśnie udostępniło GPT-Image-2, swój nowy flagowy model do generowania i edycji obrazów. Dodaliśmy go do Smart AIPI tego samego dnia. Użyj modelu ID gpt-image-2 w dowolnym wywołaniu /v1/images/generations lub /v1/images/edits — bez zmian konfiguracji, bez redeploy, z tym samym API key.
Poniżej: co faktycznie zmieniło się względem gpt-image-1.5, dlaczego multi-reference edits + mask inpainting mają znaczenie w produkcji, dokładne ceny oraz działający kod w czterech językach.
Co wyróżnia GPT-Image-2
GPT-Image-2 to pierwszy model obrazu OpenAI, który da się praktycznie wdrożyć do poważnych workflow kreatywnych — nie tylko do jednorazowych demo. Cztery konkretne zmiany możliwości napędzają tę różnicę:
- Natywna rozdzielczość 4K. GPT-Image-2 przyjmuje dowolne wymiary do 3840×2160 (4K landscape) lub 2160×3840 (4K portrait), zamiast limitu 1536×1024 w gpt-image-1.5. To skok 7.5× w maksymalnej liczbie pikseli wyjściowych. Teraz możesz generować gotowe do produkcji hero images, plakaty w jakości drukarskiej i kinowe kadry jednym wywołaniem toola.
- Swobodne rozdzielczości. Poprzednie modele gpt-image blokowały trzy presety (square, landscape, portrait). GPT-Image-2 akceptuje dowolne WxH, jeśli oba boki są wielokrotnością 16, maksymalny bok ≤ 3840px, liczba pikseli mieści się między 655,360 a 8,294,400, a stosunek dłuższego do krótszego boku wynosi ≤ 3:1. To obejmuje tysiące proporcji — banery, kadry social, ikony aplikacji, okładki książek, kadry filmowe.
- Domyślnie wysokiej jakości przetwarzanie referencji. Stary flag
input_fidelity: "high"jest teraz zawsze włączony. Każdy obraz referencyjny, który podasz, jest przetwarzany w pełnym detalu — logotypy brandów pozostają ostre, tekstury produktów przetrwają edycje, twarze postaci pozostają rozpoznawalne między kolejnymi iteracjami. Nie ma tu kompromisu jakość/szybkość do strojenia. - Szybsze niskiej jakości drafty.
quality: "low"przy 1024×1024 kosztuje $0.003 przez Smart AIPI i zwraca wynik w ok. 20–40 sekund. To na tyle tanie, że można to bez żalu wyrzucić — idealne do eksploracji promptów i podglądów UI przed przejściem na render wysokiej jakości za $0.10+.
Cennik: 50% taniej niż bezpośrednio w OpenAI
Cennik API OpenAI dla GPT-Image-2 przy 1024×1024 to $0.006 low / $0.053 medium / $0.211 high. Rozmiary inne niż kwadratowe (1024×1536, 1536×1024) kosztują 1.5× stawki dla square.
W Smart AIPI każdy poziom kosztuje dokładnie 50% ceny detalicznej OpenAI:
| Jakość | Rozdzielczość | OpenAI direct | Smart AIPI | Oszczędzasz |
|---|---|---|---|---|
| Low | 1024×1024 | $0.006 | $0.003 | 50% |
| Medium | 1024×1024 | $0.053 | $0.0265 | 50% |
| High | 1024×1024 | $0.211 | $0.1055 | 50% |
| Low | 1024×1536 / 1536×1024 | $0.005 | $0.0045 | ~50% |
| Medium | 1024×1536 / 1536×1024 | $0.041 | $0.0398 | ~50% |
| High | 1024×1536 / 1536×1024 | $0.165 | $0.1583 | ~50% |
Typowy cykl iteracji kreatywnej — 10 niskiej jakości draftów przy 1024×1024, a potem jeden finalny render wysokiej jakości 1536×1024 — kosztuje $0.19 przez Smart AIPI zamiast $0.38 bezpośrednio w OpenAI. Skaluj to do studia robiącego 100 takich cykli dziennie, a oszczędzasz $570 miesięcznie bez żadnego wysiłku.
Żaden inny provider nie oferuje GPT-Image-2 z takim rabatem. OpenRouter przekazuje ceny OpenAI direct plus marżę. Fal, Replicate i Vertex w ogóle nie hostują modeli OpenAI. Smart AIPI agreguje image capacity z subskrypcji ChatGPT Business i przekazuje oszczędności bezpośrednio dalej.
Multi-Reference Edits: kompozytowalne workflow kreatywne
Endpoint edycji GPT-Image-2 przyjmuje wiele obrazów referencyjnych w jednym wywołaniu. To funkcja, która odblokowuje prawdziwe workflow kreatywne — kompozyty produktowe, spójne z marką postacie w różnych scenach, generowanie kolaży.
Smart AIPI obsługuje każdy sposób, w jaki oficjalny OpenAI SDK je wysyła:
Python SDK (multipart z image[])
from openai import OpenAI
client = OpenAI(base_url="https://api.smartaipi.com/v1")
result = client.images.edit(
model="gpt-image-2",
image=[
open("body-lotion.png", "rb"),
open("bath-bomb.png", "rb"),
open("incense-kit.png","rb"),
open("soap.png", "rb"),
],
prompt="Fotorealistyczny kosz prezentowy 'Relax & Unwind' z wstążką, zawierający elementy z obrazów referencyjnych.",
)
with open("gift-basket.png","wb") as f:
f.write(base64.b64decode(result.data[0].b64_json))
JSON API (tablica stringów base64)
curl https://api.smartaipi.com/v1/images/edits \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-image-2",
"prompt": "Kosz prezentowy zawierający wszystkie elementy z referencji",
"image": ["<base64-png-1>", "<base64-png-2>", "<base64-png-3>"]
}'
curl multipart (zarówno image[], jak i powtarzane image działają)
curl https://api.smartaipi.com/v1/images/edits \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "model=gpt-image-2" \
-F "image[][email protected]" \
-F "image[][email protected]" \
-F "image[][email protected]" \
-F "image[][email protected]" \
-F "prompt=Kosz prezentowy ze wszystkimi wskazanymi elementami"
Mask Inpainting: precyzyjne edycje
Przekaż mask razem z image, aby ograniczyć edycje do konkretnego obszaru. Białe piksele na masce oznaczają obszary do przepisania; czarne piksele pozostają bez zmian.
curl https://api.smartaipi.com/v1/images/edits \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "model=gpt-image-2" \
-F "image=@sunlit_lounge.png" \
-F "[email protected]" \
-F "prompt=Zamień basen na flamingo float"
Wymagania formatu maski: te same wymiary pikseli co obraz główny, PNG z kanałem alpha, ≤ 50MB. Jeśli źródłowa maska jest RGB bez przezroczystości, dokumentacja OpenAI zawiera 10-liniowy snippet PIL, który dodaje kanał alpha na podstawie wartości grayscale.
Generowanie: podstawowe zapytanie
curl https://api.smartaipi.com/v1/images/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-image-2",
"prompt": "Fotorealistyczny kubek do kawy na postarzanym stole dębowym",
"size": "2048x2048",
"quality": "high"
}'
Odpowiedź ma standardowy kształt OpenAI — { "created": ..., "data": [{ "b64_json": "..." }] }. Zdekoduj Base64 z b64_json, aby uzyskać bajty PNG.
Formaty wyjściowe: PNG, JPEG, WebP
Użyj output_format, aby kontrolować kontener. JPEG zwraca się zauważalnie szybciej niż PNG i jest właściwym domyślnym wyborem, gdy latency ma większe znaczenie niż bezstratna jakość. Połącz JPEG lub WebP z output_compression (0–100), aby dostroić rozmiar pliku.
{
"model": "gpt-image-2",
"prompt": "Krajobraz filmowy, golden hour",
"size": "3840x2160",
"quality": "high",
"output_format": "jpeg",
"output_compression": 85
}
Obsługiwane parametry (v1/images/generations & v1/images/edits)
model—gpt-image-2(domyślnie),gpt-image-1.5,gpt-image-1,gpt-image-1-mini. Starsze aliasydall-e,dall-e-3,gpt-image,gpt-image-latestmapują się na gpt-image-2.prompt— wymagane pole z instrukcją tekstową.n— rozmiar batcha, 1–10. Smart AIPI wykonuje pętlę po stronie serwera, ponieważ Codex image tool generuje jeden obraz na wywołanie.size—autolub dowolne WxH spełniające ograniczenia gpt-image-2 (wielokrotności 16, boki ≤ 3840, 655,360 ≤ piksele ≤ 8,294,400, long:short ≤ 3:1).quality—low/medium/high/auto(domyślnie medium).output_format—png(domyślnie) /jpeg/webp.output_compression— 0–100, tylko jpeg/webp.background—auto/opaque. Transparent nie jest obsługiwany przez gpt-image-2; użyj gpt-image-1.5, jeśli go potrzebujesz.moderation—auto(domyślnie) /low.image(tylko edits) — pojedynczy string Base64 albo tablica stringów Base64 (JSON) / części multipartimagelubimage[].mask(tylko edits) — pojedynczy string Base64 (JSON) / plik multipart. White=edytuj, black=zachowaj.
Kształt odpowiedzi
Identyczny jak odpowiedź OpenAI dla /v1/images. Opcjonalnie dodawane jest jedno pole: jeśli backend Codex zwróci revised_prompt, Smart AIPI pokazuje je przy każdym elemencie obrazu.
{
"created": 1777064910,
"data": [
{
"b64_json": "iVBORw0KGgo...",
"revised_prompt": "Szczegółowy, fotorealistyczny kubek do kawy..."
}
]
}
Zacznij
W zestawie darmowe kredyty. Każde nowe konto dostaje $5 darmowych kredytów — wystarczy to na ok. 1,650 niskiej jakości draftów, 188 renderów medium albo 47 wysokiej jakości hero images. Zarejestruj się na smartaipi.com/signup.
- Zarejestruj się na smartaipi.com/signup (darmowe kredyty, bez karty płatniczej)
- Utwórz API key w dashboardzie
- Ustaw base URL na
https://api.smartaipi.com/v1 - Użyj modelu
gpt-image-2
Ten sam kształt API zgodny z OpenAI, ten sam kod Python / JavaScript / curl, te same narzędzia do generowania obrazów — teraz z najnowszym flagowym modelem obrazu OpenAI, za połowę ceny.
Brama API kompatybilna z OpenAI. Uzyskaj dostęp do frontier AI models przy koszcie niższym o 75%.
Zacznij za darmo