GPT-5.4 Mini i Nano: nowi królowie małych modeli

GPT-5.4 Mini osiąga 60% w Terminal-Bench 2.0 przy zaledwie $0.75/1M input. GPT-5.4 Nano kosztuje $0.20/1M. Oba są już dostępne w Smart AIPI z 75% zniżką — oto jak używać ich do agentów, programowania i obsługi komputera.

S
Smart AIPI Team
6 min czytania ·
GPT-5.4 Mini i Nano: nowi królowie małych modeli
GPT-5.4 Mini wybrany w selektorze modeli

W skrócie: GPT-5.4 Mini i Nano są już dostępne w Smart AIPI. Mini osiąga 60% w Terminal-Bench 2.0 przy cenie $0.75/1M input. Nano kosztuje tylko $0.20/1M. Oba modele są dostępne z 75% zniżką. Użyj gpt-5.4-mini i gpt-5.4-nano w dowolnym wywołaniu API.

OpenAI właśnie wypuściło dwa nowe modele z rodziny 5.4 i zmieniają one ekonomię rozwoju AI. GPT-5.4 Mini oferuje możliwości programistyczne bliskie frontier przy ułamku ceny. GPT-5.4 Nano to najtańszy model frontier, jaki kiedykolwiek udostępniono.

Oba są już teraz dostępne w Smart AIPI.

Liczby

Tak nowe modele wypadają pod względem ceny i wydajności:

Wykres cena vs zdolności programistyczne pokazujący GPT-5.4 Mini z wynikiem 60% w Terminal-Bench 2.0, GPT-5.4 Nano z 46% i Gemini 3 Flash z 47.7%
Model Terminal-Bench 2.0 Input /1M Output /1M Output w Smart AIPI
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/D
GPT-5.4 (full) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini pokonuje Gemini 3 Flash w programowaniu o ponad 12 punktów, kosztując jednocześnie tylko o 50% więcej na input. A w Smart AIPI ta różnica jeszcze bardziej się zmniejsza — płacisz $0.1875/1M input zamiast $0.50 w Gemini.

Kiedy używać którego modelu

Rodzina 5.4 daje teraz trzy poziomy dopasowane do Twojego obciążenia:

GPT-5.4 Mini: koń roboczy dla subagentów

To model, którego chcesz używać do równoległych zadań programistycznych. Jeśli uruchamiasz Codex, Claude Code lub dowolne agentowe narzędzie do programowania, które uruchamia subagentów, Mini jest najlepszym wyborem.

Strategia kosztowa dla subagentów:

  • Uruchom swojego głównego agenta na gpt-5.4 z wysokim reasoning dla decyzji architektonicznych
  • Uruchamiaj subagentów na gpt-5.4-mini z wysokim reasoning dla zadań implementacyjnych
  • Każdy subagent kosztuje ~70% mniej niż uruchomienie na pełnym modelu, a mimo to osiąga 60% w Terminal-Bench
  • 10 równoległych subagentów na Mini kosztuje mniej niż 3 na GPT-5.4 — i kończy pracę szybciej

Mini świetnie sprawdza się także w obsłudze komputera i automatyzacji przeglądarki. Zapewnia solidną dokładność w zadaniach interakcji z UI przy znacznie większej szybkości niż GPT-5.4, co czyni go właściwym wyborem dla agentów do web scrapingu, automatycznych testów i każdego workflow, w którym model ma poruszać się po ekranach i klikać przyciski bez przepalania budżetu.

Wskazówka dla Codex CLI: Ustaw model = "gpt-5.4-mini" w ~/.codex/config.toml wraz z model_reasoning_effort = "high", aby uzyskać szybkiego i skutecznego asystenta programistycznego, który nie wyczerpie Twoich kredytów.

GPT-5.4 Nano: koń roboczy do codziennych zadań

Przy cenie $0.20/1M input (lub $0.05 w Smart AIPI) Nano jest praktycznie darmowy. To nie jest model do programowania — ale nie musi nim być. Używaj go do wszystkiego innego:

  • Klasyfikacja i routing — decydowanie, który model lub tool wywołać
  • Streszczanie — kondensowanie dokumentów, rozmów i wyników wyszukiwania
  • Ekstrakcja danych — wyciąganie ustrukturyzowanych pól z nieustrukturyzowanego tekstu
  • Podstawowe zadania agentowe — proste wieloetapowe workflow, które nie obejmują generowania kodu
  • Tytuły rozmów — sami używamy go do generowania tytułów czatów
  • Moderacja treści — szybkie i tanie filtrowanie treści na dużą skalę

Nano obsługuje zadania, które wcześniej wymagały GPT-4.1 Mini lub GPT-5 Mini, ale przy ułamku kosztu. W pipeline'ach o wysokiej przepustowości, przetwarzających miliony żądań, oszczędności są ogromne.

Uwaga: GPT-5.4 Nano obecnie obsługuje tylko endpoint Chat Completions (/v1/chat/completions). Responses API nie jest jeszcze dostępne dla tego modelu. Jeśli używasz narzędzi takich jak Codex CLI, które wymagają endpoint Responses, użyj zamiast tego Mini.

Inteligentny stos modeli

To wzorzec, który rekomendujemy dla produkcyjnych aplikacji AI:

Zadanie Model Dlaczego
Architektura, złożony reasoning gpt-5.4 Najlepsza w klasie jakość dla krytycznych decyzji
Subagenci do programowania, code review, obsługa komputera gpt-5.4-mini 60% w Terminal-Bench przy koszcie niższym o 70% niż 5.4
Routing, klasyfikacja, podsumowania, ekstrakcja gpt-5.4-nano Prawie darmowy przy $0.05/1M input w Smart AIPI
Generowanie i edycja obrazów gpt-image-1.5 Jakość obrazów klasy frontier
Generowanie wideo sora-2 Wideo do 20 s z tekstu lub obrazu

Szybki start

Oba modele działają z dowolnym SDK OpenAI. Wystarczy ustawić ID modelu:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Szybkie programowanie z Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Tania klasyfikacja z Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Cennik w Smart AIPI

Jak zawsze, 75% taniej niż bezpośredni cennik OpenAI:

Model Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

Dzięki prompt caching (automatycznie, bez potrzeby konfiguracji), długodziałające agenty ze spójnymi prompt systemowymi osiągają 30–50% trafień cache — co jeszcze bardziej obniża koszt Mini w obciążeniach agentowych.

Zacznij teraz

Oba modele są dostępne już teraz. Bez waitlisty, bez potrzeby specjalnego dostępu.

  1. Zarejestruj się po darmowe konto Smart AIPI (zawiera $5 darmowych kredytów)
  2. Ustaw swój base URL na https://api.smartaipi.com/v1
  3. Użyj modelu gpt-5.4-mini lub gpt-5.4-nano
  4. Albo wypróbuj je od razu na chat.smartaipi.com

Era drogiego AI dobiegła końca. Buduj więcej, wydawaj mniej.

GPT-5.4 Mini GPT-5.4 Nano Małe modele
S
Autor
Smart AIPI

Brama API kompatybilna z OpenAI. Uzyskaj dostęp do frontier AI models przy koszcie niższym o 75%.

Zacznij za darmo

Wiadomość wysłana

Odpowiemy w ciągu 2 dni roboczych.

Kontakt z supportem

Masz pytanie albo potrzebujesz pomocy? Wyślij nam wiadomość, a odpowiemy w ciągu 2 dni roboczych.