GPT-5.4 Mini i Nano: nowi królowie małych modeli
GPT-5.4 Mini osiąga 60% w Terminal-Bench 2.0 przy zaledwie $0.75/1M input. GPT-5.4 Nano kosztuje $0.20/1M. Oba są już dostępne w Smart AIPI z 75% zniżką — oto jak używać ich do agentów, programowania i obsługi komputera.
W skrócie: GPT-5.4 Mini i Nano są już dostępne w Smart AIPI. Mini osiąga 60% w Terminal-Bench 2.0 przy cenie $0.75/1M input. Nano kosztuje tylko $0.20/1M. Oba modele są dostępne z 75% zniżką. Użyj gpt-5.4-mini i gpt-5.4-nano w dowolnym wywołaniu API.
OpenAI właśnie wypuściło dwa nowe modele z rodziny 5.4 i zmieniają one ekonomię rozwoju AI. GPT-5.4 Mini oferuje możliwości programistyczne bliskie frontier przy ułamku ceny. GPT-5.4 Nano to najtańszy model frontier, jaki kiedykolwiek udostępniono.
Oba są już teraz dostępne w Smart AIPI.
Liczby
Tak nowe modele wypadają pod względem ceny i wydajności:
| Model | Terminal-Bench 2.0 | Input /1M | Output /1M | Output w Smart AIPI |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/D |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini pokonuje Gemini 3 Flash w programowaniu o ponad 12 punktów, kosztując jednocześnie tylko o 50% więcej na input. A w Smart AIPI ta różnica jeszcze bardziej się zmniejsza — płacisz $0.1875/1M input zamiast $0.50 w Gemini.
Kiedy używać którego modelu
Rodzina 5.4 daje teraz trzy poziomy dopasowane do Twojego obciążenia:
GPT-5.4 Mini: koń roboczy dla subagentów
To model, którego chcesz używać do równoległych zadań programistycznych. Jeśli uruchamiasz Codex, Claude Code lub dowolne agentowe narzędzie do programowania, które uruchamia subagentów, Mini jest najlepszym wyborem.
Strategia kosztowa dla subagentów:
- Uruchom swojego głównego agenta na
gpt-5.4z wysokim reasoning dla decyzji architektonicznych - Uruchamiaj subagentów na
gpt-5.4-miniz wysokim reasoning dla zadań implementacyjnych - Każdy subagent kosztuje ~70% mniej niż uruchomienie na pełnym modelu, a mimo to osiąga 60% w Terminal-Bench
- 10 równoległych subagentów na Mini kosztuje mniej niż 3 na GPT-5.4 — i kończy pracę szybciej
Mini świetnie sprawdza się także w obsłudze komputera i automatyzacji przeglądarki. Zapewnia solidną dokładność w zadaniach interakcji z UI przy znacznie większej szybkości niż GPT-5.4, co czyni go właściwym wyborem dla agentów do web scrapingu, automatycznych testów i każdego workflow, w którym model ma poruszać się po ekranach i klikać przyciski bez przepalania budżetu.
Wskazówka dla Codex CLI: Ustaw model = "gpt-5.4-mini" w ~/.codex/config.toml wraz z model_reasoning_effort = "high", aby uzyskać szybkiego i skutecznego asystenta programistycznego, który nie wyczerpie Twoich kredytów.
GPT-5.4 Nano: koń roboczy do codziennych zadań
Przy cenie $0.20/1M input (lub $0.05 w Smart AIPI) Nano jest praktycznie darmowy. To nie jest model do programowania — ale nie musi nim być. Używaj go do wszystkiego innego:
- Klasyfikacja i routing — decydowanie, który model lub tool wywołać
- Streszczanie — kondensowanie dokumentów, rozmów i wyników wyszukiwania
- Ekstrakcja danych — wyciąganie ustrukturyzowanych pól z nieustrukturyzowanego tekstu
- Podstawowe zadania agentowe — proste wieloetapowe workflow, które nie obejmują generowania kodu
- Tytuły rozmów — sami używamy go do generowania tytułów czatów
- Moderacja treści — szybkie i tanie filtrowanie treści na dużą skalę
Nano obsługuje zadania, które wcześniej wymagały GPT-4.1 Mini lub GPT-5 Mini, ale przy ułamku kosztu. W pipeline'ach o wysokiej przepustowości, przetwarzających miliony żądań, oszczędności są ogromne.
Uwaga: GPT-5.4 Nano obecnie obsługuje tylko endpoint Chat Completions (/v1/chat/completions). Responses API nie jest jeszcze dostępne dla tego modelu. Jeśli używasz narzędzi takich jak Codex CLI, które wymagają endpoint Responses, użyj zamiast tego Mini.
Inteligentny stos modeli
To wzorzec, który rekomendujemy dla produkcyjnych aplikacji AI:
| Zadanie | Model | Dlaczego |
|---|---|---|
| Architektura, złożony reasoning | gpt-5.4 | Najlepsza w klasie jakość dla krytycznych decyzji |
| Subagenci do programowania, code review, obsługa komputera | gpt-5.4-mini | 60% w Terminal-Bench przy koszcie niższym o 70% niż 5.4 |
| Routing, klasyfikacja, podsumowania, ekstrakcja | gpt-5.4-nano | Prawie darmowy przy $0.05/1M input w Smart AIPI |
| Generowanie i edycja obrazów | gpt-image-1.5 | Jakość obrazów klasy frontier |
| Generowanie wideo | sora-2 | Wideo do 20 s z tekstu lub obrazu |
Szybki start
Oba modele działają z dowolnym SDK OpenAI. Wystarczy ustawić ID modelu:
Cennik w Smart AIPI
Jak zawsze, 75% taniej niż bezpośredni cennik OpenAI:
| Model | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Dzięki prompt caching (automatycznie, bez potrzeby konfiguracji), długodziałające agenty ze spójnymi prompt systemowymi osiągają 30–50% trafień cache — co jeszcze bardziej obniża koszt Mini w obciążeniach agentowych.
Zacznij teraz
Oba modele są dostępne już teraz. Bez waitlisty, bez potrzeby specjalnego dostępu.
- Zarejestruj się po darmowe konto Smart AIPI (zawiera $5 darmowych kredytów)
- Ustaw swój base URL na
https://api.smartaipi.com/v1 - Użyj modelu
gpt-5.4-minilubgpt-5.4-nano - Albo wypróbuj je od razu na chat.smartaipi.com
Era drogiego AI dobiegła końca. Buduj więcej, wydawaj mniej.
Brama API kompatybilna z OpenAI. Uzyskaj dostęp do frontier AI models przy koszcie niższym o 75%.
Zacznij za darmo