GPT-5.4 Mini en Nano: de nieuwe koningen van kleine modellen

GPT-5.4 Mini scoort 60% op Terminal-Bench 2.0 voor slechts $0.75/1M input. GPT-5.4 Nano kost $0.20/1M. Beide zijn nu beschikbaar op Smart AIPI met 75% korting — zo gebruik je ze voor agents, coderen en computergebruik.

S
Smart AIPI Team
6 min leestijd ·
GPT-5.4 Mini en Nano: de nieuwe koningen van kleine modellen
GPT-5.4 Mini geselecteerd in modelkiezer

TL;DR: GPT-5.4 Mini en Nano zijn live op Smart AIPI. Mini scoort 60% op Terminal-Bench 2.0 bij $0.75/1M input. Nano kost slechts $0.20/1M. Beide zijn beschikbaar met 75% korting. Gebruik gpt-5.4-mini en gpt-5.4-nano in elke API-aanroep.

OpenAI heeft zojuist twee nieuwe modellen uitgebracht in de 5.4-familie, en die veranderen de economie van AI-ontwikkeling. GPT-5.4 Mini levert bijna frontier-niveau codeercapaciteit voor een fractie van de prijs. GPT-5.4 Nano is het goedkoopste frontier-model dat ooit is uitgebracht.

Beide zijn nu live op Smart AIPI.

De cijfers

Zo vergelijken de nieuwe modellen zich op prijs en prestaties:

Grafiek prijs vs codeercapaciteit met GPT-5.4 Mini op 60% Terminal-Bench 2.0-score, GPT-5.4 Nano op 46%, en Gemini 3 Flash op 47.7%
Model Terminal-Bench 2.0 Input /1M Output /1M Smart AIPI Output
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N.v.t.
GPT-5.4 (volledig) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini verslaat Gemini 3 Flash op coderen met 12+ punten terwijl het op input slechts 50% meer kost. En op Smart AIPI wordt dat gat nog kleiner — je betaalt $0.1875/1M input in plaats van Gemini's $0.50.

Wanneer gebruik je welk model

De 5.4-familie geeft je nu drie niveaus om op je workload af te stemmen:

GPT-5.4 Mini: het werkpaard voor subagents

Dit is het model dat je wilt voor geparalleliseerde codeertaken. Als je Codex, Claude Code of een andere agentische codeertool gebruikt die subagents start, dan is Mini de ideale middenweg.

De kostenstrategie voor subagents:

  • Draai je hoofdagent op gpt-5.4 met hoge reasoning voor architectuurbeslissingen
  • Start subagents op gpt-5.4-mini met hoge reasoning voor implementatietaken
  • Elke subagent kost ~70% minder dan draaien op het volledige model, terwijl hij nog steeds 60% scoort op Terminal-Bench
  • 10 parallelle subagents op Mini kosten minder dan 3 op GPT-5.4 — en zijn sneller klaar

Mini blinkt ook uit in computergebruik en browserautomatisering. Het levert solide nauwkeurigheid op UI-interactietaken bij veel hogere snelheden dan GPT-5.4, waardoor het de juiste keuze is voor web scraping-agents, geautomatiseerd testen en elke workflow waarin je het model schermen wilt laten navigeren en op knoppen wilt laten klikken zonder je budget op te branden.

Codex CLI-tip: Stel model = "gpt-5.4-mini" in in ~/.codex/config.toml met model_reasoning_effort = "high" voor een snelle, capabele codeerassistent die je credits niet leegtrekt.

GPT-5.4 Nano: het dagelijkse werkpaard

Met $0.20/1M input (of $0.05 op Smart AIPI) is Nano praktisch gratis. Het is geen codeermodel — maar dat hoeft ook niet. Gebruik het voor alles daarbuiten:

  • Classificatie en routing — bepaal welk model of hulpmiddel je moet aanroepen
  • Samenvatting — vat documenten, gesprekken en zoekresultaten samen
  • Data-extractie — haal gestructureerde velden uit ongestructureerde tekst
  • Basis agentische taken — eenvoudige meerstapsworkflows zonder codegeneratie
  • Gesprekstitels — wij gebruiken het zelf voor het genereren van chattitels
  • Contentmoderatie — snelle, goedkope contentfiltering op schaal

Nano verwerkt taken waarvoor eerder GPT-4.1 Mini of GPT-5 Mini nodig was, maar dan voor een fractie van de kosten. Voor high-throughput pipelines die miljoenen requests verwerken, zijn de besparingen enorm.

Opmerking: GPT-5.4 Nano ondersteunt momenteel alleen de Chat Completions endpoint (/v1/chat/completions). De Responses API is nog niet beschikbaar voor dit model. Als je tools gebruikt zoals Codex CLI die de Responses endpoint vereisen, gebruik dan Mini.

De slimme modelstack

Dit is het patroon dat we aanbevelen voor productie-AI-applicaties:

Taak Model Waarom
Architectuur, complexe reasoning gpt-5.4 Beste kwaliteit in zijn klasse voor kritieke beslissingen
Coding-subagents, code review, computergebruik gpt-5.4-mini 60% Terminal-Bench bij 70% lagere kosten dan 5.4
Routing, classificatie, samenvattingen, extractie gpt-5.4-nano Bijna gratis met $0.05/1M input op Smart AIPI
Afbeeldingsgeneratie en bewerking gpt-image-1.5 Frontier-beeldkwaliteit
Videogeneratie sora-2 Tot 20s video uit tekst of afbeelding

Snel aan de slag

Beide modellen werken met elke OpenAI SDK. Stel gewoon de model-ID in:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Snel coderen met Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Goedkope classificatie met Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Prijzen op Smart AIPI

Zoals altijd 75% korting op de directe prijzen van OpenAI:

Model Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

Met prompt caching (automatisch, geen setup nodig) zien langlopende agents met consistente system prompts cache hit-rates van 30-50% — waardoor Mini nog goedkoper wordt voor agentische workloads.

Begin vandaag

Beide modellen zijn nu direct beschikbaar. Geen wachtlijst, geen speciale toegang nodig.

  1. Meld je aan voor een gratis Smart AIPI-account (inclusief $5 gratis credits)
  2. Stel je base URL in op https://api.smartaipi.com/v1
  3. Gebruik model gpt-5.4-mini of gpt-5.4-nano
  4. Of probeer ze direct op chat.smartaipi.com

Het tijdperk van dure AI is voorbij. Bouw meer, geef minder uit.

GPT-5.4 Mini GPT-5.4 Nano Kleine modellen
S
Geschreven door
Smart AIPI

OpenAI-compatible API gateway. Krijg toegang tot frontier AI-modellen voor 75% lagere kosten.

Gratis starten

Bericht verzonden

We nemen binnen 2 werkdagen contact met je op.

Contact opnemen met support

Heb je een vraag of hulp nodig? Stuur ons een bericht en we nemen binnen 2 werkdagen contact met je op.