GPT-5.4 Mini e Nano: i nuovi re dei Small Models
GPT-5.4 Mini ottiene il 60% su Terminal-Bench 2.0 a soli $0.75/1M input. GPT-5.4 Nano costa $0.20/1M. Entrambi sono disponibili ora su Smart AIPI con il 75% di sconto — ecco come usarli per agenti, coding e computer use.
TL;DR: GPT-5.4 Mini e Nano sono attivi su Smart AIPI. Mini ottiene il 60% su Terminal-Bench 2.0 a $0.75/1M input. Nano costa solo $0.20/1M. Entrambi sono disponibili con il 75% di sconto. Usa gpt-5.4-mini e gpt-5.4-nano in qualsiasi chiamata API.
OpenAI ha appena rilasciato due nuovi modelli della famiglia 5.4 e cambiano l'economia dello sviluppo AI. GPT-5.4 Mini offre capacità di coding quasi da frontiera a una frazione del prezzo. GPT-5.4 Nano è il modello frontier più economico mai rilasciato.
Entrambi sono già attivi su Smart AIPI.
I numeri
Ecco come si confrontano i nuovi modelli in termini di prezzo e prestazioni:
| Modello | Terminal-Bench 2.0 | Input /1M | Output /1M | Output Smart AIPI |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/D |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini supera Gemini 3 Flash nel coding di oltre 12 punti pur costando solo il 50% in più sull'input. E su Smart AIPI questo divario si riduce ulteriormente — paghi $0.1875/1M input invece dei $0.50 di Gemini.
Quando usare quale modello
La famiglia 5.4 ora ti offre tre livelli per adattarsi al tuo carico di lavoro:
GPT-5.4 Mini: il cavallo di battaglia dei subagent
Questo è il modello giusto per task di coding parallelizzati. Se stai usando Codex, Claude Code o qualsiasi strumento di coding agentico che genera subagent, Mini è il punto ottimale.
La strategia di costo dei subagent:
- Esegui il tuo agente principale su
gpt-5.4con reasoning elevato per le decisioni di architettura - Genera subagent su
gpt-5.4-minicon reasoning elevato per i task di implementazione - Ogni subagent costa ~70% in meno rispetto all'esecuzione sul modello completo, pur ottenendo il 60% su Terminal-Bench
- 10 subagent paralleli su Mini costano meno di 3 su GPT-5.4 — e finiscono più velocemente
Mini eccelle anche in computer use e browser automation. Offre una buona accuratezza nei task di interazione UI a velocità molto più elevate rispetto a GPT-5.4, rendendolo la scelta giusta per agenti di web scraping, test automatizzati e qualsiasi workflow in cui hai bisogno che il modello navighi tra schermate e clicchi pulsanti senza consumare il budget.
Suggerimento per Codex CLI: imposta model = "gpt-5.4-mini" in ~/.codex/config.toml con model_reasoning_effort = "high" per avere un assistente di coding rapido e capace che non prosciughi i tuoi crediti.
GPT-5.4 Nano: il cavallo di battaglia di tutti i giorni
A $0.20/1M input (o $0.05 su Smart AIPI), Nano è praticamente gratis. Non è un modello da coding — ma non ne ha bisogno. Usalo per tutto il resto:
- Classificazione e routing — decidere quale modello o tool invocare
- Riepilogo — condensare documenti, conversazioni, risultati di ricerca
- Estrazione dati — estrarre campi strutturati da testo non strutturato
- Task agentici di base — workflow semplici in più passaggi che non coinvolgono generazione di codice
- Titoli delle conversazioni — lo usiamo noi stessi per generare titoli di chat
- Content moderation — filtro dei contenuti rapido ed economico su larga scala
Nano gestisce task che in precedenza richiedevano GPT-4.1 Mini o GPT-5 Mini ma a una frazione del costo. Per pipeline ad alto throughput che elaborano milioni di richieste, il risparmio è enorme.
Nota: GPT-5.4 Nano al momento supporta solo l'endpoint Chat Completions (/v1/chat/completions). La Responses API non è ancora disponibile per questo modello. Se stai usando tool come Codex CLI che richiedono l'endpoint Responses, usa invece Mini.
Lo stack di modelli intelligente
Ecco il pattern che consigliamo per le applicazioni AI in produzione:
| Task | Modello | Perché |
|---|---|---|
| Architettura, reasoning complesso | gpt-5.4 | Qualità best-in-class per decisioni critiche |
| Subagent di coding, code review, computer use | gpt-5.4-mini | 60% su Terminal-Bench con il 70% di costo in meno rispetto a 5.4 |
| Routing, classificazione, riepiloghi, estrazione | gpt-5.4-nano | Quasi gratis a $0.05/1M input su Smart AIPI |
| Generazione e modifica immagini | gpt-image-1.5 | Qualità immagini frontier |
| Generazione video | sora-2 | Video fino a 20s da testo o immagine |
Avvio rapido
Entrambi i modelli funzionano con qualsiasi SDK OpenAI. Basta impostare l'ID del modello:
Prezzi su Smart AIPI
Come sempre, 75% di sconto rispetto ai prezzi diretti OpenAI:
| Modello | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Con prompt caching (automatico, senza configurazione necessaria), gli agenti di lunga durata con system prompt coerenti vedono tassi di cache hit del 30-50% — rendendo Mini ancora più economico per i workload agentici.
Inizia ora
Entrambi i modelli sono disponibili da subito. Nessuna waitlist, nessun accesso speciale richiesto.
- Registrati per un account Smart AIPI gratuito (include $5 di crediti gratis)
- Imposta il tuo base URL su
https://api.smartaipi.com/v1 - Usa il modello
gpt-5.4-miniogpt-5.4-nano - Oppure provali subito su chat.smartaipi.com
L'era dell'AI costosa è finita. Costruisci di più, spendi meno.
Gateway API compatibile con OpenAI. Accedi ai modelli AI frontier con un costo inferiore del 75%.
Inizia gratis