GPT-5.4 Mini e Nano: Os Novos Reis dos Small Models
GPT-5.4 Mini marca 60% no Terminal-Bench 2.0 por apenas $0.75/1M de input. GPT-5.4 Nano custa $0.20/1M. Ambos já estão disponíveis no Smart AIPI com 75% de desconto — veja como usá-los para agents, coding e computer use.
Resumo: GPT-5.4 Mini e Nano já estão ativos no Smart AIPI. Mini marca 60% no Terminal-Bench 2.0 por $0.75/1M de input. Nano custa apenas $0.20/1M. Ambos estão disponíveis com 75% de desconto. Use gpt-5.4-mini e gpt-5.4-nano em qualquer chamada de API.
A OpenAI acaba de lançar dois novos modelos da família 5.4, e eles mudam a economia do desenvolvimento com AI. GPT-5.4 Mini entrega capacidade de coding próxima da fronteira por uma fração do preço. GPT-5.4 Nano é o modelo de fronteira mais barato já lançado.
Os dois já estão disponíveis no Smart AIPI agora mesmo.
Os números
Veja como os novos modelos se comparam em preço e desempenho:
| Modelo | Terminal-Bench 2.0 | Input /1M | Output /1M | Output no Smart AIPI |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (completo) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini supera o Gemini 3 Flash em coding por mais de 12 pontos custando apenas 50% a mais no input. E no Smart AIPI, essa diferença diminui ainda mais — você paga $0.1875/1M de input em vez dos $0.50 do Gemini.
Quando usar cada modelo
A família 5.4 agora oferece três camadas para combinar com a sua carga de trabalho:
GPT-5.4 Mini: o motor dos subagents
Esse é o modelo ideal para tarefas de coding paralelizadas. Se você está executando Codex, Claude Code ou qualquer ferramenta de coding agentic que cria subagents, Mini é o ponto ideal.
A estratégia de custo com subagents:
- Execute seu agent principal em
gpt-5.4com alto raciocínio para decisões de arquitetura - Crie subagents em
gpt-5.4-minicom alto raciocínio para tarefas de implementação - Cada subagent custa ~70% menos do que executar no modelo completo, mantendo 60% no Terminal-Bench
- 10 subagents paralelos em Mini custam menos do que 3 em GPT-5.4 — e terminam mais rápido
Mini também se destaca em computer use e automação de navegador. Ele entrega boa precisão em tarefas de interação com UI em velocidades muito maiores que o GPT-5.4, tornando-se a escolha certa para agents de web scraping, testes automatizados e qualquer fluxo em que você precise que o modelo navegue por telas e clique em botões sem consumir todo o seu orçamento.
Dica de Codex CLI: Defina model = "gpt-5.4-mini" em ~/.codex/config.toml com model_reasoning_effort = "high" para ter um assistente de coding rápido e capaz, sem drenar seus créditos.
GPT-5.4 Nano: o motor do dia a dia
Por $0.20/1M de input (ou $0.05 no Smart AIPI), Nano é praticamente de graça. Não é um modelo de coding — mas não precisa ser. Use para todo o resto:
- Classificação e routing — decidir qual modelo ou ferramenta invocar
- Summarization — condensar documentos, conversas e resultados de busca
- Extração de dados — puxar campos estruturados de texto não estruturado
- Tarefas agentic básicas — fluxos simples de múltiplas etapas que não envolvem geração de código
- Títulos de conversas — nós mesmos usamos para gerar títulos de chat
- Moderação de conteúdo — filtragem de conteúdo rápida e barata em escala
Nano lida com tarefas que antes exigiam GPT-4.1 Mini ou GPT-5 Mini, mas por uma fração do custo. Para pipelines de alto throughput processando milhões de requisições, a economia é enorme.
Observação: GPT-5.4 Nano atualmente só oferece suporte ao endpoint de Chat Completions (/v1/chat/completions). A Responses API ainda não está disponível para esse modelo. Se você estiver usando ferramentas como Codex CLI que exigem o endpoint Responses, use Mini no lugar.
A stack inteligente de modelos
Este é o padrão que recomendamos para aplicações de AI em produção:
| Tarefa | Modelo | Por quê |
|---|---|---|
| Arquitetura, raciocínio complexo | gpt-5.4 | Qualidade líder da categoria para decisões críticas |
| Subagents de coding, code review, computer use | gpt-5.4-mini | 60% no Terminal-Bench com 70% menos custo do que 5.4 |
| Routing, classificação, resumos, extração | gpt-5.4-nano | Praticamente gratuito a $0.05/1M de input no Smart AIPI |
| Geração e edição de imagens | gpt-image-1.5 | Qualidade de imagem de fronteira |
| Geração de vídeo | sora-2 | Vídeos de até 20s a partir de texto ou imagem |
Início rápido
Ambos os modelos funcionam com qualquer SDK da OpenAI. Basta definir o ID do modelo:
Preços no Smart AIPI
Como sempre, 75% abaixo do preço direto da OpenAI:
| Modelo | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Com prompt caching (automático, sem necessidade de configuração), agents de longa duração com prompts de sistema consistentes têm taxas de acerto de cache de 30-50% — tornando Mini ainda mais barato para cargas de trabalho agentic.
Comece agora
Ambos os modelos estão disponíveis neste momento. Sem waitlist, sem necessidade de acesso especial.
- Cadastre-se para uma conta gratuita do Smart AIPI (inclui $5 em créditos grátis)
- Defina sua base URL como
https://api.smartaipi.com/v1 - Use o modelo
gpt-5.4-miniougpt-5.4-nano - Ou teste instantaneamente em chat.smartaipi.com
A era da AI cara acabou. Construa mais, gaste menos.
Gateway de API compatível com OpenAI. Acesse modelos de AI de ponta com 75% menos custo.
Comece grátis