GPT-5.4 Mini e Nano: Os Novos Reis dos Small Models

GPT-5.4 Mini marca 60% no Terminal-Bench 2.0 por apenas $0.75/1M de input. GPT-5.4 Nano custa $0.20/1M. Ambos já estão disponíveis no Smart AIPI com 75% de desconto — veja como usá-los para agents, coding e computer use.

S
Smart AIPI Team
6 min de leitura ·
GPT-5.4 Mini e Nano: Os Novos Reis dos Small Models
GPT-5.4 Mini selecionado no seletor de modelos

Resumo: GPT-5.4 Mini e Nano já estão ativos no Smart AIPI. Mini marca 60% no Terminal-Bench 2.0 por $0.75/1M de input. Nano custa apenas $0.20/1M. Ambos estão disponíveis com 75% de desconto. Use gpt-5.4-mini e gpt-5.4-nano em qualquer chamada de API.

A OpenAI acaba de lançar dois novos modelos da família 5.4, e eles mudam a economia do desenvolvimento com AI. GPT-5.4 Mini entrega capacidade de coding próxima da fronteira por uma fração do preço. GPT-5.4 Nano é o modelo de fronteira mais barato já lançado.

Os dois já estão disponíveis no Smart AIPI agora mesmo.

Os números

Veja como os novos modelos se comparam em preço e desempenho:

Gráfico de preço vs capacidade de coding mostrando GPT-5.4 Mini com 60% no Terminal-Bench 2.0, GPT-5.4 Nano com 46% e Gemini 3 Flash com 47.7%
Modelo Terminal-Bench 2.0 Input /1M Output /1M Output no Smart AIPI
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (completo) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini supera o Gemini 3 Flash em coding por mais de 12 pontos custando apenas 50% a mais no input. E no Smart AIPI, essa diferença diminui ainda mais — você paga $0.1875/1M de input em vez dos $0.50 do Gemini.

Quando usar cada modelo

A família 5.4 agora oferece três camadas para combinar com a sua carga de trabalho:

GPT-5.4 Mini: o motor dos subagents

Esse é o modelo ideal para tarefas de coding paralelizadas. Se você está executando Codex, Claude Code ou qualquer ferramenta de coding agentic que cria subagents, Mini é o ponto ideal.

A estratégia de custo com subagents:

  • Execute seu agent principal em gpt-5.4 com alto raciocínio para decisões de arquitetura
  • Crie subagents em gpt-5.4-mini com alto raciocínio para tarefas de implementação
  • Cada subagent custa ~70% menos do que executar no modelo completo, mantendo 60% no Terminal-Bench
  • 10 subagents paralelos em Mini custam menos do que 3 em GPT-5.4 — e terminam mais rápido

Mini também se destaca em computer use e automação de navegador. Ele entrega boa precisão em tarefas de interação com UI em velocidades muito maiores que o GPT-5.4, tornando-se a escolha certa para agents de web scraping, testes automatizados e qualquer fluxo em que você precise que o modelo navegue por telas e clique em botões sem consumir todo o seu orçamento.

Dica de Codex CLI: Defina model = "gpt-5.4-mini" em ~/.codex/config.toml com model_reasoning_effort = "high" para ter um assistente de coding rápido e capaz, sem drenar seus créditos.

GPT-5.4 Nano: o motor do dia a dia

Por $0.20/1M de input (ou $0.05 no Smart AIPI), Nano é praticamente de graça. Não é um modelo de coding — mas não precisa ser. Use para todo o resto:

  • Classificação e routing — decidir qual modelo ou ferramenta invocar
  • Summarization — condensar documentos, conversas e resultados de busca
  • Extração de dados — puxar campos estruturados de texto não estruturado
  • Tarefas agentic básicas — fluxos simples de múltiplas etapas que não envolvem geração de código
  • Títulos de conversas — nós mesmos usamos para gerar títulos de chat
  • Moderação de conteúdo — filtragem de conteúdo rápida e barata em escala

Nano lida com tarefas que antes exigiam GPT-4.1 Mini ou GPT-5 Mini, mas por uma fração do custo. Para pipelines de alto throughput processando milhões de requisições, a economia é enorme.

Observação: GPT-5.4 Nano atualmente só oferece suporte ao endpoint de Chat Completions (/v1/chat/completions). A Responses API ainda não está disponível para esse modelo. Se você estiver usando ferramentas como Codex CLI que exigem o endpoint Responses, use Mini no lugar.

A stack inteligente de modelos

Este é o padrão que recomendamos para aplicações de AI em produção:

Tarefa Modelo Por quê
Arquitetura, raciocínio complexo gpt-5.4 Qualidade líder da categoria para decisões críticas
Subagents de coding, code review, computer use gpt-5.4-mini 60% no Terminal-Bench com 70% menos custo do que 5.4
Routing, classificação, resumos, extração gpt-5.4-nano Praticamente gratuito a $0.05/1M de input no Smart AIPI
Geração e edição de imagens gpt-image-1.5 Qualidade de imagem de fronteira
Geração de vídeo sora-2 Vídeos de até 20s a partir de texto ou imagem

Início rápido

Ambos os modelos funcionam com qualquer SDK da OpenAI. Basta definir o ID do modelo:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Coding rápido com Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Classificação barata com Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Preços no Smart AIPI

Como sempre, 75% abaixo do preço direto da OpenAI:

Modelo Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

Com prompt caching (automático, sem necessidade de configuração), agents de longa duração com prompts de sistema consistentes têm taxas de acerto de cache de 30-50% — tornando Mini ainda mais barato para cargas de trabalho agentic.

Comece agora

Ambos os modelos estão disponíveis neste momento. Sem waitlist, sem necessidade de acesso especial.

  1. Cadastre-se para uma conta gratuita do Smart AIPI (inclui $5 em créditos grátis)
  2. Defina sua base URL como https://api.smartaipi.com/v1
  3. Use o modelo gpt-5.4-mini ou gpt-5.4-nano
  4. Ou teste instantaneamente em chat.smartaipi.com

A era da AI cara acabou. Construa mais, gaste menos.

GPT-5.4 Mini GPT-5.4 Nano Small Models
S
Escrito por
Smart AIPI

Gateway de API compatível com OpenAI. Acesse modelos de AI de ponta com 75% menos custo.

Comece grátis

Mensagem enviada

Responderemos em até 2 dias úteis.

Fale com o Suporte

Tem alguma dúvida ou precisa de ajuda? Envie uma mensagem e responderemos em até 2 dias úteis.