GPT-5.4 Mini y Nano: Los nuevos reyes de los modelos pequeños

GPT-5.4 Mini obtiene un 60% en Terminal-Bench 2.0 por solo $0.75/1M de entrada. GPT-5.4 Nano cuesta $0.20/1M. Ambos ya están disponibles en Smart AIPI con un 75% de descuento — así puedes usarlos para agentes, coding y uso de computadora.

S
Smart AIPI Team
6 min de lectura ·
GPT-5.4 Mini y Nano: Los nuevos reyes de los modelos pequeños
GPT-5.4 Mini seleccionado en el selector de modelos

TL;DR: GPT-5.4 Mini y Nano ya están disponibles en Smart AIPI. Mini obtiene un 60% en Terminal-Bench 2.0 por $0.75/1M de entrada. Nano cuesta solo $0.20/1M. Ambos están disponibles con un 75% de descuento. Usa gpt-5.4-mini y gpt-5.4-nano en cualquier llamada a la API.

OpenAI acaba de lanzar dos nuevos modelos de la familia 5.4, y cambian la economía del desarrollo de AI. GPT-5.4 Mini ofrece una capacidad de coding cercana a la frontera por una fracción del precio. GPT-5.4 Nano es el modelo frontier más barato jamás lanzado.

Ambos están disponibles ahora mismo en Smart AIPI.

Los números

Así se comparan los nuevos modelos en precio y rendimiento:

Gráfico de precio vs capacidad de coding que muestra GPT-5.4 Mini con 60% de puntuación en Terminal-Bench 2.0, GPT-5.4 Nano con 46%, y Gemini 3 Flash con 47.7%
Modelo Terminal-Bench 2.0 Entrada /1M Salida /1M Salida en Smart AIPI
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (completo) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini supera a Gemini 3 Flash en coding por más de 12 puntos mientras cuesta solo un 50% más en entrada. Y en Smart AIPI, esa diferencia se reduce aún más — pagas $0.1875/1M de entrada en lugar de los $0.50 de Gemini.

Cuándo usar cada modelo

La familia 5.4 ahora te ofrece tres niveles para ajustarse a tu carga de trabajo:

GPT-5.4 Mini: el caballo de batalla para subagentes

Este es el modelo que quieres para tareas de coding paralelizadas. Si estás ejecutando Codex, Claude Code o cualquier herramienta de coding agéntico que genere subagentes, Mini es el punto óptimo.

La jugada de costos con subagentes:

  • Ejecuta tu agente principal en gpt-5.4 con razonamiento alto para decisiones de arquitectura
  • Lanza subagentes en gpt-5.4-mini con razonamiento alto para tareas de implementación
  • Cada subagente cuesta ~70% menos que ejecutarlo en el modelo completo, y aun así obtiene 60% en Terminal-Bench
  • 10 subagentes paralelos en Mini cuestan menos que 3 en GPT-5.4 — y terminan más rápido

Mini también destaca en uso de computadora y automatización del navegador. Ofrece una precisión sólida en tareas de interacción con UI a velocidades mucho mayores que GPT-5.4, lo que lo convierte en la opción correcta para agentes de web scraping, pruebas automatizadas y cualquier flujo de trabajo en el que necesites que el modelo navegue por pantallas y haga clic en botones sin consumir tu presupuesto.

Consejo para Codex CLI: Configura model = "gpt-5.4-mini" en ~/.codex/config.toml con model_reasoning_effort = "high" para tener un asistente de coding rápido y capaz que no agote tus créditos.

GPT-5.4 Nano: el caballo de batalla de todos los días

Con $0.20/1M de entrada (o $0.05 en Smart AIPI), Nano es prácticamente gratis. No es un modelo de coding — pero no necesita serlo. Úsalo para todo lo demás:

  • Clasificación y routing — decidir qué modelo o herramienta invocar
  • Resúmenes — condensar documentos, conversaciones y resultados de búsqueda
  • Extracción de datos — extraer campos estructurados de texto no estructurado
  • Tareas agénticas básicas — flujos de trabajo simples de varios pasos que no implican generación de código
  • Títulos de conversaciones — nosotros mismos lo usamos para generar títulos de chat
  • Moderación de contenido — filtrado de contenido rápido y barato a escala

Nano maneja tareas que antes requerían GPT-4.1 Mini o GPT-5 Mini, pero a una fracción del costo. Para pipelines de alto volumen que procesan millones de solicitudes, el ahorro es enorme.

Nota: GPT-5.4 Nano actualmente solo admite el endpoint de Chat Completions (/v1/chat/completions). La Responses API todavía no está disponible para este modelo. Si estás usando herramientas como Codex CLI que requieren el endpoint de Responses, usa Mini en su lugar.

La pila de modelos inteligente

Este es el patrón que recomendamos para aplicaciones de AI en producción:

Tarea Modelo Por qué
Arquitectura, razonamiento complejo gpt-5.4 La mejor calidad de su clase para decisiones críticas
Subagentes de coding, revisión de código, uso de computadora gpt-5.4-mini 60% en Terminal-Bench con un 70% menos de costo que 5.4
Routing, clasificación, resúmenes, extracción gpt-5.4-nano Casi gratis a $0.05/1M de entrada en Smart AIPI
Generación y edición de imágenes gpt-image-1.5 Calidad de imagen frontier
Generación de video sora-2 Hasta 20s de video a partir de texto o imagen

Inicio rápido

Ambos modelos funcionan con cualquier SDK de OpenAI. Solo establece el ID del modelo:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Coding rápido con Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Clasificación barata con Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Precios en Smart AIPI

Como siempre, 75% de descuento sobre el precio directo de OpenAI:

Modelo Entrada /1M Entrada cacheada /1M Salida /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

Con prompt caching (automático, sin necesidad de configuración), los agentes de larga duración con prompts de sistema consistentes ven tasas de acierto de caché del 30-50% — lo que hace que Mini sea aún más barato para cargas de trabajo agénticas.

Empieza ahora

Ambos modelos están disponibles ahora mismo. Sin lista de espera, sin acceso especial.

  1. Regístrate para obtener una cuenta gratuita de Smart AIPI (incluye $5 en créditos gratis)
  2. Configura tu base URL en https://api.smartaipi.com/v1
  3. Usa el modelo gpt-5.4-mini o gpt-5.4-nano
  4. O pruébalos al instante en chat.smartaipi.com

La era de la AI cara ha terminado. Construye más, gasta menos.

GPT-5.4 Mini GPT-5.4 Nano Modelos pequeños
S
Escrito por
Smart AIPI

Puerta de enlace de API compatible con OpenAI. Accede a modelos de AI de frontera con un 75% menos de costo.

Empieza gratis

Mensaje enviado

Te responderemos en un plazo de 2 días hábiles.

Contactar soporte

¿Tienes una pregunta o necesitas ayuda? Envíanos un mensaje y te responderemos en un plazo de 2 días hábiles.