GPT-5.4 Mini y Nano: Los nuevos reyes de los modelos pequeños
GPT-5.4 Mini obtiene un 60% en Terminal-Bench 2.0 por solo $0.75/1M de entrada. GPT-5.4 Nano cuesta $0.20/1M. Ambos ya están disponibles en Smart AIPI con un 75% de descuento — así puedes usarlos para agentes, coding y uso de computadora.
TL;DR: GPT-5.4 Mini y Nano ya están disponibles en Smart AIPI. Mini obtiene un 60% en Terminal-Bench 2.0 por $0.75/1M de entrada. Nano cuesta solo $0.20/1M. Ambos están disponibles con un 75% de descuento. Usa gpt-5.4-mini y gpt-5.4-nano en cualquier llamada a la API.
OpenAI acaba de lanzar dos nuevos modelos de la familia 5.4, y cambian la economía del desarrollo de AI. GPT-5.4 Mini ofrece una capacidad de coding cercana a la frontera por una fracción del precio. GPT-5.4 Nano es el modelo frontier más barato jamás lanzado.
Ambos están disponibles ahora mismo en Smart AIPI.
Los números
Así se comparan los nuevos modelos en precio y rendimiento:
| Modelo | Terminal-Bench 2.0 | Entrada /1M | Salida /1M | Salida en Smart AIPI |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (completo) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini supera a Gemini 3 Flash en coding por más de 12 puntos mientras cuesta solo un 50% más en entrada. Y en Smart AIPI, esa diferencia se reduce aún más — pagas $0.1875/1M de entrada en lugar de los $0.50 de Gemini.
Cuándo usar cada modelo
La familia 5.4 ahora te ofrece tres niveles para ajustarse a tu carga de trabajo:
GPT-5.4 Mini: el caballo de batalla para subagentes
Este es el modelo que quieres para tareas de coding paralelizadas. Si estás ejecutando Codex, Claude Code o cualquier herramienta de coding agéntico que genere subagentes, Mini es el punto óptimo.
La jugada de costos con subagentes:
- Ejecuta tu agente principal en
gpt-5.4con razonamiento alto para decisiones de arquitectura - Lanza subagentes en
gpt-5.4-minicon razonamiento alto para tareas de implementación - Cada subagente cuesta ~70% menos que ejecutarlo en el modelo completo, y aun así obtiene 60% en Terminal-Bench
- 10 subagentes paralelos en Mini cuestan menos que 3 en GPT-5.4 — y terminan más rápido
Mini también destaca en uso de computadora y automatización del navegador. Ofrece una precisión sólida en tareas de interacción con UI a velocidades mucho mayores que GPT-5.4, lo que lo convierte en la opción correcta para agentes de web scraping, pruebas automatizadas y cualquier flujo de trabajo en el que necesites que el modelo navegue por pantallas y haga clic en botones sin consumir tu presupuesto.
Consejo para Codex CLI: Configura model = "gpt-5.4-mini" en ~/.codex/config.toml con model_reasoning_effort = "high" para tener un asistente de coding rápido y capaz que no agote tus créditos.
GPT-5.4 Nano: el caballo de batalla de todos los días
Con $0.20/1M de entrada (o $0.05 en Smart AIPI), Nano es prácticamente gratis. No es un modelo de coding — pero no necesita serlo. Úsalo para todo lo demás:
- Clasificación y routing — decidir qué modelo o herramienta invocar
- Resúmenes — condensar documentos, conversaciones y resultados de búsqueda
- Extracción de datos — extraer campos estructurados de texto no estructurado
- Tareas agénticas básicas — flujos de trabajo simples de varios pasos que no implican generación de código
- Títulos de conversaciones — nosotros mismos lo usamos para generar títulos de chat
- Moderación de contenido — filtrado de contenido rápido y barato a escala
Nano maneja tareas que antes requerían GPT-4.1 Mini o GPT-5 Mini, pero a una fracción del costo. Para pipelines de alto volumen que procesan millones de solicitudes, el ahorro es enorme.
Nota: GPT-5.4 Nano actualmente solo admite el endpoint de Chat Completions (/v1/chat/completions). La Responses API todavía no está disponible para este modelo. Si estás usando herramientas como Codex CLI que requieren el endpoint de Responses, usa Mini en su lugar.
La pila de modelos inteligente
Este es el patrón que recomendamos para aplicaciones de AI en producción:
| Tarea | Modelo | Por qué |
|---|---|---|
| Arquitectura, razonamiento complejo | gpt-5.4 | La mejor calidad de su clase para decisiones críticas |
| Subagentes de coding, revisión de código, uso de computadora | gpt-5.4-mini | 60% en Terminal-Bench con un 70% menos de costo que 5.4 |
| Routing, clasificación, resúmenes, extracción | gpt-5.4-nano | Casi gratis a $0.05/1M de entrada en Smart AIPI |
| Generación y edición de imágenes | gpt-image-1.5 | Calidad de imagen frontier |
| Generación de video | sora-2 | Hasta 20s de video a partir de texto o imagen |
Inicio rápido
Ambos modelos funcionan con cualquier SDK de OpenAI. Solo establece el ID del modelo:
Precios en Smart AIPI
Como siempre, 75% de descuento sobre el precio directo de OpenAI:
| Modelo | Entrada /1M | Entrada cacheada /1M | Salida /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Con prompt caching (automático, sin necesidad de configuración), los agentes de larga duración con prompts de sistema consistentes ven tasas de acierto de caché del 30-50% — lo que hace que Mini sea aún más barato para cargas de trabajo agénticas.
Empieza ahora
Ambos modelos están disponibles ahora mismo. Sin lista de espera, sin acceso especial.
- Regístrate para obtener una cuenta gratuita de Smart AIPI (incluye $5 en créditos gratis)
- Configura tu base URL en
https://api.smartaipi.com/v1 - Usa el modelo
gpt-5.4-miniogpt-5.4-nano - O pruébalos al instante en chat.smartaipi.com
La era de la AI cara ha terminado. Construye más, gasta menos.
Puerta de enlace de API compatible con OpenAI. Accede a modelos de AI de frontera con un 75% menos de costo.
Empieza gratis