GPT-5.4 Mini et Nano : les nouveaux rois des petits modèles

GPT-5.4 Mini atteint 60 % sur Terminal-Bench 2.0 à seulement $0.75/1M input. GPT-5.4 Nano coûte $0.20/1M. Les deux sont disponibles dès maintenant sur Smart AIPI avec 75 % de réduction — voici comment les utiliser pour les agents, le coding et l’usage sur ordinateur.

S
Smart AIPI Team
6 min de lecture ·
GPT-5.4 Mini et Nano : les nouveaux rois des petits modèles
GPT-5.4 Mini sélectionné dans le sélecteur de modèles

TL;DR: GPT-5.4 Mini et Nano sont disponibles sur Smart AIPI. Mini atteint 60 % sur Terminal-Bench 2.0 à $0.75/1M input. Nano coûte seulement $0.20/1M. Les deux sont proposés avec 75 % de réduction. Utilisez gpt-5.4-mini et gpt-5.4-nano dans n’importe quel appel API.

OpenAI vient de lancer deux nouveaux modèles de la famille 5.4, et ils changent l’économie du développement IA. GPT-5.4 Mini apporte des capacités de coding proches de l’état de l’art pour une fraction du prix. GPT-5.4 Nano est le modèle frontier le moins cher jamais lancé.

Les deux sont déjà disponibles sur Smart AIPI.

Les chiffres

Voici comment les nouveaux modèles se comparent en prix et en performances :

Graphique prix vs capacité en coding montrant GPT-5.4 Mini à 60 % sur Terminal-Bench 2.0, GPT-5.4 Nano à 46 %, et Gemini 3 Flash à 47.7 %
Modèle Terminal-Bench 2.0 Input /1M Output /1M Output Smart AIPI
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (complet) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini dépasse Gemini 3 Flash en coding de plus de 12 points tout en ne coûtant que 50 % de plus en input. Et sur Smart AIPI, cet écart se réduit encore — vous payez $0.1875/1M input au lieu des $0.50 de Gemini.

Quand utiliser chaque modèle

La famille 5.4 vous donne maintenant trois niveaux pour s’adapter à votre charge de travail :

GPT-5.4 Mini : le moteur des subagents

C’est le modèle à choisir pour les tâches de coding parallélisées. Si vous utilisez Codex, Claude Code ou tout autre outil de coding agentique qui lance des subagents, Mini est le meilleur compromis.

La stratégie de coût pour les subagents :

  • Exécutez votre agent principal sur gpt-5.4 avec un raisonnement élevé pour les décisions d’architecture
  • Lancez des subagents sur gpt-5.4-mini avec un raisonnement élevé pour les tâches d’implémentation
  • Chaque subagent coûte ~70 % de moins que sur le modèle complet, tout en atteignant 60 % sur Terminal-Bench
  • 10 subagents parallèles sur Mini coûtent moins cher que 3 sur GPT-5.4 — et finissent plus vite

Mini excelle aussi pour l’usage sur ordinateur et l’automatisation de navigateur. Il offre une bonne précision sur les tâches d’interaction UI à des vitesses bien plus élevées que GPT-5.4, ce qui en fait le bon choix pour les agents de web scraping, les tests automatisés et tout workflow où le modèle doit naviguer entre des écrans et cliquer sur des boutons sans exploser votre budget.

Astuce Codex CLI : définissez model = "gpt-5.4-mini" dans ~/.codex/config.toml avec model_reasoning_effort = "high" pour obtenir un assistant de coding rapide et capable qui ne videra pas vos crédits.

GPT-5.4 Nano : le moteur du quotidien

À $0.20/1M input (ou $0.05 sur Smart AIPI), Nano est quasiment gratuit. Ce n’est pas un modèle de coding — mais il n’a pas besoin de l’être. Utilisez-le pour tout le reste :

  • Classification et routing — décider quel modèle ou outil invoquer
  • Summarization — condenser des documents, conversations, résultats de recherche
  • Extraction de données — extraire des champs structurés à partir de texte non structuré
  • Tâches agentiques de base — workflows simples en plusieurs étapes sans génération de code
  • Titres de conversation — nous l’utilisons nous-mêmes pour générer les titres de chat
  • Modération de contenu — filtrage de contenu rapide et peu coûteux à grande échelle

Nano prend en charge des tâches qui exigeaient auparavant GPT-4.1 Mini ou GPT-5 Mini, mais pour une fraction du coût. Pour les pipelines à haut débit qui traitent des millions de requêtes, les économies sont énormes.

Remarque : GPT-5.4 Nano ne prend actuellement en charge que l’endpoint Chat Completions (/v1/chat/completions). La Responses API n’est pas encore disponible pour ce modèle. Si vous utilisez des outils comme Codex CLI qui nécessitent l’endpoint Responses, utilisez Mini à la place.

La pile de modèles intelligente

Voici le schéma que nous recommandons pour les applications IA en production :

Tâche Modèle Pourquoi
Architecture, raisonnement complexe gpt-5.4 Qualité de premier ordre pour les décisions critiques
Subagents de coding, revue de code, usage sur ordinateur gpt-5.4-mini 60 % sur Terminal-Bench pour un coût inférieur de 70 % à 5.4
Routing, classification, résumés, extraction gpt-5.4-nano Quasi gratuit à $0.05/1M input sur Smart AIPI
Génération et édition d’images gpt-image-1.5 Qualité d’image frontier
Génération vidéo sora-2 Jusqu’à 20 s de vidéo à partir de texte ou d’image

Démarrage rapide

Les deux modèles fonctionnent avec n’importe quel SDK OpenAI. Il suffit de définir l’ID du modèle :

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Coding rapide avec Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Classification à bas coût avec Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Tarification sur Smart AIPI

Comme toujours, 75 % moins cher que la tarification directe OpenAI :

Modèle Input /1M Input en cache /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

Avec le prompt caching (automatique, sans configuration), les agents longue durée avec des prompts système cohérents voient des taux de cache hit de 30 à 50 % — ce qui rend Mini encore moins cher pour les charges de travail agentiques.

Commencer

Les deux modèles sont disponibles dès maintenant. Pas de liste d’attente, pas d’accès spécial nécessaire.

  1. Inscrivez-vous pour obtenir un compte Smart AIPI gratuit (inclut $5 de crédits gratuits)
  2. Définissez votre base URL sur https://api.smartaipi.com/v1
  3. Utilisez le modèle gpt-5.4-mini ou gpt-5.4-nano
  4. Ou essayez-les instantanément sur chat.smartaipi.com

L’ère de l’IA coûteuse est terminée. Construisez plus, dépensez moins.

GPT-5.4 Mini GPT-5.4 Nano Petits modèles
S
Écrit par
Smart AIPI

Passerelle API compatible OpenAI. Accédez aux modèles d'IA de pointe à 75 % de coût en moins.

Commencer gratuitement

Message envoyé

Nous vous répondrons sous 2 jours ouvrés.

Contacter le support

Vous avez une question ou besoin d'aide ? Envoyez-nous un message et nous vous répondrons sous 2 jours ouvrés.