GPT-5.4 Mini et Nano : les nouveaux rois des petits modèles
GPT-5.4 Mini atteint 60 % sur Terminal-Bench 2.0 à seulement $0.75/1M input. GPT-5.4 Nano coûte $0.20/1M. Les deux sont disponibles dès maintenant sur Smart AIPI avec 75 % de réduction — voici comment les utiliser pour les agents, le coding et l’usage sur ordinateur.
TL;DR: GPT-5.4 Mini et Nano sont disponibles sur Smart AIPI. Mini atteint 60 % sur Terminal-Bench 2.0 à $0.75/1M input. Nano coûte seulement $0.20/1M. Les deux sont proposés avec 75 % de réduction. Utilisez gpt-5.4-mini et gpt-5.4-nano dans n’importe quel appel API.
OpenAI vient de lancer deux nouveaux modèles de la famille 5.4, et ils changent l’économie du développement IA. GPT-5.4 Mini apporte des capacités de coding proches de l’état de l’art pour une fraction du prix. GPT-5.4 Nano est le modèle frontier le moins cher jamais lancé.
Les deux sont déjà disponibles sur Smart AIPI.
Les chiffres
Voici comment les nouveaux modèles se comparent en prix et en performances :
| Modèle | Terminal-Bench 2.0 | Input /1M | Output /1M | Output Smart AIPI |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (complet) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini dépasse Gemini 3 Flash en coding de plus de 12 points tout en ne coûtant que 50 % de plus en input. Et sur Smart AIPI, cet écart se réduit encore — vous payez $0.1875/1M input au lieu des $0.50 de Gemini.
Quand utiliser chaque modèle
La famille 5.4 vous donne maintenant trois niveaux pour s’adapter à votre charge de travail :
GPT-5.4 Mini : le moteur des subagents
C’est le modèle à choisir pour les tâches de coding parallélisées. Si vous utilisez Codex, Claude Code ou tout autre outil de coding agentique qui lance des subagents, Mini est le meilleur compromis.
La stratégie de coût pour les subagents :
- Exécutez votre agent principal sur
gpt-5.4avec un raisonnement élevé pour les décisions d’architecture - Lancez des subagents sur
gpt-5.4-miniavec un raisonnement élevé pour les tâches d’implémentation - Chaque subagent coûte ~70 % de moins que sur le modèle complet, tout en atteignant 60 % sur Terminal-Bench
- 10 subagents parallèles sur Mini coûtent moins cher que 3 sur GPT-5.4 — et finissent plus vite
Mini excelle aussi pour l’usage sur ordinateur et l’automatisation de navigateur. Il offre une bonne précision sur les tâches d’interaction UI à des vitesses bien plus élevées que GPT-5.4, ce qui en fait le bon choix pour les agents de web scraping, les tests automatisés et tout workflow où le modèle doit naviguer entre des écrans et cliquer sur des boutons sans exploser votre budget.
Astuce Codex CLI : définissez model = "gpt-5.4-mini" dans ~/.codex/config.toml avec model_reasoning_effort = "high" pour obtenir un assistant de coding rapide et capable qui ne videra pas vos crédits.
GPT-5.4 Nano : le moteur du quotidien
À $0.20/1M input (ou $0.05 sur Smart AIPI), Nano est quasiment gratuit. Ce n’est pas un modèle de coding — mais il n’a pas besoin de l’être. Utilisez-le pour tout le reste :
- Classification et routing — décider quel modèle ou outil invoquer
- Summarization — condenser des documents, conversations, résultats de recherche
- Extraction de données — extraire des champs structurés à partir de texte non structuré
- Tâches agentiques de base — workflows simples en plusieurs étapes sans génération de code
- Titres de conversation — nous l’utilisons nous-mêmes pour générer les titres de chat
- Modération de contenu — filtrage de contenu rapide et peu coûteux à grande échelle
Nano prend en charge des tâches qui exigeaient auparavant GPT-4.1 Mini ou GPT-5 Mini, mais pour une fraction du coût. Pour les pipelines à haut débit qui traitent des millions de requêtes, les économies sont énormes.
Remarque : GPT-5.4 Nano ne prend actuellement en charge que l’endpoint Chat Completions (/v1/chat/completions). La Responses API n’est pas encore disponible pour ce modèle. Si vous utilisez des outils comme Codex CLI qui nécessitent l’endpoint Responses, utilisez Mini à la place.
La pile de modèles intelligente
Voici le schéma que nous recommandons pour les applications IA en production :
| Tâche | Modèle | Pourquoi |
|---|---|---|
| Architecture, raisonnement complexe | gpt-5.4 | Qualité de premier ordre pour les décisions critiques |
| Subagents de coding, revue de code, usage sur ordinateur | gpt-5.4-mini | 60 % sur Terminal-Bench pour un coût inférieur de 70 % à 5.4 |
| Routing, classification, résumés, extraction | gpt-5.4-nano | Quasi gratuit à $0.05/1M input sur Smart AIPI |
| Génération et édition d’images | gpt-image-1.5 | Qualité d’image frontier |
| Génération vidéo | sora-2 | Jusqu’à 20 s de vidéo à partir de texte ou d’image |
Démarrage rapide
Les deux modèles fonctionnent avec n’importe quel SDK OpenAI. Il suffit de définir l’ID du modèle :
Tarification sur Smart AIPI
Comme toujours, 75 % moins cher que la tarification directe OpenAI :
| Modèle | Input /1M | Input en cache /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Avec le prompt caching (automatique, sans configuration), les agents longue durée avec des prompts système cohérents voient des taux de cache hit de 30 à 50 % — ce qui rend Mini encore moins cher pour les charges de travail agentiques.
Commencer
Les deux modèles sont disponibles dès maintenant. Pas de liste d’attente, pas d’accès spécial nécessaire.
- Inscrivez-vous pour obtenir un compte Smart AIPI gratuit (inclut $5 de crédits gratuits)
- Définissez votre base URL sur
https://api.smartaipi.com/v1 - Utilisez le modèle
gpt-5.4-miniougpt-5.4-nano - Ou essayez-les instantanément sur chat.smartaipi.com
L’ère de l’IA coûteuse est terminée. Construisez plus, dépensez moins.
Passerelle API compatible OpenAI. Accédez aux modèles d'IA de pointe à 75 % de coût en moins.
Commencer gratuitement