GPT-5.4 MiniとNano:小型モデルの新たな王者
GPT-5.4 MiniはTerminal-Bench 2.0で60%を記録し、料金はわずか$0.75/1M input。GPT-5.4 Nanoは$0.20/1M。どちらも今すぐSmart AIPIで75%オフで利用可能です — agents、coding、computer useで使う方法を紹介します。
要点: GPT-5.4 MiniとNanoがSmart AIPIで利用開始しました。MiniはTerminal-Bench 2.0で60%を記録し、料金は$0.75/1M input。Nanoはわずか$0.20/1Mです。どちらも75%オフで利用できます。あらゆるAPI callでgpt-5.4-miniとgpt-5.4-nanoを使えます。
OpenAIが5.4ファミリーに2つの新モデルを追加し、AI開発のコスト構造を大きく変えました。GPT-5.4 Miniは、最先端に近いcoding性能を大幅に低い価格で提供します。GPT-5.4 Nanoは、これまでにリリースされた中で最も安価なfrontier modelです。
どちらも今すぐSmart AIPIで利用できます。
数値で見る比較
新モデルの価格と性能を比較すると次のとおりです。
| モデル | Terminal-Bench 2.0 | Input /1M | Output /1M | Smart AIPI Output |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Miniは、Inputコストがわずか50%高いだけで、codingではGemini 3 Flashを12ポイント超上回ります。さらにSmart AIPIでは差はもっと縮まり、Geminiの$0.50ではなく、$0.1875/1M inputで利用できます。
どのモデルをいつ使うべきか
5.4ファミリーでは、ワークロードに応じて選べる3つの階層が揃いました。
GPT-5.4 Mini: subagent向けの主力モデル
このモデルは並列化されたcodingタスクに最適です。Codex、Claude Code、またはsubagentを生成するagentic coding toolを使っているなら、Miniが最もバランスの良い選択です。
subagentコスト戦略:
- main agentは
gpt-5.4を高いreasoning設定で動かし、アーキテクチャ判断を担当させる - subagentsは
gpt-5.4-miniを高いreasoning設定で動かし、実装タスクを担当させる - 各subagentのコストはfull modelで動かすより約70%低く、それでもTerminal-Benchで60%を記録
- Miniで10個の並列subagentsを動かしても、GPT-5.4で3個動かすより安く、しかも完了はより高速
Miniはcomputer useやbrowser automationにも優れています。UI操作タスクで十分に高い精度を発揮しつつ、GPT-5.4よりはるかに高速です。そのため、web scraping agents、自動テスト、画面を移動してボタンをクリックするような操作を予算を使い切らずにモデルへ任せたいワークフローに適しています。
Codex CLI tip: ~/.codex/config.tomlでmodel = "gpt-5.4-mini"とmodel_reasoning_effort = "high"を設定すると、クレジットを大きく消費せずに高速で高性能なcoding assistantを使えます。
GPT-5.4 Nano: 日常タスク向けの主力モデル
$0.20/1M input(Smart AIPIでは$0.05)という価格のNanoは、ほぼ無料に近い感覚で使えます。これはcoding modelではありませんが、それで問題ありません。その他の幅広い用途に使えます。
- 分類とルーティング — どのモデルやtoolを呼び出すかを決める
- 要約 — ドキュメント、会話、検索結果を短くまとめる
- データ抽出 — 非構造化テキストから構造化フィールドを取り出す
- 基本的なagentic tasks — code generationを伴わないシンプルな複数ステップのワークフロー
- 会話タイトル生成 — 私たち自身もチャットタイトル生成に使っています
- コンテンツモデレーション — 高速かつ低コストで大規模なコンテンツフィルタリング
Nanoは、これまでGPT-4.1 MiniやGPT-5 Miniが必要だったタスクを、ほんの一部のコストで処理できます。何百万ものリクエストを処理する高スループットのパイプラインでは、削減効果は非常に大きくなります。
注意: GPT-5.4 Nanoは現在、Chat Completions endpoint(/v1/chat/completions)のみをサポートしています。Responses APIはこのモデルではまだ利用できません。Codex CLIのようにResponses endpointが必要なtoolsを使う場合は、代わりにMiniを使ってください。
賢いモデルスタック
本番AIアプリケーションでは、次の構成を推奨します。
| タスク | モデル | 理由 |
|---|---|---|
| アーキテクチャ、複雑なreasoning | gpt-5.4 | 重要な意思決定で最高クラスの品質 |
| coding subagents、code review、computer use | gpt-5.4-mini | Terminal-Benchで60%、5.4より70%低コスト |
| ルーティング、分類、要約、抽出 | gpt-5.4-nano | Smart AIPIでは$0.05/1M inputで、ほぼ無料に近い |
| 画像生成と編集 | gpt-image-1.5 | 最先端の画像品質 |
| 動画生成 | sora-2 | テキストまたは画像から最長20秒の動画を生成 |
クイックスタート
どちらのモデルも任意のOpenAI SDKで動作します。必要なのはmodel IDを設定するだけです。
Smart AIPIでの料金
いつもどおり、OpenAIの直接料金より75%オフです。
| モデル | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
prompt caching(自動で有効、設定不要)により、一貫したsystem promptを使う長時間稼働のagentsでは30〜50%のcache hit率が見込めます。これにより、agentic workloadsでMiniはさらに低コストになります。
今すぐ始める
どちらのモデルも今すぐ利用可能です。waitlistも特別なアクセス権も不要です。
- Sign upして無料のSmart AIPIアカウントを作成する($5分の無料クレジット付き)
- base URLを
https://api.smartaipi.com/v1に設定する - モデル
gpt-5.4-miniまたはgpt-5.4-nanoを使う - またはchat.smartaipi.comですぐに試す
高価なAIの時代は終わりました。より多くを作り、より少なく使いましょう。