GPT-5.4 Mini 和 Nano:小模型的新王者
GPT-5.4 Mini 在 Terminal-Bench 2.0 上拿到 60%,输入价格仅 $0.75/1M。GPT-5.4 Nano 价格低至 $0.20/1M。两者现已在 Smart AIPI 上线,并提供 75% 折扣——下面介绍如何将它们用于 agents、编码和 computer use。
TL;DR:GPT-5.4 Mini 和 Nano 已在 Smart AIPI 上线。Mini 在 Terminal-Bench 2.0 上达到 60%,输入价格为 $0.75/1M。Nano 仅需 $0.20/1M。两者都可享受 75% 折扣。在任何 API 调用中使用 gpt-5.4-mini 和 gpt-5.4-nano 即可。
OpenAI 刚刚发布了 5.4 系列中的两个新模型,它们正在改变 AI 开发的经济模型。GPT-5.4 Mini 以极低的价格带来接近前沿水平的编码能力。GPT-5.4 Nano 则是迄今发布过最便宜的前沿模型。
两者现在都已在 Smart AIPI 上线。
关键数据
下面是这些新模型在价格和性能上的对比:
| 模型 | Terminal-Bench 2.0 | 输入 /1M | 输出 /1M | Smart AIPI 输出 |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4(完整版) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini 在编码能力上比 Gemini 3 Flash 高出 12+ 个百分点,而输入成本只高 50%。而在 Smart AIPI 上,这个差距会进一步缩小——你支付的是 $0.1875/1M 输入,而不是 Gemini 的 $0.50。
什么时候该用哪个模型
现在,5.4 系列提供了三个层级来匹配不同工作负载:
GPT-5.4 Mini:Subagent 主力模型
如果你要处理并行化编码任务,这个模型就是首选。如果你正在运行 Codex、Claude Code 或任何会生成 subagents 的 agentic 编码工具,Mini 就是最佳平衡点。
subagent 成本策略:
- 将你的主 agent 运行在
gpt-5.4上,并设置高 reasoning,用于架构决策 - 将subagents 运行在
gpt-5.4-mini上,并设置高 reasoning,用于实现任务 - 每个 subagent 的成本相比完整版模型低约 70%,同时在 Terminal-Bench 上仍能达到 60%
- 在 Mini 上运行 10 个并行 subagents 的成本,比在 GPT-5.4 上运行 3 个还低——而且完成得更快
Mini 在computer use 和浏览器自动化方面也很出色。它在 UI 交互任务上能提供稳定的准确率,速度明显快于 GPT-5.4,因此非常适合 web scraping agents、自动化测试,以及任何需要模型在屏幕间导航、点击按钮,同时又不想快速耗尽预算的工作流。
Codex CLI 提示:在 ~/.codex/config.toml 中设置 model = "gpt-5.4-mini",并将 model_reasoning_effort = "high",即可获得一个快速、强大且不会迅速耗尽 credits 的编码助手。
GPT-5.4 Nano:日常主力模型
按 $0.20/1M 输入 计费(在 Smart AIPI 上则是 $0.05),Nano 基本等于不要钱。它不是一个编码模型——但它也不需要是。你可以把它用于其他几乎所有任务:
- 分类与路由——决定调用哪个模型或工具
- 摘要——压缩文档、对话和搜索结果
- 数据提取——从非结构化文本中提取结构化字段
- 基础 agentic 任务——不涉及代码生成的简单多步骤工作流
- 对话标题——我们自己就用它来生成聊天标题
- 内容审核——以极低成本实现大规模快速内容过滤
Nano 可以处理过去需要 GPT-4.1 Mini 或 GPT-5 Mini 才能完成的任务,但成本只是其中一小部分。对于每秒高吞吐、处理数百万请求的 pipeline,节省非常可观。
注意:GPT-5.4 Nano 当前仅支持 Chat Completions endpoint(/v1/chat/completions)。Responses API 目前尚未对该模型开放。如果你使用的是 Codex CLI 这类依赖 Responses endpoint 的工具,请改用 Mini。
智能模型栈
这是我们推荐用于生产级 AI 应用的模式:
| 任务 | 模型 | 原因 |
|---|---|---|
| 架构、复杂 reasoning | gpt-5.4 | 关键决策场景中的同类最佳质量 |
| 编码 subagents、代码审查、computer use | gpt-5.4-mini | Terminal-Bench 达到 60%,成本比 5.4 低 70% |
| 路由、分类、摘要、提取 | gpt-5.4-nano | 在 Smart AIPI 上输入仅 $0.05/1M,几乎可以忽略不计 |
| 图像生成与编辑 | gpt-image-1.5 | 前沿图像质量 |
| 视频生成 | sora-2 | 可从文本或图像生成最长 20 秒视频 |
快速开始
这两个模型都可配合任何 OpenAI SDK 使用。你只需要设置 model ID:
Smart AIPI 上的定价
和以往一样,相比 OpenAI 官方直连价格低 75%:
| 模型 | 输入 /1M | 缓存输入 /1M | 输出 /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
借助 prompt caching(自动启用,无需额外设置),使用稳定 system prompts 的长时运行 agents 通常可获得 30-50% 的缓存命中率——这会让 Mini 在 agentic 工作负载中更便宜。
开始使用
这两个模型现在都已可用。无需等候名单,也不需要特殊权限。
- 注册免费 Smart AIPI 账号(包含 $5 免费 credits)
- 将你的 base URL 设置为
https://api.smartaipi.com/v1 - 使用模型
gpt-5.4-mini或gpt-5.4-nano - 或者直接在 chat.smartaipi.com 立即试用
高成本 AI 的时代已经结束。构建更多,花费更少。