GPT-5.4 Mini와 Nano: Small Models의 새로운 최강자
GPT-5.4 Mini는 Terminal-Bench 2.0에서 60%를 기록하면서 입력 1M당 단 $0.75입니다. GPT-5.4 Nano는 1M당 $0.20입니다. 두 모델 모두 지금 Smart AIPI에서 75% 할인으로 사용할 수 있습니다 — agents, coding, computer use에 활용하는 방법을 소개합니다.
TL;DR: GPT-5.4 Mini와 Nano가 Smart AIPI에 정식 출시되었습니다. Mini는 Terminal-Bench 2.0에서 $0.75/1M input으로 60%를 기록합니다. Nano는 단 $0.20/1M입니다. 두 모델 모두 75% 할인된 가격으로 제공됩니다. 모든 API 호출에서 gpt-5.4-mini 및 gpt-5.4-nano를 사용하면 됩니다.
OpenAI가 5.4 제품군에 두 개의 새 모델을 추가했고, 이는 AI 개발의 비용 구조를 바꿉니다. GPT-5.4 Mini는 최전선급에 가까운 coding 성능을 훨씬 저렴한 가격에 제공합니다. GPT-5.4 Nano는 지금까지 출시된 frontier model 중 가장 저렴합니다.
두 모델 모두 지금 바로 Smart AIPI에서 사용할 수 있습니다.
핵심 수치
새 모델들의 가격과 성능을 비교하면 다음과 같습니다:
| 모델 | Terminal-Bench 2.0 | 입력 /1M | 출력 /1M | Smart AIPI 출력 |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini는 coding에서 Gemini 3 Flash보다 12포인트 이상 앞서면서도 input 비용은 50%만 더 듭니다. 그리고 Smart AIPI에서는 그 격차가 더 줄어듭니다 — Gemini의 $0.50 대신 input 1M당 $0.1875만 지불하면 됩니다.
어떤 모델을 언제 써야 할까
이제 5.4 제품군은 워크로드에 맞게 선택할 수 있는 세 가지 계층을 제공합니다:
GPT-5.4 Mini: Subagent용 주력 모델
이 모델은 병렬화된 coding 작업에 적합합니다. Codex, Claude Code 또는 subagent를 생성하는 agentic coding 도구를 사용하고 있다면, Mini가 가장 균형이 좋은 선택입니다.
subagent 비용 전략:
- 아키텍처 결정을 위해 main agent는 높은 reasoning 설정의
gpt-5.4에서 실행 - 구현 작업을 위해 subagents는 높은 reasoning 설정의
gpt-5.4-mini에서 실행 - 각 subagent는 full model 대비 비용이 약 70% 낮으면서도, 여전히 Terminal-Bench에서 60%를 기록
- Mini에서 병렬 subagent 10개를 돌리는 비용이 GPT-5.4에서 3개를 돌리는 것보다 적고, 완료 속도도 더 빠름
Mini는 computer use 및 browser automation에서도 뛰어납니다. UI 상호작용 작업에서 안정적인 정확도를 제공하면서 GPT-5.4보다 훨씬 빠르게 동작하므로, web scraping agents, 자동화 테스트, 그리고 예산을 과도하게 소모하지 않으면서 화면을 탐색하고 버튼을 클릭해야 하는 모든 워크플로에 적합합니다.
Codex CLI 팁: 빠르고 성능 좋은 coding assistant를 credit 소모 걱정 없이 사용하려면 ~/.codex/config.toml에 model = "gpt-5.4-mini"와 model_reasoning_effort = "high"를 설정하세요.
GPT-5.4 Nano: 일상 작업용 주력 모델
$0.20/1M input(Smart AIPI에서는 $0.05)인 Nano는 사실상 무료에 가깝습니다. coding 모델은 아니지만, 그럴 필요도 없습니다. 다음과 같은 대부분의 작업에 적합합니다:
- 분류 및 라우팅 — 어떤 모델이나 도구를 호출할지 결정
- 요약 — 문서, 대화, 검색 결과를 압축
- 데이터 추출 — 비정형 텍스트에서 구조화된 필드를 추출
- 기본 agentic 작업 — 코드 생성을 포함하지 않는 단순한 다단계 워크플로
- 대화 제목 생성 — 저희도 chat 제목 생성에 직접 사용합니다
- 콘텐츠 moderation — 대규모에서 빠르고 저렴한 콘텐츠 필터링
Nano는 이전에는 GPT-4.1 Mini나 GPT-5 Mini가 필요했던 작업을 훨씬 낮은 비용으로 처리합니다. 수백만 건의 요청을 처리하는 고처리량 파이프라인에서는 절감 효과가 매우 큽니다.
참고: GPT-5.4 Nano는 현재 Chat Completions endpoint(/v1/chat/completions)만 지원합니다. 이 모델에서는 Responses API를 아직 사용할 수 없습니다. Codex CLI처럼 Responses endpoint가 필요한 도구를 사용 중이라면 대신 Mini를 사용하세요.
Smart Model Stack
프로덕션 AI 애플리케이션에서는 다음 패턴을 권장합니다:
| 작업 | 모델 | 이유 |
|---|---|---|
| 아키텍처, 복잡한 reasoning | gpt-5.4 | 중요한 결정에 필요한 최고 수준의 품질 |
| Coding subagents, code review, computer use | gpt-5.4-mini | 5.4보다 70% 낮은 비용으로 Terminal-Bench 60% |
| 라우팅, 분류, 요약, 추출 | gpt-5.4-nano | Smart AIPI에서 input 1M당 $0.05로 거의 무료 수준 |
| 이미지 생성 및 편집 | gpt-image-1.5 | 최전선 수준의 이미지 품질 |
| 비디오 생성 | sora-2 | 텍스트 또는 이미지로 최대 20초 비디오 생성 |
빠른 시작
두 모델 모두 모든 OpenAI SDK에서 사용할 수 있습니다. model ID만 설정하면 됩니다:
Smart AIPI 가격
항상 그렇듯 OpenAI 직접 가격 대비 75% 할인입니다:
| 모델 | 입력 /1M | Cached Input /1M | 출력 /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
prompt caching(자동 적용, 별도 설정 불필요)을 사용하면 일관된 system prompt를 쓰는 장기 실행 agent는 30~50%의 cache hit rate를 보게 됩니다 — 즉, agentic 워크로드에서 Mini 비용은 더 낮아집니다.
시작하기
두 모델 모두 지금 바로 사용할 수 있습니다. 대기자 명단도 없고, 별도 접근 권한도 필요하지 않습니다.
- 회원가입하여 무료 Smart AIPI 계정을 만드세요 (무료 credits $5 포함)
- base URL을
https://api.smartaipi.com/v1로 설정하세요 gpt-5.4-mini또는gpt-5.4-nano모델을 사용하세요- 또는 chat.smartaipi.com에서 바로 사용해 보세요
비싼 AI의 시대는 끝났습니다. 더 많이 만들고, 더 적게 쓰세요.