GPT-5.4 출시: Smart AIPI에서 지금 바로 사용할 수 있는 OpenAI의 가장 강력한 모델
GPT-5.4가 Smart AIPI에 정식 적용되었습니다. 코딩, 추론, 수학, agentic 작업 전반에서 새로운 최고 수준 benchmark를 기록했으며, OpenAI 직접 가격 대비 75% 저렴하게 사용할 수 있습니다.
요약: GPT-5.4가 Smart AIPI에 적용되었습니다. 어떤 API 호출에서든 모델 gpt-5.4를 사용하면 됩니다. 코딩, 추론, 수학, agentic 작업 등 모든 주요 benchmark에서 GPT-5.3 Codex를 앞서며, 지금 바로 OpenAI 가격 대비 75% 할인된 비용으로 사용할 수 있습니다.
OpenAI가 방금 GPT-5.4를 출시했고, 이는 GPT-5.3 Codex에서 한 단계 크게 도약한 모델입니다. 저희는 이미 테스트를 마쳤고, 모델 목록에 추가했으며, 현재 Smart AIPI에서 바로 사용할 수 있습니다.
개발자 관점에서 알아야 할 핵심만 정리했습니다.
Benchmark
GPT-5.4는 사실상 모든 주요 benchmark에서 새로운 최고 수준 점수를 기록했습니다. 아래는 GPT-5.3 Codex, GPT-5.2, Claude Opus 4.6, Gemini 3.1 Pro와의 비교입니다.
| Benchmark | GPT-5.4 | GPT-5.3 Codex | Claude Opus 4.6 | Gemini 3.1 Pro |
|---|---|---|---|---|
| OSWorld 컴퓨터 사용 |
75.0% | 74.0% | 72.7% | — |
| WebArena 웹 브라우징 |
67.3% | — | 66.4% | — |
| GDPval 지식 기반 작업 |
83.0% | 70.9% | 78.0% | — |
| BrowseComp Agentic 브라우징 |
82.7% | 77.3% | 84.0% | 85.9% |
| SWE-Bench Pro 소프트웨어 엔지니어링 |
57.7% | 56.8% | — | 54.2% |
| GPQA Diamond 전문 과학 추론 |
92.8% | 92.6% | 91.3% | 94.3% |
| FrontierMath 고급 수학 |
47.6% | — | 40.7% | 36.9% |
| Toolathlon Agentic 도구 사용 |
54.6% | 51.9% | 44.8% | — |
눈에 띄는 수치는 다음과 같습니다. GDPval 83% (지식 기반 작업, 70.9%에서 상승), SWE-Bench Pro 57.7% (실전 코딩의 대표 benchmark), FrontierMath 47.6% (1년 전만 해도 거의 불가능하다고 여겨졌던 고급 수학).
GPT-5.4 Pro는 어떤가요?
OpenAI는 더 긴 사고 과정을 위해 설계된 한층 더 강력한 변형 모델인 GPT-5.4 Pro도 함께 발표했습니다. Pro benchmark도 매우 인상적입니다.
- BrowseComp: 89.3% (모든 모델 중 최고)
- GPQA Diamond: 94.4%
- FrontierMath: 50.0% (처음으로 절반에 도달한 모델)
- FrontierMath Tier 4: 38.0% (Claude Opus 4.6의 22.9%에 비해 거의 2배)
GPT-5.4 Pro는 아직 API를 통해 제공되지 않습니다. 공개되는 즉시 지원을 추가하겠습니다.
Smart AIPI에서 GPT-5.4 사용하는 방법
이미 사용 가능합니다. 모델 파라미터만 바꾸면 됩니다.
Chat Completions API
curl https://api.smartaipi.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"messages": [{"role": "user", "content": "Hello!"}]
}'
Responses API
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"input": "Explain quantum computing in simple terms"
}'
Reasoning과 함께 사용
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"input": "Solve this step by step: what is the integral of x^2 * e^x?",
"reasoning": {"effort": "high", "summary": "auto"}
}'
Fast Mode (Priority Processing)
GPT-5.4는 service_tier: "priority" 파라미터를 통해 fast mode를 지원합니다. 이 설정을 사용하면 추론 깊이 또는 출력 품질을 바꾸지 않고도 더 낮은 지연 시간으로 요청을 우선 처리할 수 있습니다.
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"input": "Refactor this function",
"service_tier": "priority"
}'
이 기능은 reasoning.effort와는 별개입니다. 어떤 reasoning 수준과도 함께 priority processing을 사용할 수 있습니다. Codex CLI에서는 세션 중 /fast 슬래시 명령으로 priority processing을 전환할 수 있습니다.
가격 참고: Priority processing은 표준 요금의 1.5배로 과금됩니다. GPT-5.4 기준으로 입력은 $0.9375/1M, 출력은 $5.625/1M tokens입니다. (표준 요금은 각각 $0.625, $3.75)
Codex CLI
~/.codex/config.toml을 다음처럼 업데이트하세요.
model = "gpt-5.4"
OpenCode
config에서 모델 ID를 gpt-5.4로 설정하세요.
중요: store 파라미터
GPT-5.4부터(그리고 앞으로의 모든 모델에서) upstream API는 이제 store를 반드시 false로 설정하도록 요구합니다. "store": true를 보내거나, 오래된 기본값 때문에 이를 생략하면, "Store must be set to false" 오류가 발생합니다.
Smart AIPI는 이 부분을 자동으로 처리합니다. Responses API와 WebSocket endpoint 모두에서 store의 기본값을 false로 설정합니다. 따라서 별도로 바꿀 것은 없습니다. 다만 코드에서 "store": true를 명시적으로 설정하고 있다면, 아래처럼 수정해야 합니다.
// 이전 (GPT-5.4에서는 동작하지 않음)
{"model": "gpt-5.4", "input": "Hello", "store": true}
// 이후 (동작함)
{"model": "gpt-5.4", "input": "Hello", "store": false}
// 또는 그냥 생략 가능 — Smart AIPI는 기본값을 false로 설정함
{"model": "gpt-5.4", "input": "Hello"}
previous_response_id를 사용해 multi-turn 대화를 구현하고 있다면, store: false는 서버가 응답을 영구 저장하지 않는다는 뜻이라는 점에 유의하세요. Smart AIPI의 WebSocket endpoint는 대화 상태를 내부적으로 관리하므로, 저장 없이도 WebSocket에서는 multi-turn이 계속 동작합니다.
GPT-5.3 Codex 대비 무엇이 달라졌나
개발자 입장에서 가장 의미 있는 개선점은 다음과 같습니다.
- 더 나은 코딩 성능. SWE-Bench Pro는 56.8%에서 57.7%로 상승했습니다. 수치상 증가는 점진적이지만 최전선 benchmark에서는 충분히 의미 있는 향상입니다. 더 중요한 점은 실제 사용에서 복잡한 multi-file 리팩터링과 디버깅 정확도가 눈에 띄게 좋아졌다는 것입니다.
- 더 강한 추론. GPQA Diamond는 92.8%로 향상되었고, FrontierMath는 47.6%까지 뛰었습니다. 복잡한 문제를 더 안정적으로 추론합니다.
- 더 나은 agentic 성능. OSWorld(75.0%), Toolathlon(54.6%), WebArena(67.3%)는 모두 자율적인 컴퓨터 사용과 도구 상호작용 능력이 개선되었음을 보여줍니다. 코딩 에이전트에 필요한 바로 그 능력입니다.
- 지식 기반 작업의 큰 도약. GDPval은 70.9%에서 83.0%로 12포인트 상승했습니다. 실제 업무형 지식 작업에서 성능이 크게 좋아졌습니다.
가격
OpenAI 직접 가격 대비 75% 저렴합니다. GPT-5.4를 OpenAI에서 직접 사용하면 입력 $2.50/1M, 출력 $15/1M입니다. Smart AIPI에서는 입력 $0.625/1M, 출력 $3.75/1M만 지불하면 됩니다.
GPT-5.4는 실험적 기능으로 1M context window도 지원합니다. (기본 272K에서 확장) 272K tokens를 초과하는 요청은 일반 요금의 2배로 계산되며, 이는 provider와 관계없이 적용되는 OpenAI의 upstream 정책입니다.
무료 크레딧 제공. 모든 신규 계정에는 무료 크레딧이 포함됩니다. smartaipi.com/signup에서 가입하고, API key를 만든 뒤, 즉시 GPT-5.4를 사용해 보세요. 신용카드는 필요하지 않습니다.
시작하기
- 가입하기: smartaipi.com/signup (무료 크레딧 제공, 신용카드 불필요)
- API key 생성: 대시보드에서 생성
- base URL 설정:
https://api.smartaipi.com/v1 - 모델 사용:
gpt-5.4
이게 전부입니다. 같은 API, 같은 도구, 더 나은 모델, 그리고 75% 더 저렴한 비용.