GPT-5.4 Mini và Nano: Những ông vua mới của các model nhỏ
GPT-5.4 Mini đạt 60% trên Terminal-Bench 2.0 với chi phí chỉ $0.75/1M input. GPT-5.4 Nano có giá $0.20/1M. Cả hai hiện đã có trên Smart AIPI với mức giảm giá 75% — đây là cách dùng chúng cho agents, coding và computer use.
Tóm tắt: GPT-5.4 Mini và Nano đã hoạt động trên Smart AIPI. Mini đạt 60% trên Terminal-Bench 2.0 với giá $0.75/1M input. Nano chỉ có giá $0.20/1M. Cả hai đều đang được giảm 75%. Dùng gpt-5.4-mini và gpt-5.4-nano trong bất kỳ API call nào.
OpenAI vừa phát hành hai model mới trong dòng 5.4, và chúng thay đổi bài toán kinh tế của phát triển AI. GPT-5.4 Mini mang lại khả năng coding gần mức frontier với chi phí chỉ bằng một phần nhỏ. GPT-5.4 Nano là model frontier rẻ nhất từng được phát hành.
Cả hai đều đã có mặt trên Smart AIPI ngay bây giờ.
Các con số
Dưới đây là cách các model mới so sánh về giá và hiệu năng:
| Model | Terminal-Bench 2.0 | Input /1M | Output /1M | Output trên Smart AIPI |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (bản đầy đủ) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini vượt Gemini 3 Flash về coding hơn 12+ điểm trong khi chỉ đắt hơn 50% ở input. Và trên Smart AIPI, khoảng cách đó còn thu hẹp hơn nữa — bạn trả $0.1875/1M input thay vì $0.50 của Gemini.
Khi nào nên dùng model nào
Dòng 5.4 hiện cung cấp cho bạn ba tầng để phù hợp với workload:
GPT-5.4 Mini: Cỗ máy chủ lực cho subagent
Đây là model bạn nên dùng cho các tác vụ coding song song. Nếu bạn đang chạy Codex, Claude Code, hoặc bất kỳ công cụ coding dạng agent nào tạo ra subagents, Mini là điểm cân bằng tốt nhất.
Chiến lược chi phí với subagent:
- Chạy main agent của bạn trên
gpt-5.4với reasoning cao cho các quyết định về kiến trúc - Tạo subagents trên
gpt-5.4-minivới reasoning cao cho các tác vụ triển khai - Mỗi subagent có chi phí thấp hơn ~70% so với chạy trên model đầy đủ, trong khi vẫn đạt 60% trên Terminal-Bench
- 10 subagents chạy song song trên Mini có chi phí thấp hơn 3 subagents trên GPT-5.4 — và hoàn thành nhanh hơn
Mini cũng rất mạnh ở computer use và tự động hóa trình duyệt. Nó mang lại độ chính xác tốt trên các tác vụ tương tác UI với tốc độ nhanh hơn nhiều so với GPT-5.4, khiến nó trở thành lựa chọn phù hợp cho web scraping agents, kiểm thử tự động và bất kỳ workflow nào mà bạn cần model điều hướng qua các màn hình và nhấn nút mà không làm cháy ngân sách.
Mẹo Codex CLI: Đặt model = "gpt-5.4-mini" trong ~/.codex/config.toml với model_reasoning_effort = "high" để có một trợ lý coding nhanh, mạnh mà không làm cạn credits của bạn.
GPT-5.4 Nano: Cỗ máy chủ lực hằng ngày
Với mức giá $0.20/1M input (hoặc $0.05 trên Smart AIPI), Nano gần như miễn phí. Đây không phải model coding — nhưng nó không cần phải như vậy. Hãy dùng nó cho mọi thứ khác:
- Classification và routing — quyết định model hoặc công cụ nào cần được gọi
- Summarization — rút gọn tài liệu, hội thoại, kết quả tìm kiếm
- Data extraction — trích xuất các trường có cấu trúc từ văn bản phi cấu trúc
- Các tác vụ agentic cơ bản — các workflow nhiều bước đơn giản không liên quan đến sinh code
- Tiêu đề hội thoại — chính chúng tôi cũng dùng nó để tạo tiêu đề chat
- Content moderation — lọc nội dung nhanh, rẻ ở quy mô lớn
Nano xử lý được các tác vụ trước đây cần GPT-4.1 Mini hoặc GPT-5 Mini nhưng với chi phí chỉ bằng một phần nhỏ. Với các pipeline thông lượng cao xử lý hàng triệu request, khoản tiết kiệm là rất lớn.
Lưu ý: GPT-5.4 Nano hiện chỉ hỗ trợ endpoint Chat Completions (/v1/chat/completions). Responses API hiện chưa khả dụng cho model này. Nếu bạn đang dùng các công cụ như Codex CLI cần endpoint Responses, hãy dùng Mini thay thế.
Ngăn xếp model thông minh
Đây là mẫu mà chúng tôi khuyến nghị cho các ứng dụng AI production:
| Tác vụ | Model | Lý do |
|---|---|---|
| Kiến trúc, reasoning phức tạp | gpt-5.4 | Chất lượng tốt nhất trong phân khúc cho các quyết định quan trọng |
| Coding subagents, code review, computer use | gpt-5.4-mini | 60% Terminal-Bench với chi phí thấp hơn 70% so với 5.4 |
| Routing, classification, summaries, extraction | gpt-5.4-nano | Gần như miễn phí ở mức $0.05/1M input trên Smart AIPI |
| Sinh và chỉnh sửa ảnh | gpt-image-1.5 | Chất lượng ảnh frontier |
| Sinh video | sora-2 | Video dài tới 20 giây từ văn bản hoặc ảnh |
Bắt đầu nhanh
Cả hai model đều hoạt động với mọi OpenAI SDK. Chỉ cần đặt model ID:
Giá trên Smart AIPI
Như thường lệ, giảm 75% so với giá trực tiếp từ OpenAI:
| Model | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Với prompt caching (tự động, không cần thiết lập), các agents chạy dài hạn với system prompts ổn định sẽ thấy tỷ lệ cache hit 30-50% — giúp Mini còn rẻ hơn nữa cho các workload agentic.
Bắt đầu
Cả hai model đều đã sẵn sàng ngay bây giờ. Không có waitlist, không cần quyền truy cập đặc biệt.
- Đăng ký tài khoản Smart AIPI miễn phí (bao gồm $5 credits miễn phí)
- Đặt base URL của bạn thành
https://api.smartaipi.com/v1 - Dùng model
gpt-5.4-minihoặcgpt-5.4-nano - Hoặc thử ngay tại chat.smartaipi.com
Kỷ nguyên AI đắt đỏ đã kết thúc. Xây dựng nhiều hơn, chi ít hơn.
API gateway tương thích OpenAI. Truy cập các mô hình AI frontier với chi phí thấp hơn 75%.
Bắt đầu miễn phí