GPT-5.4 Mini và Nano: Những ông vua mới của các model nhỏ

GPT-5.4 Mini đạt 60% trên Terminal-Bench 2.0 với chi phí chỉ $0.75/1M input. GPT-5.4 Nano có giá $0.20/1M. Cả hai hiện đã có trên Smart AIPI với mức giảm giá 75% — đây là cách dùng chúng cho agents, coding và computer use.

S
Smart AIPI Team
Đọc trong 6 phút ·
GPT-5.4 Mini và Nano: Những ông vua mới của các model nhỏ
Đã chọn GPT-5.4 Mini trong bộ chọn model

Tóm tắt: GPT-5.4 Mini và Nano đã hoạt động trên Smart AIPI. Mini đạt 60% trên Terminal-Bench 2.0 với giá $0.75/1M input. Nano chỉ có giá $0.20/1M. Cả hai đều đang được giảm 75%. Dùng gpt-5.4-minigpt-5.4-nano trong bất kỳ API call nào.

OpenAI vừa phát hành hai model mới trong dòng 5.4, và chúng thay đổi bài toán kinh tế của phát triển AI. GPT-5.4 Mini mang lại khả năng coding gần mức frontier với chi phí chỉ bằng một phần nhỏ. GPT-5.4 Nano là model frontier rẻ nhất từng được phát hành.

Cả hai đều đã có mặt trên Smart AIPI ngay bây giờ.

Các con số

Dưới đây là cách các model mới so sánh về giá và hiệu năng:

Biểu đồ giá so với khả năng coding cho thấy GPT-5.4 Mini đạt 60% điểm Terminal-Bench 2.0, GPT-5.4 Nano đạt 46%, và Gemini 3 Flash đạt 47.7%
Model Terminal-Bench 2.0 Input /1M Output /1M Output trên Smart AIPI
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (bản đầy đủ) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini vượt Gemini 3 Flash về coding hơn 12+ điểm trong khi chỉ đắt hơn 50% ở input. Và trên Smart AIPI, khoảng cách đó còn thu hẹp hơn nữa — bạn trả $0.1875/1M input thay vì $0.50 của Gemini.

Khi nào nên dùng model nào

Dòng 5.4 hiện cung cấp cho bạn ba tầng để phù hợp với workload:

GPT-5.4 Mini: Cỗ máy chủ lực cho subagent

Đây là model bạn nên dùng cho các tác vụ coding song song. Nếu bạn đang chạy Codex, Claude Code, hoặc bất kỳ công cụ coding dạng agent nào tạo ra subagents, Mini là điểm cân bằng tốt nhất.

Chiến lược chi phí với subagent:

  • Chạy main agent của bạn trên gpt-5.4 với reasoning cao cho các quyết định về kiến trúc
  • Tạo subagents trên gpt-5.4-mini với reasoning cao cho các tác vụ triển khai
  • Mỗi subagent có chi phí thấp hơn ~70% so với chạy trên model đầy đủ, trong khi vẫn đạt 60% trên Terminal-Bench
  • 10 subagents chạy song song trên Mini có chi phí thấp hơn 3 subagents trên GPT-5.4 — và hoàn thành nhanh hơn

Mini cũng rất mạnh ở computer use và tự động hóa trình duyệt. Nó mang lại độ chính xác tốt trên các tác vụ tương tác UI với tốc độ nhanh hơn nhiều so với GPT-5.4, khiến nó trở thành lựa chọn phù hợp cho web scraping agents, kiểm thử tự động và bất kỳ workflow nào mà bạn cần model điều hướng qua các màn hình và nhấn nút mà không làm cháy ngân sách.

Mẹo Codex CLI: Đặt model = "gpt-5.4-mini" trong ~/.codex/config.toml với model_reasoning_effort = "high" để có một trợ lý coding nhanh, mạnh mà không làm cạn credits của bạn.

GPT-5.4 Nano: Cỗ máy chủ lực hằng ngày

Với mức giá $0.20/1M input (hoặc $0.05 trên Smart AIPI), Nano gần như miễn phí. Đây không phải model coding — nhưng nó không cần phải như vậy. Hãy dùng nó cho mọi thứ khác:

  • Classification và routing — quyết định model hoặc công cụ nào cần được gọi
  • Summarization — rút gọn tài liệu, hội thoại, kết quả tìm kiếm
  • Data extraction — trích xuất các trường có cấu trúc từ văn bản phi cấu trúc
  • Các tác vụ agentic cơ bản — các workflow nhiều bước đơn giản không liên quan đến sinh code
  • Tiêu đề hội thoại — chính chúng tôi cũng dùng nó để tạo tiêu đề chat
  • Content moderation — lọc nội dung nhanh, rẻ ở quy mô lớn

Nano xử lý được các tác vụ trước đây cần GPT-4.1 Mini hoặc GPT-5 Mini nhưng với chi phí chỉ bằng một phần nhỏ. Với các pipeline thông lượng cao xử lý hàng triệu request, khoản tiết kiệm là rất lớn.

Lưu ý: GPT-5.4 Nano hiện chỉ hỗ trợ endpoint Chat Completions (/v1/chat/completions). Responses API hiện chưa khả dụng cho model này. Nếu bạn đang dùng các công cụ như Codex CLI cần endpoint Responses, hãy dùng Mini thay thế.

Ngăn xếp model thông minh

Đây là mẫu mà chúng tôi khuyến nghị cho các ứng dụng AI production:

Tác vụ Model Lý do
Kiến trúc, reasoning phức tạp gpt-5.4 Chất lượng tốt nhất trong phân khúc cho các quyết định quan trọng
Coding subagents, code review, computer use gpt-5.4-mini 60% Terminal-Bench với chi phí thấp hơn 70% so với 5.4
Routing, classification, summaries, extraction gpt-5.4-nano Gần như miễn phí ở mức $0.05/1M input trên Smart AIPI
Sinh và chỉnh sửa ảnh gpt-image-1.5 Chất lượng ảnh frontier
Sinh video sora-2 Video dài tới 20 giây từ văn bản hoặc ảnh

Bắt đầu nhanh

Cả hai model đều hoạt động với mọi OpenAI SDK. Chỉ cần đặt model ID:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Coding nhanh với Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Classification giá rẻ với Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Giá trên Smart AIPI

Như thường lệ, giảm 75% so với giá trực tiếp từ OpenAI:

Model Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

Với prompt caching (tự động, không cần thiết lập), các agents chạy dài hạn với system prompts ổn định sẽ thấy tỷ lệ cache hit 30-50% — giúp Mini còn rẻ hơn nữa cho các workload agentic.

Bắt đầu

Cả hai model đều đã sẵn sàng ngay bây giờ. Không có waitlist, không cần quyền truy cập đặc biệt.

  1. Đăng ký tài khoản Smart AIPI miễn phí (bao gồm $5 credits miễn phí)
  2. Đặt base URL của bạn thành https://api.smartaipi.com/v1
  3. Dùng model gpt-5.4-mini hoặc gpt-5.4-nano
  4. Hoặc thử ngay tại chat.smartaipi.com

Kỷ nguyên AI đắt đỏ đã kết thúc. Xây dựng nhiều hơn, chi ít hơn.

GPT-5.4 Mini GPT-5.4 Nano Models nhỏ
S
Viết bởi
Smart AIPI

API gateway tương thích OpenAI. Truy cập các mô hình AI frontier với chi phí thấp hơn 75%.

Bắt đầu miễn phí

Đã gửi tin nhắn

Chúng tôi sẽ phản hồi trong vòng 2 ngày làm việc.

Liên hệ hỗ trợ

Có câu hỏi hoặc cần hỗ trợ? Hãy gửi cho chúng tôi một tin nhắn và chúng tôi sẽ phản hồi trong vòng 2 ngày làm việc.