GPT-5.4 Mini at Nano: Ang Mga Bagong Hari ng Small Models
Ang GPT-5.4 Mini ay nakakakuha ng 60% sa Terminal-Bench 2.0 sa halagang $0.75/1M input lang. Ang GPT-5.4 Nano ay nagkakahalaga ng $0.20/1M. Available na ngayon ang pareho sa Smart AIPI na may 75% off — narito kung paano gamitin ang mga ito para sa agents, coding, at computer use.
TL;DR: Live na sa Smart AIPI ang GPT-5.4 Mini at Nano. Nakakakuha ang Mini ng 60% sa Terminal-Bench 2.0 sa $0.75/1M input. Ang Nano ay nagkakahalaga lang ng $0.20/1M. Available ang pareho na may 75% off. Gamitin ang gpt-5.4-mini at gpt-5.4-nano sa anumang API call.
Kakalabas lang ng OpenAI ng dalawang bagong model sa 5.4 family, at binabago nila ang economics ng AI development. Ang GPT-5.4 Mini ay naghahatid ng near-frontier coding ability sa maliit na bahagi ng presyo. Ang GPT-5.4 Nano ang pinakamurang frontier model na nailabas kailanman.
Live na ngayon ang pareho sa Smart AIPI.
Mga Numero
Narito kung paano naghahambing ang mga bagong model sa presyo at performance:
| Model | Terminal-Bench 2.0 | Input /1M | Output /1M | Smart AIPI Output |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
Tinalo ng GPT-5.4 Mini ang Gemini 3 Flash sa coding ng 12+ puntos habang 50% lang ang dagdag na gastos sa input. At sa Smart AIPI, lalo pang lumiit ang agwat na iyon — nagbabayad ka ng $0.1875/1M input sa halip na $0.50 ng Gemini.
Kailan Gagamitin ang Bawat Model
Ang 5.4 family ay nagbibigay na ngayon ng tatlong tier para tumugma sa iyong workload:
GPT-5.4 Mini: Ang Workhorse para sa Subagent
Ito ang model na gusto mo para sa parallelized coding tasks. Kung nagpapatakbo ka ng Codex, Claude Code, o anumang agentic coding tool na nagse-spawn ng subagents, Mini ang pinakamagandang balanse.
Ang cost play para sa subagent:
- Patakbuhin ang iyong main agent sa
gpt-5.4na may high reasoning para sa mga desisyon sa architecture - Mag-spawn ng subagents sa
gpt-5.4-minina may high reasoning para sa mga implementation task - Bawat subagent ay nagkakahalaga ng ~70% na mas mababa kaysa pagpapatakbo sa full model, habang nakakakuha pa rin ng 60% sa Terminal-Bench
- Ang 10 parallel subagents sa Mini ay mas mura kaysa 3 sa GPT-5.4 — at mas mabilis matapos
Mahusay din ang Mini sa computer use at browser automation. Naghahatid ito ng solid na accuracy sa mga task ng UI interaction sa mas mabilis na bilis kaysa GPT-5.4, kaya ito ang tamang piliin para sa web scraping agents, automated testing, at anumang workflow kung saan kailangan mong ipanavigate sa model ang mga screen at i-click ang mga button nang hindi inuubos ang iyong budget.
Tip sa Codex CLI: Itakda ang model = "gpt-5.4-mini" sa ~/.codex/config.toml kasama ang model_reasoning_effort = "high" para sa isang mabilis at mahusay na coding assistant na hindi uubos sa iyong credits.
GPT-5.4 Nano: Ang Pang-araw-araw na Workhorse
Sa $0.20/1M input (o $0.05 sa Smart AIPI), halos libre na ang Nano. Hindi ito coding model — pero hindi naman kailangan. Gamitin ito para sa lahat ng iba pa:
- Classification at routing — magpasya kung aling model o tool ang tatawagin
- Summarization — paikliin ang mga dokumento, pag-uusap, at search results
- Data extraction — humugot ng structured fields mula sa unstructured text
- Basic agentic tasks — mga simpleng multi-step workflow na walang code generation
- Mga pamagat ng pag-uusap — ginagamit din namin ito para sa pag-generate ng mga chat title
- Content moderation — mabilis at murang content filtering sa scale
Kaya ng Nano ang mga task na dati ay nangangailangan ng GPT-4.1 Mini o GPT-5 Mini pero sa maliit na bahagi ng gastos. Para sa mga high-throughput pipeline na nagpoproseso ng milyun-milyong request, napakalaki ng matitipid.
Tandaan: Kasalukuyang sinusuportahan lang ng GPT-5.4 Nano ang Chat Completions endpoint (/v1/chat/completions). Hindi pa available ang Responses API para sa model na ito. Kung gumagamit ka ng mga tool tulad ng Codex CLI na nangangailangan ng Responses endpoint, gamitin ang Mini sa halip.
Ang Smart Model Stack
Narito ang pattern na inirerekomenda namin para sa production AI applications:
| Task | Model | Bakit |
|---|---|---|
| Architecture, complex reasoning | gpt-5.4 | Best-in-class na kalidad para sa mga kritikal na desisyon |
| Coding subagents, code review, computer use | gpt-5.4-mini | 60% Terminal-Bench sa 70% mas mababang gastos kaysa 5.4 |
| Routing, classification, summaries, extraction | gpt-5.4-nano | Halos libre sa $0.05/1M input sa Smart AIPI |
| Image generation at editing | gpt-image-1.5 | Frontier na kalidad ng image |
| Video generation | sora-2 | Hanggang 20s na video mula sa text o image |
Mabilisang Pagsisimula
Gumagana ang parehong model sa anumang OpenAI SDK. Itakda lang ang model ID:
Pagpepresyo sa Smart AIPI
Gaya ng dati, 75% off sa OpenAI direct pricing:
| Model | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
Sa prompt caching (automatic, walang setup na kailangan), ang mga long-running agent na may consistent na system prompts ay nakakakita ng 30-50% cache hit rates — kaya mas lalo pang bumababa ang gastos ng Mini para sa agentic workloads.
Magsimula Na
Available na ngayon ang parehong model. Walang waitlist, walang espesyal na access na kailangan.
- Mag-sign up para sa libreng Smart AIPI account (may kasamang $5 libreng credits)
- Itakda ang iyong base URL sa
https://api.smartaipi.com/v1 - Gamitin ang model na
gpt-5.4-miniogpt-5.4-nano - O subukan agad ang mga ito sa chat.smartaipi.com
Tapos na ang panahon ng mamahaling AI. Bumuo ng mas marami, gumastos ng mas kaunti.
API gateway na compatible sa OpenAI. Ma-access ang frontier AI models nang 75% mas mababa ang gastos.
Magsimula nang libre