GPT-5.4 Mini மற்றும் Nano: சிறிய Models-இன் புதிய ராஜாக்கள்
GPT-5.4 Mini, வெறும் $0.75/1M input-இல் Terminal-Bench 2.0-ல் 60% பெறுகிறது. GPT-5.4 Nano-வின் விலை $0.20/1M. இரண்டும் இப்போது Smart AIPI-ல் 75% தள்ளுபடியில் கிடைக்கின்றன — agents, coding, மற்றும் computer use-க்கு அவற்றைப் பயன்படுத்துவது எப்படி என்பதைக் காணுங்கள்.
சுருக்கமாக: GPT-5.4 Mini மற்றும் Nano இப்போது Smart AIPI-ல் live-ஆக உள்ளன. Mini, $0.75/1M input-இல் Terminal-Bench 2.0-ல் 60% பெறுகிறது. Nano-வின் விலை வெறும் $0.20/1M. இரண்டும் 75% தள்ளுபடியில் கிடைக்கின்றன. எந்த API call-இலும் gpt-5.4-mini மற்றும் gpt-5.4-nano பயன்படுத்தலாம்.
OpenAI இப்போது 5.4 family-இல் இரண்டு புதிய models-ஐ வெளியிட்டுள்ளது, மேலும் அவை AI development-இன் பொருளாதாரத்தை மாற்றுகின்றன. GPT-5.4 Mini மிகவும் குறைந்த விலைக்கு frontier-க்கு நெருக்கமான coding திறனை வழங்குகிறது. GPT-5.4 Nano இதுவரை வெளியிடப்பட்ட மிகக் குறைந்த விலை frontier model ஆகும்.
இரண்டும் இப்போது Smart AIPI-ல் live-ஆக உள்ளன.
எண்கள்
புதிய models விலை மற்றும் செயல்திறனில் எப்படி ஒப்பிடப்படுகின்றன என்பதை இங்கே பார்க்கலாம்:
| Model | Terminal-Bench 2.0 | Input /1M | Output /1M | Smart AIPI Output |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini, coding-இல் Gemini 3 Flash-ஐ 12+ points வித்தியாசத்தில் முந்துகிறது, அதே நேரத்தில் input-இல் 50% மட்டுமே அதிக செலவாகிறது. மேலும் Smart AIPI-ல் அந்த வித்தியாசம் இன்னும் குறைகிறது — Gemini-யின் $0.50-க்கு பதிலாக நீங்கள் $0.1875/1M input மட்டுமே செலுத்துகிறீர்கள்.
எந்த Model-ஐ எப்போது பயன்படுத்த வேண்டும்
உங்கள் workload-க்கு பொருந்துமாறு 5.4 family இப்போது மூன்று tiers-ஐ வழங்குகிறது:
GPT-5.4 Mini: Subagent வேலைகளின் முக்கிய இயந்திரம்
parallelized coding tasks-க்கு நீங்கள் விரும்ப வேண்டிய model இதுதான். நீங்கள் Codex, Claude Code, அல்லது subagents-ஐ உருவாக்கும் ஏதேனும் agentic coding tool-ஐ இயக்கினால், Mini தான் சரியான சமநிலை இடம்.
subagent cost strategy:
- architecture முடிவுகளுக்காக high reasoning உடன் உங்கள் main agent-ஐ
gpt-5.4-ல் இயக்குங்கள் - implementation tasks-க்காக high reasoning உடன் subagents-ஐ
gpt-5.4-mini-ல் தொடங்குங்கள் - ஒவ்வொரு subagent-க்கும் full model-ஐ பயன்படுத்துவதுடன் ஒப்பிடும்போது ~70% குறைந்த செலவாகும்; இருந்தாலும் Terminal-Bench-ல் 60% பெறுகிறது
- Mini-ல் 10 parallel subagents இயக்கும் செலவு, GPT-5.4-ல் 3 subagents-க்கும் குறைவாக இருக்கும் — மேலும் வேகமாக முடியும்
Mini, computer use மற்றும் browser automation-இலும் சிறப்பாக செயல்படுகிறது. UI interaction tasks-இல் இது வலுவான accuracy-ஐ GPT-5.4-ஐ விட மிகவும் அதிக வேகத்தில் வழங்குகிறது. அதனால் web scraping agents, automated testing, மற்றும் உங்கள் budget-ஐ வேகமாகச் செலவழிக்காமல் model screen-களை navigate செய்து buttons-ஐ click செய்ய வேண்டிய எந்த workflow-க்கும் இது சரியான தேர்வு.
Codex CLI tip: வேகமான, திறன் மிக்க coding assistant-ஐ credits விரைவாக குறையாமல் பெற ~/.codex/config.toml-இல் model = "gpt-5.4-mini" மற்றும் model_reasoning_effort = "high" அமைக்கவும்.
GPT-5.4 Nano: அன்றாட வேலைகளுக்கான முக்கிய இயந்திரம்
$0.20/1M input (அல்லது Smart AIPI-ல் $0.05) என்ற விலையில், Nano கிட்டத்தட்ட இலவசம் போலவே உள்ளது. இது coding model அல்ல — ஆனால் அவ்வாறு இருக்க வேண்டியதில்லை. இதை மற்ற எல்லாவற்றிற்கும் பயன்படுத்துங்கள்:
- Classification மற்றும் routing — எந்த model அல்லது tool-ஐ invoke செய்ய வேண்டும் என்பதை தீர்மானிக்க
- Summarization — documents, conversations, search results ஆகியவற்றை சுருக்கமாக்க
- Data extraction — structured அல்லாத text-இலிருந்து structured fields-ஐ எடுக்க
- Basic agentic tasks — code generation இல்லாத எளிய multi-step workflows
- Conversation titles — chat titles உருவாக்க இதையே நாங்களும் பயன்படுத்துகிறோம்
- Content moderation — பெரிய அளவில் வேகமான, குறைந்த செலவு content filtering
முன்பு GPT-4.1 Mini அல்லது GPT-5 Mini தேவைப்பட்ட tasks-ஐ Nano கையாளுகிறது, ஆனால் செலவு அதைவிட மிகக் குறைவு. மில்லியன் கணக்கான requests-ஐ செயலாக்கும் high-throughput pipelines-க்கு இந்த சேமிப்பு மிகப் பெரியது.
குறிப்பு: GPT-5.4 Nano தற்போது Chat Completions endpoint-ஐ மட்டும் ஆதரிக்கிறது (/v1/chat/completions). இந்த model-க்கு Responses API இன்னும் கிடைக்கவில்லை. Responses endpoint தேவைப்படும் Codex CLI போன்ற tools-ஐ நீங்கள் பயன்படுத்தினால், அதற்கு பதிலாக Mini-ஐ பயன்படுத்தவும்.
சரியான Model Stack
production AI applications-க்கு நாங்கள் பரிந்துரைக்கும் pattern இதுதான்:
| Task | Model | ஏன் |
|---|---|---|
| Architecture, complex reasoning | gpt-5.4 | முக்கிய முடிவுகளுக்கு துறையின் சிறந்த தரம் |
| Coding subagents, code review, computer use | gpt-5.4-mini | 5.4-ஐ விட 70% குறைந்த செலவில் 60% Terminal-Bench |
| Routing, classification, summaries, extraction | gpt-5.4-nano | Smart AIPI-ல் $0.05/1M input என்ற அளவுக்கு கிட்டத்தட்ட இலவசம் |
| Image generation and editing | gpt-image-1.5 | Frontier image quality |
| Video generation | sora-2 | text அல்லது image-இலிருந்து 20s வரை video |
விரைவான தொடக்கம்
இரண்டு models-மும் எந்த OpenAI SDK-யுடனும் வேலை செய்கின்றன. model ID-ஐ set செய்தால் போதும்:
Smart AIPI-ல் Pricing
எப்போதும்போல், OpenAI direct pricing-ஐ விட 75% தள்ளுபடி:
| Model | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
prompt caching (automatic, setup தேவையில்லை) உடன், ஒரே மாதிரியான system prompts-ஐ பயன்படுத்தும் நீண்ட நேர agents பொதுவாக 30-50% cache hit rates-ஐ காண்கின்றன — இதனால் agentic workloads-க்கு Mini இன்னும் குறைந்த செலவாகிறது.
தொடங்குங்கள்
இரண்டு models-மும் இப்போது உடனே கிடைக்கின்றன. waitlist இல்லை, special access தேவையில்லை.
- $5 free credits உடன் வரும் இலவச Smart AIPI account-க்கு பதிவு செய்யுங்கள்
- உங்கள் base URL-ஐ
https://api.smartaipi.com/v1என அமைக்கவும் gpt-5.4-miniஅல்லதுgpt-5.4-nanomodel-ஐ பயன்படுத்தவும்- அல்லது chat.smartaipi.com இல் உடனே முயற்சி செய்து பாருங்கள்
அதிகச் செலவான AI-யின் காலம் முடிந்துவிட்டது. அதிகமாக உருவாக்குங்கள், குறைவாகச் செலவிடுங்கள்.
OpenAI-compatible API gateway. Frontier AI models ஐ 75% குறைந்த செலவில் அணுகுங்கள்.
இலவசமாக தொடங்குங்கள்