GPT-5.4 Mini ו-Nano: המלכים החדשים של המודלים הקטנים
GPT-5.4 Mini משיג 60% ב-Terminal-Bench 2.0 בעלות של $0.75/1M input בלבד. GPT-5.4 Nano עולה $0.20/1M. שניהם זמינים עכשיו ב-Smart AIPI בהנחה של 75% — כך משתמשים בהם עבור agents, קוד ושימוש במחשב.
בקיצור: GPT-5.4 Mini ו-Nano פעילים ב-Smart AIPI. Mini משיג 60% ב-Terminal-Bench 2.0 במחיר של $0.75/1M input. Nano עולה רק $0.20/1M. שניהם זמינים בהנחה של 75%. השתמשו ב-gpt-5.4-mini וב-gpt-5.4-nano בכל קריאת API.
OpenAI השיקה עכשיו שני מודלים חדשים במשפחת 5.4, והם משנים את הכלכלה של פיתוח AI. GPT-5.4 Mini מביא יכולות קידוד כמעט ברמת frontier בשבריר מהמחיר. GPT-5.4 Nano הוא מודל ה-frontier הזול ביותר ששוחרר אי פעם.
שניהם פעילים עכשיו ב-Smart AIPI.
המספרים
כך המודלים החדשים משתווים מבחינת מחיר וביצועים:
| מודל | Terminal-Bench 2.0 | Input /1M | Output /1M | Smart AIPI Output |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini עוקף את Gemini 3 Flash בקידוד ביותר מ-12 נקודות בזמן שהוא עולה רק ב-50% יותר ב-input. וב-Smart AIPI הפער הזה מצטמצם עוד יותר — אתם משלמים $0.1875/1M input במקום $0.50 של Gemini.
מתי להשתמש בכל מודל
משפחת 5.4 נותנת לכם עכשיו שלוש רמות שמתאימות לעומסי עבודה שונים:
GPT-5.4 Mini: סוס העבודה של Subagents
זה המודל שכדאי לכם לבחור עבור משימות קידוד מקביליות. אם אתם מריצים Codex, Claude Code או כל כלי קידוד agentic שיוצר subagents, Mini הוא נקודת האיזון הנכונה.
מהלך העלות של subagents:
- הריצו את ה-agent הראשי שלכם על
gpt-5.4עם reasoning גבוה עבור החלטות ארכיטקטורה - צרו subagents על
gpt-5.4-miniעם reasoning גבוה עבור משימות מימוש - כל subagent עולה ~70% פחות מהרצה על המודל המלא, ועדיין משיג 60% ב-Terminal-Bench
- 10 subagents מקביליים על Mini עולים פחות מ-3 על GPT-5.4 — וגם מסיימים מהר יותר
Mini מצטיין גם ב-שימוש במחשב ואוטומציית דפדפן. הוא מספק דיוק טוב במשימות אינטראקציה עם UI במהירויות גבוהות משמעותית מ-GPT-5.4, מה שהופך אותו לבחירה הנכונה עבור agents של web scraping, בדיקות אוטומטיות וכל workflow שבו צריך שהמודל ינווט בין מסכים וילחץ על כפתורים בלי לשרוף את התקציב שלכם.
טיפ ל-Codex CLI: הגדירו model = "gpt-5.4-mini" בתוך ~/.codex/config.toml עם model_reasoning_effort = "high" כדי לקבל עוזר קידוד מהיר ומסוגל שלא ירוקן לכם את הקרדיטים.
GPT-5.4 Nano: סוס העבודה היומיומי
במחיר של $0.20/1M input (או $0.05 ב-Smart AIPI), Nano הוא כמעט בחינם. הוא לא מודל קידוד — אבל הוא גם לא צריך להיות כזה. השתמשו בו לכל השאר:
- Classification ו-routing — להחליט איזה מודל או כלי להפעיל
- Summarization — לתמצת מסמכים, שיחות ותוצאות חיפוש
- חילוץ נתונים — למשוך שדות מובנים מטקסט לא מובנה
- משימות agentic בסיסיות — workflows פשוטים מרובי שלבים שלא כוללים יצירת קוד
- כותרות שיחה — אנחנו משתמשים בו בעצמנו כדי לייצר כותרות לצ'אטים
- Content moderation — סינון תוכן מהיר וזול בקנה מידה גדול
Nano מטפל במשימות שבעבר דרשו GPT-4.1 Mini או GPT-5 Mini, אבל בשבריר מהעלות. עבור pipelines בתפוקה גבוהה שמעבדים מיליוני בקשות, החיסכון עצום.
הערה: GPT-5.4 Nano תומך כרגע רק ב-endpoint של Chat Completions (/v1/chat/completions). ה-Responses API עדיין לא זמין עבור המודל הזה. אם אתם משתמשים בכלים כמו Codex CLI שדורשים את endpoint של Responses, השתמשו ב-Mini במקום.
מחסנית המודלים החכמה
זה הדפוס שאנחנו ממליצים עליו עבור אפליקציות AI בפרודקשן:
| משימה | מודל | למה |
|---|---|---|
| ארכיטקטורה, reasoning מורכב | gpt-5.4 | האיכות הטובה ביותר בקטגוריה עבור החלטות קריטיות |
| subagents לקידוד, code review, שימוש במחשב | gpt-5.4-mini | 60% ב-Terminal-Bench בעלות נמוכה ב-70% מ-5.4 |
| routing, classification, תקצירים, חילוץ | gpt-5.4-nano | כמעט חינם ב-$0.05/1M input ב-Smart AIPI |
| יצירה ועריכה של תמונות | gpt-image-1.5 | איכות תמונה ברמת frontier |
| יצירת וידאו | sora-2 | וידאו עד 20 שניות מטקסט או מתמונה |
התחלה מהירה
שני המודלים עובדים עם כל OpenAI SDK. פשוט הגדירו את מזהה המודל:
תמחור ב-Smart AIPI
כמו תמיד, 75% הנחה ממחירי OpenAI הישירים:
| מודל | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
עם prompt caching (אוטומטי, בלי צורך בהגדרה), agents ארוכי ריצה עם system prompts עקביים רואים שיעורי cache hit של 30-50% — מה שהופך את Mini לעוד יותר זול עבור עומסי עבודה agentic.
התחילו עכשיו
שני המודלים זמינים כבר עכשיו. בלי waitlist, בלי צורך בגישה מיוחדת.
- הירשמו לחשבון Smart AIPI חינמי (כולל $5 בקרדיטים חינמיים)
- הגדירו את ה-base URL שלכם ל-
https://api.smartaipi.com/v1 - השתמשו במודל
gpt-5.4-miniאוgpt-5.4-nano - או נסו אותם מיד ב-chat.smartaipi.com
העידן של AI יקר נגמר. בנו יותר, הוציאו פחות.