GPT-5.4 Mini ו-Nano: המלכים החדשים של המודלים הקטנים

GPT-5.4 Mini משיג 60% ב-Terminal-Bench 2.0 בעלות של $0.75/1M input בלבד. GPT-5.4 Nano עולה $0.20/1M. שניהם זמינים עכשיו ב-Smart AIPI בהנחה של 75% — כך משתמשים בהם עבור agents, קוד ושימוש במחשב.

S
Smart AIPI Team
6 דקות קריאה ·
GPT-5.4 Mini ו-Nano: המלכים החדשים של המודלים הקטנים
GPT-5.4 Mini נבחר בבורר המודלים

בקיצור: GPT-5.4 Mini ו-Nano פעילים ב-Smart AIPI. Mini משיג 60% ב-Terminal-Bench 2.0 במחיר של $0.75/1M input. Nano עולה רק $0.20/1M. שניהם זמינים בהנחה של 75%. השתמשו ב-gpt-5.4-mini וב-gpt-5.4-nano בכל קריאת API.

OpenAI השיקה עכשיו שני מודלים חדשים במשפחת 5.4, והם משנים את הכלכלה של פיתוח AI. GPT-5.4 Mini מביא יכולות קידוד כמעט ברמת frontier בשבריר מהמחיר. GPT-5.4 Nano הוא מודל ה-frontier הזול ביותר ששוחרר אי פעם.

שניהם פעילים עכשיו ב-Smart AIPI.

המספרים

כך המודלים החדשים משתווים מבחינת מחיר וביצועים:

גרף מחיר מול יכולת קידוד שמראה את GPT-5.4 Mini עם ציון 60% ב-Terminal-Bench 2.0, את GPT-5.4 Nano עם 46%, ואת Gemini 3 Flash עם 47.7%
מודל Terminal-Bench 2.0 Input /1M Output /1M Smart AIPI Output
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (full) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini עוקף את Gemini 3 Flash בקידוד ביותר מ-12 נקודות בזמן שהוא עולה רק ב-50% יותר ב-input. וב-Smart AIPI הפער הזה מצטמצם עוד יותר — אתם משלמים $0.1875/1M input במקום $0.50 של Gemini.

מתי להשתמש בכל מודל

משפחת 5.4 נותנת לכם עכשיו שלוש רמות שמתאימות לעומסי עבודה שונים:

GPT-5.4 Mini: סוס העבודה של Subagents

זה המודל שכדאי לכם לבחור עבור משימות קידוד מקביליות. אם אתם מריצים Codex, Claude Code או כל כלי קידוד agentic שיוצר subagents, Mini הוא נקודת האיזון הנכונה.

מהלך העלות של subagents:

  • הריצו את ה-agent הראשי שלכם על gpt-5.4 עם reasoning גבוה עבור החלטות ארכיטקטורה
  • צרו subagents על gpt-5.4-mini עם reasoning גבוה עבור משימות מימוש
  • כל subagent עולה ~70% פחות מהרצה על המודל המלא, ועדיין משיג 60% ב-Terminal-Bench
  • 10 subagents מקביליים על Mini עולים פחות מ-3 על GPT-5.4 — וגם מסיימים מהר יותר

Mini מצטיין גם ב-שימוש במחשב ואוטומציית דפדפן. הוא מספק דיוק טוב במשימות אינטראקציה עם UI במהירויות גבוהות משמעותית מ-GPT-5.4, מה שהופך אותו לבחירה הנכונה עבור agents של web scraping, בדיקות אוטומטיות וכל workflow שבו צריך שהמודל ינווט בין מסכים וילחץ על כפתורים בלי לשרוף את התקציב שלכם.

טיפ ל-Codex CLI: הגדירו model = "gpt-5.4-mini" בתוך ~/.codex/config.toml עם model_reasoning_effort = "high" כדי לקבל עוזר קידוד מהיר ומסוגל שלא ירוקן לכם את הקרדיטים.

GPT-5.4 Nano: סוס העבודה היומיומי

במחיר של $0.20/1M input (או $0.05 ב-Smart AIPI), Nano הוא כמעט בחינם. הוא לא מודל קידוד — אבל הוא גם לא צריך להיות כזה. השתמשו בו לכל השאר:

  • Classification ו-routing — להחליט איזה מודל או כלי להפעיל
  • Summarization — לתמצת מסמכים, שיחות ותוצאות חיפוש
  • חילוץ נתונים — למשוך שדות מובנים מטקסט לא מובנה
  • משימות agentic בסיסיות — workflows פשוטים מרובי שלבים שלא כוללים יצירת קוד
  • כותרות שיחה — אנחנו משתמשים בו בעצמנו כדי לייצר כותרות לצ'אטים
  • Content moderation — סינון תוכן מהיר וזול בקנה מידה גדול

Nano מטפל במשימות שבעבר דרשו GPT-4.1 Mini או GPT-5 Mini, אבל בשבריר מהעלות. עבור pipelines בתפוקה גבוהה שמעבדים מיליוני בקשות, החיסכון עצום.

הערה: GPT-5.4 Nano תומך כרגע רק ב-endpoint של Chat Completions ‏(/v1/chat/completions). ה-Responses API עדיין לא זמין עבור המודל הזה. אם אתם משתמשים בכלים כמו Codex CLI שדורשים את endpoint של Responses, השתמשו ב-Mini במקום.

מחסנית המודלים החכמה

זה הדפוס שאנחנו ממליצים עליו עבור אפליקציות AI בפרודקשן:

משימה מודל למה
ארכיטקטורה, reasoning מורכב gpt-5.4 האיכות הטובה ביותר בקטגוריה עבור החלטות קריטיות
subagents לקידוד, code review, שימוש במחשב gpt-5.4-mini 60% ב-Terminal-Bench בעלות נמוכה ב-70% מ-5.4
routing, classification, תקצירים, חילוץ gpt-5.4-nano כמעט חינם ב-$0.05/1M input ב-Smart AIPI
יצירה ועריכה של תמונות gpt-image-1.5 איכות תמונה ברמת frontier
יצירת וידאו sora-2 וידאו עד 20 שניות מטקסט או מתמונה

התחלה מהירה

שני המודלים עובדים עם כל OpenAI SDK. פשוט הגדירו את מזהה המודל:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# קידוד מהיר עם Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# classification זול עם Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

תמחור ב-Smart AIPI

כמו תמיד, 75% הנחה ממחירי OpenAI הישירים:

מודל Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

עם prompt caching (אוטומטי, בלי צורך בהגדרה), agents ארוכי ריצה עם system prompts עקביים רואים שיעורי cache hit של 30-50% — מה שהופך את Mini לעוד יותר זול עבור עומסי עבודה agentic.

התחילו עכשיו

שני המודלים זמינים כבר עכשיו. בלי waitlist, בלי צורך בגישה מיוחדת.

  1. הירשמו לחשבון Smart AIPI חינמי (כולל $5 בקרדיטים חינמיים)
  2. הגדירו את ה-base URL שלכם ל-https://api.smartaipi.com/v1
  3. השתמשו במודל gpt-5.4-mini או gpt-5.4-nano
  4. או נסו אותם מיד ב-chat.smartaipi.com

העידן של AI יקר נגמר. בנו יותר, הוציאו פחות.

GPT-5.4 Mini GPT-5.4 Nano מודלים קטנים
S
נכתב על ידי
Smart AIPI

שער API תואם-OpenAI. גישה למודלי AI מתקדמים בעלות נמוכה ב-75%.

התחל בחינם

ההודעה נשלחה

נחזור אליך תוך 2 ימי עסקים.

יצירת קשר עם התמיכה

יש לך שאלה או צריך עזרה? שלח לנו הודעה ונחזור אליך תוך 2 ימי עסקים.