GPT-5.4 כאן: המודל היכולותי ביותר של OpenAI, זמין עכשיו ב-Smart AIPI
GPT-5.4 זמין עכשיו ב-Smart AIPI. בנצ'מרקים חדשים ברמת state-of-the-art בקוד, reasoning, מתמטיקה ומשימות agentic — ובמחיר נמוך ב-75% מהתמחור הישיר של OpenAI.
בקיצור: GPT-5.4 זמין עכשיו ב-Smart AIPI. השתמשו במודל gpt-5.4 בכל קריאת API. הוא מנצח את GPT-5.3 Codex בכל הבנצ'מרקים המרכזיים — קוד, reasoning, מתמטיקה ומשימות agentic — והוא זמין כבר עכשיו בהנחה של 75% ממחירי OpenAI.
OpenAI בדיוק הוציאה את GPT-5.4, וזהו שדרוג משמעותי לעומת GPT-5.3 Codex. כבר בדקנו אותו, הוספנו אותו לרשימת המודלים שלנו, והוא זמין כעת ב-Smart AIPI.
הנה מה שצריך לדעת.
הבנצ'מרקים
GPT-5.4 קובע תוצאות state-of-the-art חדשות כמעט בכל בנצ'מרק מרכזי. כך הוא משתווה ל-GPT-5.3 Codex, GPT-5.2, Claude Opus 4.6 ו-Gemini 3.1 Pro:
| Benchmark | GPT-5.4 | GPT-5.3 Codex | Claude Opus 4.6 | Gemini 3.1 Pro |
|---|---|---|---|---|
| OSWorld שימוש במחשב |
75.0% | 74.0% | 72.7% | — |
| WebArena גלישה באינטרנט |
67.3% | — | 66.4% | — |
| GDPval עבודת ידע |
83.0% | 70.9% | 78.0% | — |
| BrowseComp גלישה agentic |
82.7% | 77.3% | 84.0% | 85.9% |
| SWE-Bench Pro הנדסת תוכנה |
57.7% | 56.8% | — | 54.2% |
| GPQA Diamond reasoning מדעי ברמת מומחה |
92.8% | 92.6% | 91.3% | 94.3% |
| FrontierMath מתמטיקה מתקדמת |
47.6% | — | 40.7% | 36.9% |
| Toolathlon שימוש agentic בכלים |
54.6% | 51.9% | 44.8% | — |
המספרים הבולטים: 83% ב-GDPval (עבודת ידע, עלייה מ-70.9%), 57.7% ב-SWE-Bench Pro (תקן הזהב לקוד בעולם האמיתי), ו-47.6% ב-FrontierMath (מתמטיקה מתקדמת שלפני שנה נחשבה כמעט בלתי אפשרית).
ומה לגבי GPT-5.4 Pro?
OpenAI גם הכריזה על GPT-5.4 Pro, וריאנט חזק עוד יותר שמיועד לחשיבה ממושכת. תוצאות ה-Pro מרשימות:
- BrowseComp: 89.3% (הגבוה ביותר מכל מודל)
- GPQA Diamond: 94.4%
- FrontierMath: 50.0% (המודל הראשון שהגיע לחצי)
- FrontierMath Tier 4: 38.0% (כמעט כפול מ-22.9% של Claude Opus 4.6)
GPT-5.4 Pro עדיין לא זמין דרך ה-API. נוסיף תמיכה ברגע שהוא יהיה זמין.
איך להשתמש ב-GPT-5.4 ב-Smart AIPI
הוא כבר זמין. פשוט החליפו את פרמטר המודל:
Chat Completions API
curl https://api.smartaipi.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"messages": [{"role": "user", "content": "Hello!"}]
}'
Responses API
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"input": "Explain quantum computing in simple terms"
}'
עם Reasoning
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"input": "Solve this step by step: what is the integral of x^2 * e^x?",
"reasoning": {"effort": "high", "summary": "auto"}
}'
מצב מהיר (Priority Processing)
GPT-5.4 תומך ב-fast mode דרך הפרמטר service_tier: "priority". זה מעניק לבקשות שלכם priority processing כדי לקבל latency נמוך יותר — בלי לשנות את עומק ה-reasoning או את איכות הפלט.
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"input": "Refactor this function",
"service_tier": "priority"
}'
זה נפרד מ-reasoning.effort — אפשר להשתמש ב-priority processing עם כל רמת reasoning. ב-Codex CLI, השתמשו בפקודת ה-slash /fast כדי להפעיל או לכבות priority processing במהלך סשן.
הערת תמחור: priority processing מחויב לפי 1.5x מהתעריף הסטנדרטי. עבור GPT-5.4, זה אומר $0.9375/1M input ו-$5.625/1M output tokens (לעומת $0.625 ו-$3.75 בתעריף הרגיל).
Codex CLI
עדכנו את ~/.codex/config.toml:
model = "gpt-5.4"
OpenCode
עדכנו את ההגדרות שלכם כך שישתמשו ב-gpt-5.4 בתור מזהה המודל.
חשוב: הפרמטר store
עם GPT-5.4 (וכל המודלים מכאן והלאה), ה-API upstream עכשיו מחייב ש-store יוגדר ל-false. אם תשלחו "store": true או תשמיטו אותו עם ברירת מחדל ישנה, תקבלו שגיאת "Store must be set to false".
Smart AIPI מטפלת בזה אוטומטית — אצלנו store מוגדר כברירת מחדל ל-false גם ב-Responses API וגם ב-WebSocket endpoints. אתם לא צריכים לשנות כלום. אבל אם הקוד שלכם מגדיר במפורש "store": true, תצטרכו לעדכן אותו:
// לפני (נשבר עם GPT-5.4)
{"model": "gpt-5.4", "input": "Hello", "store": true}
// אחרי (עובד)
{"model": "gpt-5.4", "input": "Hello", "store": false}
// או פשוט להשמיט — Smart AIPI מגדיר false כברירת מחדל
{"model": "gpt-5.4", "input": "Hello"}
אם אתם משתמשים ב-previous_response_id לשיחות מרובות פניות, שימו לב ש-store: false אומר שהשרת לא ישמור responses. ה-WebSocket endpoint של Smart AIPI מטפל במצב השיחה באופן פנימי, כך ששיחה מרובת פניות עדיין עובדת דרך WebSockets בלי שמירה.
מה השתנה לעומת GPT-5.3 Codex
עבור מפתחים, השיפורים המשמעותיים ביותר הם:
- קוד טוב יותר. SWE-Bench Pro עלה מ-56.8% ל-57.7% — שיפור הדרגתי אבל משמעותי בקצה העליון. חשוב יותר, בפועל המודל מטפל ב-refactors מורכבים על פני כמה קבצים וב-debugging בדיוק טוב יותר באופן מורגש.
- reasoning חזק יותר. GPQA Diamond השתפר ל-92.8%, ו-FrontierMath קפץ ל-47.6%. המודל פותר בעיות מורכבות בצורה אמינה יותר.
- ביצועי agentic טובים יותר. OSWorld (75.0%), Toolathlon (54.6%) ו-WebArena (67.3%) כולם מראים שהמודל טוב יותר בשימוש אוטונומי במחשב ובאינטראקציה עם כלים — בדיוק מה שצריך עבור agents לקוד.
- קפיצה בעבודת ידע. GDPval עלה מ-70.9% ל-83.0%, קפיצה של 12 נקודות. המודל טוב משמעותית במשימות ידע מהעולם האמיתי.
תמחור
75% פחות מהתמחור הישיר של OpenAI. GPT-5.4 ב-OpenAI עולה $2.50/1M input ו-$15/1M output. דרך Smart AIPI, אתם משלמים $0.625/1M input ו-$3.75/1M output.
GPT-5.4 תומך גם ב-1M context window ניסיוני (לעומת 272K הסטנדרטיים). בקשות שעוברות את 272K tokens מחויבות לפי 2x מהתעריף הרגיל — זו מדיניות upstream של OpenAI שחלה בלי קשר לספק.
כולל credits בחינם. כל חשבון חדש מקבל credits בחינם. הירשמו ב-smartaipi.com/signup, צרו API key, והתחילו להשתמש ב-GPT-5.4 מיד. אין צורך בכרטיס אשראי.
התחלה מהירה
- הירשמו ב-smartaipi.com/signup (credits בחינם, ללא כרטיס אשראי)
- צרו API key ב-dashboard
- הגדירו את ה-base URL ל-
https://api.smartaipi.com/v1 - השתמשו במודל
gpt-5.4
זה הכול. אותו API, אותם כלים, מודל טוב יותר, זול ב-75%.