GPT-5.4 Mini та Nano: нові королі малих моделей
GPT-5.4 Mini набирає 60% у Terminal-Bench 2.0 лише за $0.75/1M input. GPT-5.4 Nano коштує $0.20/1M. Обидві вже доступні в Smart AIPI зі знижкою 75% — ось як використовувати їх для агентів, кодування та роботи з комп’ютером.
Коротко: GPT-5.4 Mini і Nano уже доступні в Smart AIPI. Mini набирає 60% у Terminal-Bench 2.0 за $0.75/1M input. Nano коштує лише $0.20/1M. Обидві моделі доступні зі знижкою 75%. Використовуйте gpt-5.4-mini і gpt-5.4-nano у будь-якому API виклику.
OpenAI щойно випустила дві нові моделі в сімействі 5.4, і вони змінюють економіку AI-розробки. GPT-5.4 Mini дає майже frontier-рівень можливостей у кодуванні за частку ціни. GPT-5.4 Nano — найдешевша frontier-модель, яку коли-небудь випускали.
Обидві вже зараз доступні в Smart AIPI.
Цифри
Ось як нові моделі порівнюються за ціною та продуктивністю:
| Модель | Terminal-Bench 2.0 | Input /1M | Output /1M | Smart AIPI Output |
|---|---|---|---|---|
| GPT-5.4 Mini | 60.0% | $0.75 | $4.50 | $1.125 |
| GPT-5.4 Nano | 46.2% | $0.20 | $1.25 | $0.3125 |
| Gemini 3 Flash | 47.7% | $0.50 | $3.00 | N/A |
| GPT-5.4 (full) | 72.1% | $2.50 | $15.00 | $3.75 |
GPT-5.4 Mini випереджає Gemini 3 Flash у кодуванні на 12+ пунктів, при цьому коштує лише на 50% більше за input. А в Smart AIPI цей розрив ще менший — ви платите $0.1875/1M input замість $0.50 у Gemini.
Коли яку модель використовувати
Сімейство 5.4 тепер дає вам три рівні під різні типи навантаження:
GPT-5.4 Mini: робоча модель для subagent
Це модель, яку варто брати для паралелізованих задач кодування. Якщо ви запускаєте Codex, Claude Code або будь-який агентний інструмент для кодування, який породжує subagent, Mini — це оптимальна точка балансу.
Як виглядає економіка subagent:
- Запускайте основного агента на
gpt-5.4з високим reasoning для архітектурних рішень - Створюйте subagent на
gpt-5.4-miniз високим reasoning для задач реалізації - Кожен subagent коштує приблизно на 70% менше, ніж запуск на повній моделі, і при цьому все одно набирає 60% у Terminal-Bench
- 10 паралельних subagent на Mini коштують менше, ніж 3 на GPT-5.4 — і завершують роботу швидше
Mini також добре підходить для роботи з комп’ютером і автоматизації браузера. Вона дає стабільну точність у задачах взаємодії з UI на значно вищій швидкості, ніж GPT-5.4, тому це правильний вибір для агентів вебскрейпінгу, автоматизованого тестування та будь-яких workflow, де моделі потрібно переходити між екранами й натискати кнопки без перевитрат бюджету.
Порада для Codex CLI: Встановіть model = "gpt-5.4-mini" у ~/.codex/config.toml разом із model_reasoning_effort = "high", щоб отримати швидкого й потужного помічника для кодування, який не спалюватиме ваші кредити.
GPT-5.4 Nano: робоча модель на щодень
За $0.20/1M input (або $0.05 у Smart AIPI) Nano — майже безкоштовна. Це не модель для кодування, але їй це й не потрібно. Використовуйте її для всього іншого:
- Класифікація та routing — визначити, яку модель або tool викликати
- Узагальнення — стискати документи, розмови, результати пошуку
- Витяг даних — отримувати структуровані поля з неструктурованого тексту
- Базові агентні задачі — прості багатокрокові workflow без генерації коду
- Назви розмов — ми самі використовуємо її для генерації заголовків чатів
- Модерація контенту — швидка й дешева фільтрація контенту в масштабі
Nano справляється із задачами, для яких раніше були потрібні GPT-4.1 Mini або GPT-5 Mini, але за частку їхньої вартості. Для high-throughput конвеєрів, що обробляють мільйони запитів, економія виходить величезною.
Примітка: GPT-5.4 Nano наразі підтримує лише endpoint Chat Completions (/v1/chat/completions). Responses API для цієї моделі поки що недоступний. Якщо ви використовуєте інструменти на кшталт Codex CLI, яким потрібен endpoint Responses, використовуйте Mini.
Розумний стек моделей
Ось який шаблон ми рекомендуємо для production AI-застосунків:
| Задача | Модель | Чому |
|---|---|---|
| Архітектура, складний reasoning | gpt-5.4 | Найкраща у класі якість для критичних рішень |
| Subagent для кодування, code review, робота з комп’ютером | gpt-5.4-mini | 60% у Terminal-Bench при вартості на 70% нижчій, ніж у 5.4 |
| Routing, класифікація, summary, витяг | gpt-5.4-nano | Майже безкоштовна: $0.05/1M input у Smart AIPI |
| Генерація та редагування зображень | gpt-image-1.5 | Frontier-якість зображень |
| Генерація відео | sora-2 | До 20 с відео з тексту або зображення |
Швидкий старт
Обидві моделі працюють з будь-яким OpenAI SDK. Просто вкажіть model ID:
Ціни в Smart AIPI
Як завжди, на 75% дешевше за прямі ціни OpenAI:
| Модель | Input /1M | Cached Input /1M | Output /1M |
|---|---|---|---|
| GPT-5.4 Mini | $0.1875 | $0.01875 | $1.125 |
| GPT-5.4 Nano | $0.05 | $0.005 | $0.3125 |
З prompt caching (автоматично, без додаткового налаштування) довготривалі агенти зі сталими system prompt зазвичай бачать 30–50% cache hit rate — тож Mini стає ще дешевшою для агентних навантажень.
Почніть зараз
Обидві моделі доступні вже зараз. Без waitlist, без спеціального доступу.
- Зареєструйтеся та отримайте безкоштовний акаунт Smart AIPI (включає $5 безкоштовних кредитів)
- Встановіть свій base URL на
https://api.smartaipi.com/v1 - Використовуйте модель
gpt-5.4-miniабоgpt-5.4-nano - Або спробуйте їх одразу на chat.smartaipi.com
Ера дорогого AI закінчилася. Створюйте більше, витрачайте менше.
OpenAI-сумісний API gateway. Доступ до frontier AI моделей на 75% дешевше.
Почати безкоштовно