GPT-5.4 Mini та Nano: нові королі малих моделей

GPT-5.4 Mini набирає 60% у Terminal-Bench 2.0 лише за $0.75/1M input. GPT-5.4 Nano коштує $0.20/1M. Обидві вже доступні в Smart AIPI зі знижкою 75% — ось як використовувати їх для агентів, кодування та роботи з комп’ютером.

S
Smart AIPI Team
6 хв читання ·
GPT-5.4 Mini та Nano: нові королі малих моделей
GPT-5.4 Mini selected in model picker

Коротко: GPT-5.4 Mini і Nano уже доступні в Smart AIPI. Mini набирає 60% у Terminal-Bench 2.0 за $0.75/1M input. Nano коштує лише $0.20/1M. Обидві моделі доступні зі знижкою 75%. Використовуйте gpt-5.4-mini і gpt-5.4-nano у будь-якому API виклику.

OpenAI щойно випустила дві нові моделі в сімействі 5.4, і вони змінюють економіку AI-розробки. GPT-5.4 Mini дає майже frontier-рівень можливостей у кодуванні за частку ціни. GPT-5.4 Nano — найдешевша frontier-модель, яку коли-небудь випускали.

Обидві вже зараз доступні в Smart AIPI.

Цифри

Ось як нові моделі порівнюються за ціною та продуктивністю:

Price vs coding ability chart showing GPT-5.4 Mini at 60% Terminal-Bench 2.0 score, GPT-5.4 Nano at 46%, and Gemini 3 Flash at 47.7%
Модель Terminal-Bench 2.0 Input /1M Output /1M Smart AIPI Output
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (full) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini випереджає Gemini 3 Flash у кодуванні на 12+ пунктів, при цьому коштує лише на 50% більше за input. А в Smart AIPI цей розрив ще менший — ви платите $0.1875/1M input замість $0.50 у Gemini.

Коли яку модель використовувати

Сімейство 5.4 тепер дає вам три рівні під різні типи навантаження:

GPT-5.4 Mini: робоча модель для subagent

Це модель, яку варто брати для паралелізованих задач кодування. Якщо ви запускаєте Codex, Claude Code або будь-який агентний інструмент для кодування, який породжує subagent, Mini — це оптимальна точка балансу.

Як виглядає економіка subagent:

  • Запускайте основного агента на gpt-5.4 з високим reasoning для архітектурних рішень
  • Створюйте subagent на gpt-5.4-mini з високим reasoning для задач реалізації
  • Кожен subagent коштує приблизно на 70% менше, ніж запуск на повній моделі, і при цьому все одно набирає 60% у Terminal-Bench
  • 10 паралельних subagent на Mini коштують менше, ніж 3 на GPT-5.4 — і завершують роботу швидше

Mini також добре підходить для роботи з комп’ютером і автоматизації браузера. Вона дає стабільну точність у задачах взаємодії з UI на значно вищій швидкості, ніж GPT-5.4, тому це правильний вибір для агентів вебскрейпінгу, автоматизованого тестування та будь-яких workflow, де моделі потрібно переходити між екранами й натискати кнопки без перевитрат бюджету.

Порада для Codex CLI: Встановіть model = "gpt-5.4-mini" у ~/.codex/config.toml разом із model_reasoning_effort = "high", щоб отримати швидкого й потужного помічника для кодування, який не спалюватиме ваші кредити.

GPT-5.4 Nano: робоча модель на щодень

За $0.20/1M input (або $0.05 у Smart AIPI) Nano — майже безкоштовна. Це не модель для кодування, але їй це й не потрібно. Використовуйте її для всього іншого:

  • Класифікація та routing — визначити, яку модель або tool викликати
  • Узагальнення — стискати документи, розмови, результати пошуку
  • Витяг даних — отримувати структуровані поля з неструктурованого тексту
  • Базові агентні задачі — прості багатокрокові workflow без генерації коду
  • Назви розмов — ми самі використовуємо її для генерації заголовків чатів
  • Модерація контенту — швидка й дешева фільтрація контенту в масштабі

Nano справляється із задачами, для яких раніше були потрібні GPT-4.1 Mini або GPT-5 Mini, але за частку їхньої вартості. Для high-throughput конвеєрів, що обробляють мільйони запитів, економія виходить величезною.

Примітка: GPT-5.4 Nano наразі підтримує лише endpoint Chat Completions (/v1/chat/completions). Responses API для цієї моделі поки що недоступний. Якщо ви використовуєте інструменти на кшталт Codex CLI, яким потрібен endpoint Responses, використовуйте Mini.

Розумний стек моделей

Ось який шаблон ми рекомендуємо для production AI-застосунків:

Задача Модель Чому
Архітектура, складний reasoning gpt-5.4 Найкраща у класі якість для критичних рішень
Subagent для кодування, code review, робота з комп’ютером gpt-5.4-mini 60% у Terminal-Bench при вартості на 70% нижчій, ніж у 5.4
Routing, класифікація, summary, витяг gpt-5.4-nano Майже безкоштовна: $0.05/1M input у Smart AIPI
Генерація та редагування зображень gpt-image-1.5 Frontier-якість зображень
Генерація відео sora-2 До 20 с відео з тексту або зображення

Швидкий старт

Обидві моделі працюють з будь-яким OpenAI SDK. Просто вкажіть model ID:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Швидке кодування з Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Дешева класифікація з Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Ціни в Smart AIPI

Як завжди, на 75% дешевше за прямі ціни OpenAI:

Модель Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

З prompt caching (автоматично, без додаткового налаштування) довготривалі агенти зі сталими system prompt зазвичай бачать 30–50% cache hit rate — тож Mini стає ще дешевшою для агентних навантажень.

Почніть зараз

Обидві моделі доступні вже зараз. Без waitlist, без спеціального доступу.

  1. Зареєструйтеся та отримайте безкоштовний акаунт Smart AIPI (включає $5 безкоштовних кредитів)
  2. Встановіть свій base URL на https://api.smartaipi.com/v1
  3. Використовуйте модель gpt-5.4-mini або gpt-5.4-nano
  4. Або спробуйте їх одразу на chat.smartaipi.com

Ера дорогого AI закінчилася. Створюйте більше, витрачайте менше.

GPT-5.4 Mini GPT-5.4 Nano Small Models
S
Автор
Smart AIPI

OpenAI-сумісний API gateway. Доступ до frontier AI моделей на 75% дешевше.

Почати безкоштовно

Повідомлення надіслано

Ми відповімо вам протягом 2 робочих днів.

Зв’язатися з підтримкою

Маєте запитання або потрібна допомога? Надішліть нам повідомлення, і ми відповімо вам протягом 2 робочих днів.