GPT-5.4 Mini и Nano: новые короли малых моделей

GPT-5.4 Mini набирает 60% в Terminal-Bench 2.0 при цене всего $0.75/1M input. GPT-5.4 Nano стоит $0.20/1M. Обе модели уже доступны в Smart AIPI со скидкой 75% — вот как использовать их для агентов, кодинга и работы с компьютером.

S
Smart AIPI Team
6 мин чтения ·
GPT-5.4 Mini и Nano: новые короли малых моделей
GPT-5.4 Mini выбран в селекторе моделей

Коротко: GPT-5.4 Mini и Nano уже доступны в Smart AIPI. Mini набирает 60% в Terminal-Bench 2.0 при цене $0.75/1M input. Nano стоит всего $0.20/1M. Обе модели доступны со скидкой 75%. Используйте gpt-5.4-mini и gpt-5.4-nano в любом API-вызове.

OpenAI только что выпустила две новые модели семейства 5.4, и они меняют экономику AI-разработки. GPT-5.4 Mini дает почти передовые возможности кодинга за небольшую часть стоимости. GPT-5.4 Nano — самая дешевая frontier-модель из когда-либо выпущенных.

Обе уже доступны в Smart AIPI прямо сейчас.

Цифры

Вот как новые модели выглядят по цене и производительности:

График цены и способностей к кодингу, показывающий GPT-5.4 Mini с результатом 60% в Terminal-Bench 2.0, GPT-5.4 Nano с 46% и Gemini 3 Flash с 47.7%
Модель Terminal-Bench 2.0 Input /1M Output /1M Smart AIPI Output
GPT-5.4 Mini 60.0% $0.75 $4.50 $1.125
GPT-5.4 Nano 46.2% $0.20 $1.25 $0.3125
Gemini 3 Flash 47.7% $0.50 $3.00 N/A
GPT-5.4 (full) 72.1% $2.50 $15.00 $3.75

GPT-5.4 Mini превосходит Gemini 3 Flash в кодинге на 12+ пунктов, при этом input стоит всего на 50% дороже. А в Smart AIPI этот разрыв становится еще меньше — вы платите $0.1875/1M input вместо $0.50 у Gemini.

Когда использовать какую модель

Семейство 5.4 теперь дает вам три уровня под разные типы нагрузки:

GPT-5.4 Mini: рабочая лошадка для субагентов

Это модель, которую стоит брать для параллелизованных задач кодинга. Если вы используете Codex, Claude Code или любой агентный инструмент для кодинга, который запускает субагентов, Mini — оптимальный вариант.

Выгодная схема с субагентами:

  • Запускайте основного агента на gpt-5.4 с высоким reasoning для архитектурных решений
  • Запускайте субагентов на gpt-5.4-mini с высоким reasoning для задач реализации
  • Каждый субагент стоит примерно на 70% меньше, чем запуск на полной модели, при этом все еще набирает 60% в Terminal-Bench
  • 10 параллельных субагентов на Mini стоят дешевле, чем 3 на GPT-5.4, и завершают работу быстрее

Mini также отлично показывает себя в computer use и browser automation. Она дает хорошую точность в задачах взаимодействия с UI при намного более высокой скорости, чем GPT-5.4, поэтому это правильный выбор для агентов веб-скрейпинга, автоматизированного тестирования и любых процессов, где модели нужно перемещаться по экранам и нажимать кнопки, не сжигая бюджет.

Совет для Codex CLI: Установите model = "gpt-5.4-mini" в ~/.codex/config.toml вместе с model_reasoning_effort = "high", чтобы получить быстрого и способного помощника для кодинга, который не будет быстро расходовать ваши кредиты.

GPT-5.4 Nano: рабочая лошадка на каждый день

При цене $0.20/1M input (или $0.05 в Smart AIPI) Nano практически бесплатна. Это не модель для кодинга — но ей это и не нужно. Используйте ее для всего остального:

  • Классификации и маршрутизации — решить, какую модель или tool вызывать
  • Суммаризации — сжимать документы, диалоги, результаты поиска
  • Извлечения данных — вытаскивать структурированные поля из неструктурированного текста
  • Базовых агентных задач — простых многошаговых workflow без генерации кода
  • Заголовков диалогов — мы сами используем ее для генерации названий чатов
  • Модерации контента — быстрая и дешевая фильтрация контента в масштабе

Nano справляется с задачами, для которых раньше требовались GPT-4.1 Mini или GPT-5 Mini, но за небольшую часть стоимости. Для high-throughput pipeline, обрабатывающих миллионы запросов, экономия получается огромной.

Примечание: GPT-5.4 Nano сейчас поддерживает только endpoint Chat Completions (/v1/chat/completions). Responses API для этой модели пока недоступен. Если вы используете инструменты вроде Codex CLI, которым нужен endpoint Responses, используйте Mini.

Умный стек моделей

Вот паттерн, который мы рекомендуем для production AI-приложений:

Задача Модель Почему
Архитектура, сложный reasoning gpt-5.4 Лучшее в классе качество для критически важных решений
Субагенты для кодинга, code review, computer use gpt-5.4-mini 60% в Terminal-Bench при стоимости на 70% ниже, чем у 5.4
Маршрутизация, классификация, summaries, extraction gpt-5.4-nano Почти бесплатно: $0.05/1M input в Smart AIPI
Генерация и редактирование изображений gpt-image-1.5 Frontier-качество изображений
Генерация видео sora-2 Видео до 20 секунд из текста или изображения

Быстрый старт

Обе модели работают с любым OpenAI SDK. Достаточно указать ID модели:

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.smartaipi.com/v1",
    api_key="your-api-key"
)

# Быстрый кодинг с Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Refactor this function to use async/await"}]
)

# Дешевая классификация с Nano
response = client.chat.completions.create(
    model="gpt-5.4-nano",
    messages=[{"role": "user", "content": "Classify this support ticket: ..."}]
)

Цены в Smart AIPI

Как всегда, на 75% дешевле прямых цен OpenAI:

Модель Input /1M Cached Input /1M Output /1M
GPT-5.4 Mini $0.1875 $0.01875 $1.125
GPT-5.4 Nano $0.05 $0.005 $0.3125

С prompt caching (автоматически, без дополнительной настройки) долгоживущие агенты с постоянными system prompt обычно получают 30–50% cache hit rate — и это делает Mini еще дешевле для агентных нагрузок.

Начните прямо сейчас

Обе модели уже доступны. Никакого waitlist, никакого специального доступа не требуется.

  1. Зарегистрируйтесь и получите бесплатный аккаунт Smart AIPI (включает $5 бесплатных кредитов)
  2. Установите base URL: https://api.smartaipi.com/v1
  3. Используйте модель gpt-5.4-mini или gpt-5.4-nano
  4. Или попробуйте их сразу на chat.smartaipi.com

Эра дорогого AI закончилась. Создавайте больше, тратьте меньше.

GPT-5.4 Mini GPT-5.4 Nano Малые модели
S
Автор
Smart AIPI

OpenAI-совместимый API gateway. Доступ к frontier AI моделям на 75% дешевле.

Начать бесплатно

Сообщение отправлено

Мы ответим вам в течение 2 рабочих дней.

Связаться с поддержкой

Есть вопрос или нужна помощь? Отправьте нам сообщение, и мы ответим вам в течение 2 рабочих дней.