o4 Mini
- Разработчик:
- OpenAI
- Релиз:
- Идентификатор:
-
openai/o4-mini
Цены o4 Mini в рублях — от 122 ₽ за 1 млн токенов
Модель обслуживает один провайдер, оплата — по факту за использованные токены.
| Тип операции | Стоимость |
|---|---|
|
Вход
За 1 млн токенов
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
|
122 ₽ |
|
Выход
За 1 млн токенов
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
|
488 ₽ |
|
Кэш: чтение
За 1 млн токенов
Повторное использование кэшированного контента снижает затраты благодаря применению пониженного тарифа на эти токены.
|
30 ₽ |
|
Кэш: запись
не поддерживается
|
— |
|
Веб-поиск
За 1 тыс вызовов
Тарифицируется каждый вызов веб-поиска, который модель делает при ответе.
|
1111 ₽ |
Возможности o4 Mini
OpenAI o4-mini — это компактная модель рассуждений в серии o, оптимизированная для быстрого и экономичного выполнения задач, при этом обладающая сильными мультимодальными и агентными возможностями. Она поддерживает использование инструментов и демонстрирует конкурентоспособные результаты в рассуждениях и программировании по таким тестам, как AIME (99,5% с использованием Python) и SWE-bench, превосходя своего предшественника o3-mini и даже приближаясь к o3 в некоторых областях.
Несмотря на меньший размер, o4-mini демонстрирует высокую точность в задачах STEM, визуальном решении проблем (например, MathVista, MMMU) и редактировании кода. Она особенно хорошо подходит для сценариев с высокой пропускной способностью, где критичны задержка или стоимость. Благодаря своей эффективной архитектуре и усовершенствованному обучению с подкреплением, o4-mini может связывать инструменты, генерировать структурированные выходные данные и решать многошаговые задачи с минимальной задержкой — часто менее чем за минуту.
Характеристики o4 Mini
Контекстное окно
- Всего
- 200K токенов
- На выход
- 100K токенов
Модальности
- Вход
- Изображения Текст Файл
- Выход
- Текст
Сильные стороны
- Рассуждения
-
GPQA Diamond: 78,4 %
Вопросы уровня PhD по биологии, физике и химии (подвыборка Diamond).
- Режим рассуждений
- Вызов инструментов
- Структурированный вывод
- Кэш промпта
- Веб-поиск
Сравнение o4 Mini с другими нейросетями: бенчмарки и рейтинг
Независимые замеры, а не цифры из пресс-релиза: место в рейтинге, сравнение с моделями класса и сколько интеллекта вы получаете за рубль.
o4 Mini и модели его класса
| Модель | Intelligence | Coding | SciCode | GPQA | HLE | Скорость | Отклик | Цена | Убрать |
|---|---|---|---|---|---|---|---|---|---|
|
|
16,8 | 15,6 | 39,0 % | 82,8 % | 21,5 % | — | — | 125 ₽ | |
|
|
16,7 | 39,3 | 40,0 % | 79,2 % | 19,3 % | — | — | 14 ₽ | |
|
|
16,7 | — | 46,5 % | 78,4 % | 16,5 % | — | — | 305 ₽ | |
|
|
16,6 | — | 37,3 % | 68,3 % | 4,3 % | — | — | 1000 ₽ | |
|
|
16,6 | — | 38,5 % | 83,1 % | 21,1 % | — | — | 22 ₽ |
Зелёным — лучшее значение в столбце, цена — среднее входа и выхода за 1М токенов. Данные независимых замеров — Artificial Analysis (замерено 8 октября 2026).
Все замеры модели 12
- Intelligence Index
- 16,7
- IFBench
- 68,7 %
- MMLU-Pro
- 83,2 %
- LiveCodeBench
- 85,9 %
- SciCode
- 46,5 %
- Math Index
- 90,7
- AIME
- 94,0 %
- MATH-500
- 98,9 %
- GPQA Diamond
- 78,4 %
- Humanity's Last Exam
- 16,5 %
- τ²-Bench
- 55,6 %
- Terminal-Bench Hard
- 15,2 %
Провайдеры o4 Mini
Модель развёрнута у 1 провайдера: вход 122 ₽, выход 488 ₽ за 1 млн токенов.
| Провайдер | Вход | Выход | Кэш: чтение | Контекст |
|---|---|---|---|---|
|
|
122 ₽ | 488 ₽ | 30 ₽ | 200K |
Цены считаются по провайдеру, который фактически обработал запрос. Порядок в таблице — по возрастанию цены. Прочерк — провайдер не поддерживает операцию. Флаг — страна серверов или штаб-квартиры провайдера (на мобильном нажмите на первый столбец, на большом экране — на строку).
API o4 Mini:
подключение и примеры кода
API RouterAI совместим с OpenAI SDK: в существующем коде достаточно заменить
base_url
и ключ, идентификатор модели передаётся в поле
model.
Один ключ открывает доступ ко всем моделям каталога, лимиты и расход — в личном кабинете.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://routerai.ru/api/v1"
)
response = client.chat.completions.create(
model="openai/o4-mini",
messages=[
{"role": "user", "content": "Hello, how are you?"}
]
)
print(response.choices[0].message.content)
import requests
import json
url = "https://routerai.ru/api/v1/chat/completions"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "openai/o4-mini",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}
response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/o4-mini",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}'
Эндпоинты API для o4 Mini
Схемы запроса и ответа повторяют OpenAI — существующие клиенты и SDK работают без изменений.
Chat Completions
Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- openai/o4-mini
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| seed | integer | — | Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат. |
| response_format | map | — | Заставляет модель выдавать ответ в определённом формате. |
| structured_outputs | boolean | — | Поддержка ответа по строгой JSON-схеме. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Responses API
Создаёт ответ в формате OpenAI Responses API — для агентных сценариев и работы с инструментами. Поддерживает потоковый и обычный режимы.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- openai/o4-mini
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| seed | integer | — | Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат. |
| response_format | map | — | Заставляет модель выдавать ответ в определённом формате. |
| structured_outputs | boolean | — | Поддержка ответа по строгой JSON-схеме. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Messages API
Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- openai/o4-mini
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| seed | integer | — | Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат. |
| response_format | map | — | Заставляет модель выдавать ответ в определённом формате. |
| structured_outputs | boolean | — | Поддержка ответа по строгой JSON-схеме. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Частые вопросы о o4 Mini
-
Работает ли o4 Mini из России без VPN?
Да. Прямой доступ через веб-чат и API RouterAI — без VPN, прокси и зарубежных карт, оплата в рублях.
-
Сколько стоит o4 Mini?
Вход — 122 ₽ за 1 млн токенов, выход — 488 ₽ за 1 млн токенов. Списывается только фактическое использование, без подписки.
-
Какой контекст у o4 Mini?
Контекстное окно — 200K токенов на запрос, длина ответа — до 100K токенов.
-
Поддерживает ли o4 Mini вызов инструментов?
Да: модель вызывает функции (параметр tools) и умеет отвечать по строгой JSON-схеме — через API в формате OpenAI.
-
Что с данными в запросах к o4 Mini?
Содержимое запросов RouterAI передаёт только провайдеру модели для обработки и не использует для обучения моделей. Email, телефон и платёжные данные провайдерам не передаются, учётные данные хранятся на серверах в России. Политика конфиденциальности
-
Чем RouterAI отличается от сервиса OpenAI?
Один ключ и единый баланс в рублях для всех моделей каталога, API в формате OpenAI.
Попробуйте o4 Mini
В чате или по API — доступ из России за пару минут, оплата в рублях.