Step 3.5 Flash
- Разработчик:
- Stepfun
- Релиз:
- Идентификатор:
-
stepfun/step-3.5-flash
Цены Step 3.5 Flash в рублях — от 10 ₽ за 1 млн токенов
Модель обслуживает один провайдер, оплата — по факту за использованные токены.
| Тип операции | Стоимость |
|---|---|
|
Вход
За 1 млн токенов
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
|
10 ₽ |
|
Выход
За 1 млн токенов
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
|
32 ₽ |
|
Кэш: чтение
не поддерживается
|
— |
|
Кэш: запись
не поддерживается
|
— |
Возможности Step 3.5 Flash
Step 3.5 Flash — это самая продвинутая модель с открытым исходным кодом от StepFun. Построенная на архитектуре разреженной смеси экспертов (MoE), она избирательно активирует только 11 миллиардов из своих 196 миллиардов параметров на каждый токен. Это модель рассуждений, которая невероятно эффективна по скорости даже при работе с длинными контекстами.
Характеристики Step 3.5 Flash
Контекстное окно
- Всего
- 262K токенов
- На выход
- 66K токенов
Модальности
- Вход
- Текст
- Выход
- Текст
Сильные стороны
- Рассуждения
-
GPQA Diamond: 83,1 %
Вопросы уровня PhD по биологии, физике и химии (подвыборка Diamond).
- Режим рассуждений
- Вызов инструментов
Сравнение Step 3.5 Flash с другими нейросетями: бенчмарки и рейтинг
Независимые замеры, а не цифры из пресс-релиза: место в рейтинге, сравнение с моделями класса и сколько интеллекта вы получаете за рубль.
Step 3.5 Flash и модели его класса
| Модель | Intelligence | Coding | SciCode | GPQA | HLE | Скорость | Отклик | Цена | Убрать |
|---|---|---|---|---|---|---|---|---|---|
|
|
16,8 | 15,6 | 39,0 % | 82,8 % | 21,5 % | — | — | 122 ₽ | |
|
|
16,7 | — | 46,5 % | 78,4 % | 16,5 % | — | — | 298 ₽ | |
|
|
16,7 | 39,3 | 40,0 % | 79,2 % | 19,3 % | — | — | 14 ₽ | |
|
|
16,6 | — | 37,3 % | 68,3 % | 4,3 % | — | — | 976 ₽ | |
Step 3.5 Flash
|
16,6 | — | 38,5 % | 83,1 % | 21,1 % | — | — | 21 ₽ |
Зелёным — лучшее значение в столбце, цена — среднее входа и выхода за 1М токенов. Данные независимых замеров — Artificial Analysis (замерено 5 октября 2026).
Все замеры модели 7
- Intelligence Index
- 16,6
- IFBench
- 64,6 %
- SciCode
- 38,5 %
- GPQA Diamond
- 83,1 %
- Humanity's Last Exam
- 21,1 %
- τ²-Bench
- 94,4 %
- Terminal-Bench Hard
- 27,3 %
Провайдеры Step 3.5 Flash
Модель развёрнута у 1 провайдера: вход 10 ₽, выход 32 ₽ за 1 млн токенов.
| Провайдер | Вход | Выход | Контекст |
|---|---|---|---|
|
|
10 ₽ | 32 ₽ | 262K |
Цены считаются по провайдеру, который фактически обработал запрос. Порядок в таблице — по возрастанию цены. Прочерк — провайдер не поддерживает операцию. Флаг — страна серверов или штаб-квартиры провайдера (на мобильном нажмите на первый столбец, на большом экране — на строку).
API Step 3.5 Flash:
подключение и примеры кода
API RouterAI совместим с OpenAI SDK: в существующем коде достаточно заменить
base_url
и ключ, идентификатор модели передаётся в поле
model.
Один ключ открывает доступ ко всем моделям каталога, лимиты и расход — в личном кабинете.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://routerai.ru/api/v1"
)
response = client.chat.completions.create(
model="stepfun/step-3.5-flash",
messages=[
{"role": "user", "content": "Hello, how are you?"}
]
)
print(response.choices[0].message.content)
import requests
import json
url = "https://routerai.ru/api/v1/chat/completions"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "stepfun/step-3.5-flash",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}
response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stepfun/step-3.5-flash",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}'
Эндпоинты API для Step 3.5 Flash
Схемы запроса и ответа повторяют OpenAI — существующие клиенты и SDK работают без изменений.
Chat Completions
Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- stepfun/step-3.5-flash
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| temperature | float | 1 | Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод. |
| top_p | float | 1 | Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P. |
| frequency_penalty | float | 0 | Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных. |
| top_k | integer | — | Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Responses API
Создаёт ответ в формате OpenAI Responses API — для агентных сценариев и работы с инструментами. Поддерживает потоковый и обычный режимы.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- stepfun/step-3.5-flash
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| temperature | float | 1 | Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод. |
| top_p | float | 1 | Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P. |
| frequency_penalty | float | 0 | Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных. |
| top_k | integer | — | Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Messages API
Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- stepfun/step-3.5-flash
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| temperature | float | 1 | Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод. |
| top_p | float | 1 | Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P. |
| frequency_penalty | float | 0 | Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных. |
| top_k | integer | — | Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Частые вопросы о Step 3.5 Flash
-
Работает ли Step 3.5 Flash из России без VPN?
Да. Прямой доступ через веб-чат и API RouterAI — без VPN, прокси и зарубежных карт, оплата в рублях.
-
Сколько стоит Step 3.5 Flash?
Вход — 10 ₽ за 1 млн токенов, выход — 32 ₽ за 1 млн токенов. Списывается только фактическое использование, без подписки.
-
Какой контекст у Step 3.5 Flash?
Контекстное окно — 262K токенов на запрос, длина ответа — до 66K токенов.
-
Поддерживает ли Step 3.5 Flash вызов инструментов?
Да: модель вызывает функции (параметр tools) — через API в формате OpenAI.
-
Что с данными в запросах к Step 3.5 Flash?
Содержимое запросов RouterAI передаёт только провайдеру модели для обработки и не использует для обучения моделей. Email, телефон и платёжные данные провайдерам не передаются, учётные данные хранятся на серверах в России. Политика конфиденциальности
-
Чем RouterAI отличается от сервиса Stepfun?
Один ключ и единый баланс в рублях для всех моделей каталога, API в формате OpenAI.
Попробуйте Step 3.5 Flash
В чате или по API — доступ из России за пару минут, оплата в рублях.