Загрузка...

Step 3.5 Flash

Разработчик:
Stepfun
Релиз:
Идентификатор:
stepfun/step-3.5-flash

Цены Step 3.5 Flash в рублях — от 10 ₽ за 1 млн токенов

Модель обслуживает один провайдер, оплата — по факту за использованные токены.

Тип операции Стоимость
Вход За 1 млн токенов
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
10 ₽
Выход За 1 млн токенов
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
32 ₽
Кэш: чтение не поддерживается
—
Кэш: запись не поддерживается
—

Возможности Step 3.5 Flash

Step 3.5 Flash — это самая продвинутая модель с открытым исходным кодом от StepFun. Построенная на архитектуре разреженной смеси экспертов (MoE), она избирательно активирует только 11 миллиардов из своих 196 миллиардов параметров на каждый токен. Это модель рассуждений, которая невероятно эффективна по скорости даже при работе с длинными контекстами.

Характеристики Step 3.5 Flash

  • MoE
  • 196 млрд параметров
  • 11 млрд активных параметров

Топ 12 % по эффективности

Контекстное окно

Всего
262K токенов
На выход
66K токенов

Модальности

Вход
Текст
Выход
Текст

Сильные стороны

Рассуждения
GPQA Diamond: 83,1 %
Вопросы уровня PhD по биологии, физике и химии (подвыборка Diamond).
Поддерживает:
  • Режим рассуждений
  • Вызов инструментов

Сравнение Step 3.5 Flash с другими нейросетями: бенчмарки и рейтинг

Независимые замеры, а не цифры из пресс-релиза: место в рейтинге, сравнение с моделями класса и сколько интеллекта вы получаете за рубль.

Intelligence Index 16,6 № 84 из 151 — выше 44 % моделей
слабее все модели каталога умнее →
Цена ↔ Интеллект топ 12 % индекс 16,6 при 21 ₽ за 1М токенов
хуже все модели каталога лучше →

Step 3.5 Flash и модели его класса

Модель Intelligence Coding SciCode GPQA HLE Скорость Отклик Цена Убрать
GPT-5 Mini OpenAI 16,8 15,6 39,0 % 82,8 % 21,5 % — — 122 ₽
o4 Mini OpenAI 16,7 — 46,5 % 78,4 % 16,5 % — — 298 ₽
Gemma 4 26B A4B Google 16,7 39,3 40,0 % 79,2 % 19,3 % — — 14 ₽
Claude Sonnet 4 Anthropic 16,6 — 37,3 % 68,3 % 4,3 % — — 976 ₽
Step 3.5 Flash эта модель 16,6 — 38,5 % 83,1 % 21,1 % — — 21 ₽

Зелёным — лучшее значение в столбце, цена — среднее входа и выхода за 1М токенов. Данные независимых замеров — Artificial Analysis (замерено 5 октября 2026).

Все замеры модели 7
Intelligence Index
16,6
IFBench
64,6 %
SciCode
38,5 %
GPQA Diamond
83,1 %
Humanity's Last Exam
21,1 %
τ²-Bench
94,4 %
Terminal-Bench Hard
27,3 %

Провайдеры Step 3.5 Flash

Модель развёрнута у 1 провайдера: вход 10 ₽, выход 32 ₽ за 1 млн токенов.

Провайдер Вход Выход Контекст
Серверы: США SiliconFlow fp8 10 ₽ 32 ₽ 262K

Цены считаются по провайдеру, который фактически обработал запрос. Порядок в таблице — по возрастанию цены. Прочерк — провайдер не поддерживает операцию. Флаг — страна серверов или штаб-квартиры провайдера (на мобильном нажмите на первый столбец, на большом экране — на строку).

API Step 3.5 Flash:
подключение и примеры кода

API RouterAI совместим с OpenAI SDK: в существующем коде достаточно заменить base_url и ключ, идентификатор модели передаётся в поле model. Один ключ открывает доступ ко всем моделям каталога, лимиты и расход — в личном кабинете.

POST https://routerai.ru/api/v1/chat/completions
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://routerai.ru/api/v1"
)

response = client.chat.completions.create(
    model="stepfun/step-3.5-flash",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)

Эндпоинты API для Step 3.5 Flash

Схемы запроса и ответа повторяют OpenAI — существующие клиенты и SDK работают без изменений.

Chat Completions

Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.

POST https://routerai.ru/api/v1/chat/completions
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
stepfun/step-3.5-flash

Поддерживаемые параметры запроса

Параметр Тип По умолчанию Описание
max_tokens integer — Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature float 1 Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p float 1 Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
frequency_penalty float 0 Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
top_k integer — Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.

Частые вопросы о Step 3.5 Flash

Попробуйте Step 3.5 Flash

В чате или по API — доступ из России за пару минут, оплата в рублях.

Открыть в чате