Загрузка...

DeepSeek V4 Flash 0731

Разработчик: DeepSeek
Идентификатор:
Скопировано!
Чат

Характеристики DeepSeek V4 Flash 0731

Контекстное окно 1M

Дата релиза 31 июля 2026

Мультимодальность

Входящие данные:

  • Текст

Исходящие данные:

  • Текст

Цены DeepSeek V4 Flash 0731 в рублях

Оплата производится по факту за использованные токены.

Тип
Стоимость
Входящие токены
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
4,82 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Inceptron
    9 ₽
    Входящие
  • 2
    Sail Research
    9 ₽
    Входящие
  • 3
    CoreWeave
    15 ₽
    Входящие
  • 4
    Alibaba
    42 ₽
    Входящие · Пиковые часы
    03:00–17:00 МСК
    21 ₽
    Входящие · Внепиковые часы
    17:00–03:00 МСК
  • 5
    AtlasCloud
    53 ₽
    Входящие
  • 6
    Together
    16 ₽
    Входящие
  • 7
    BaseTen
    15 ₽
    Входящие
  • 8
    Cloudflare
    53 ₽
    Входящие
  • 9
    Venice
    21 ₽
    Входящие
  • 10
    Baidu
    53 ₽
    Входящие
  • 11
    Mancer 2
    24 ₽
    Входящие
  • 12
    Morph
    14 ₽
    Входящие
  • 13
    Makora
    10 ₽
    Входящие
  • 14
    Wafer
    12 ₽
    Входящие
  • 15
    Novita
    49 ₽
    Входящие
  • 16
    GMICloud
    34 ₽
    Входящие
  • 17
    Phala
    53 ₽
    Входящие
  • 18
    Parasail
    16 ₽
    Входящие
  • 19
    Reka
    13 ₽
    Входящие
  • 20
    DeepInfra
    7 ₽
    Входящие
  • 21
    SiliconFlow
    26 ₽
    Входящие
  • 22
    StreamLake
    6 ₽
    Входящие
  • 23
    OpenInference
    4,82 ₽
    Входящие
  • 24
    Fireworks
    26 ₽
    Входящие
  • 25
    Relace
    7 ₽
    Входящие
  • 26
    NextBit
    42 ₽
    Входящие
  • 27
    DigitalOcean
    9 ₽
    Входящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена
Исходящие токены
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
12 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Inceptron
    21 ₽
    Исходящие
  • 2
    Sail Research
    43 ₽
    Исходящие
  • 3
    CoreWeave
    33 ₽
    Исходящие
  • 4
    Alibaba
    127 ₽
    Исходящие · Пиковые часы
    03:00–17:00 МСК
    63 ₽
    Исходящие · Внепиковые часы
    17:00–03:00 МСК
  • 5
    AtlasCloud
    159 ₽
    Исходящие
  • 6
    Together
    33 ₽
    Исходящие
  • 7
    BaseTen
    31 ₽
    Исходящие
  • 8
    Cloudflare
    159 ₽
    Исходящие
  • 9
    Venice
    42 ₽
    Исходящие
  • 10
    Baidu
    159 ₽
    Исходящие
  • 11
    Mancer 2
    72 ₽
    Исходящие
  • 12
    Morph
    41 ₽
    Исходящие
  • 13
    Makora
    23 ₽
    Исходящие
  • 14
    Wafer
    30 ₽
    Исходящие
  • 15
    Novita
    147 ₽
    Исходящие
  • 16
    GMICloud
    103 ₽
    Исходящие
  • 17
    Phala
    159 ₽
    Исходящие
  • 18
    Parasail
    33 ₽
    Исходящие
  • 19
    Reka
    79 ₽
    Исходящие
  • 20
    DeepInfra
    21 ₽
    Исходящие
  • 21
    SiliconFlow
    79 ₽
    Исходящие
  • 22
    StreamLake
    20 ₽
    Исходящие
  • 23
    OpenInference
    12 ₽
    Исходящие
  • 24
    Fireworks
    79 ₽
    Исходящие
  • 25
    Relace
    14 ₽
    Исходящие
  • 26
    NextBit
    127 ₽
    Исходящие
  • 27
    DigitalOcean
    30 ₽
    Исходящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена
Чтение кеша
Повторное использование кэшированного контента снижает затраты благодаря применению пониженного тарифа на эти токены.
1,20 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Inceptron
    1,57 ₽
    Чтение кеша
  • 2
    Sail Research
    2,89 ₽
    Чтение кеша
  • 3
    CoreWeave
    8 ₽
    Чтение кеша
  • 4
    Alibaba
    4,24 ₽
    Чтение кеша · Пиковые часы
    03:00–17:00 МСК
    2,12 ₽
    Чтение кеша · Внепиковые часы
    17:00–03:00 МСК
  • 5
    AtlasCloud
    3,37 ₽
    Чтение кеша
  • 6
    Together
    3,61 ₽
    Чтение кеша
  • 7
    BaseTen
    3,37 ₽
    Чтение кеша
  • 8
    Cloudflare
    1,69 ₽
    Чтение кеша
  • 9
    Venice
    4,22 ₽
    Чтение кеша
  • 10
    Baidu
    1,69 ₽
    Чтение кеша
  • 11
    Morph
    3,77 ₽
    Чтение кеша
  • 12
    Makora
    2,36 ₽
    Чтение кеша
  • 13
    Wafer
    6 ₽
    Чтение кеша
  • 14
    Novita
    3,14 ₽
    Чтение кеша
  • 15
    GMICloud
    1,10 ₽
    Чтение кеша
  • 16
    Phala
    3,37 ₽
    Чтение кеша
  • 17
    Parasail
    6 ₽
    Чтение кеша
  • 18
    Reka
    0,84 ₽
    Чтение кеша
  • 19
    DeepInfra
    1,81 ₽
    Чтение кеша
  • 20
    SiliconFlow
    3,37 ₽
    Чтение кеша
  • 21
    StreamLake
    0,22 ₽
    Чтение кеша
  • 22
    OpenInference
    1,20 ₽
    Чтение кеша
  • 23
    Fireworks
    0,84 ₽
    Чтение кеша
  • 24
    Relace
    1,45 ₽
    Чтение кеша
  • 25
    NextBit
    1,45 ₽
    Чтение кеша
  • 26
    DigitalOcean
    3,04 ₽
    Чтение кеша

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена

Цены указаны в рублях и могут меняться в зависимости от курса валют

Что умеет DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 — это модель с разреженной смесью экспертов от DeepSeek, с 13 миллиардами активных параметров из 284 миллиардов общих. Эта пересмотренная версия, прошедшая повторное обучение, подходит для кодирования, рассуждений и рабочих процессов агентов.

API DeepSeek V4 Flash 0731: подключение и примеры кода

Наш сервис предоставляет единый API, совместимый с OpenAI SDK. Просто укажите наш base_url и используйте ключ, полученный в личном кабинете.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://routerai.ru/api/v1"
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)
import requests
import json

url = "https://routerai.ru/api/v1/chat/completions"
headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}

data = {
    "model": "deepseek/deepseek-v4-flash-0731",
    "messages": [
        {"role": "user", "content": "Hello, how are you?"}
    ]
}

response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-flash-0731",
    "messages": [
      {"role": "user", "content": "Hello, how are you?"}
    ]
  }'

Эндпоинты API

Chat Completions

Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.

POST https://routerai.ru/api/v1/chat/completions
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
deepseek/deepseek-v4-flash-0731

Поддерживаемые параметры запроса

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.

Responses API

Создаёт ответ в формате OpenAI Responses API — для агентных сценариев и работы с инструментами. Поддерживает потоковый и обычный режимы.

POST https://routerai.ru/api/v1/responses
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
deepseek/deepseek-v4-flash-0731

Поддерживаемые параметры запроса

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.

Messages API

Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).

POST https://routerai.ru/api/v1/messages
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
deepseek/deepseek-v4-flash-0731

Поддерживаемые параметры запроса

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.