DeepSeek V4 Pro 0813
- Разработчик:
- DeepSeek
- Релиз:
- Идентификатор:
-
deepseek/deepseek-v4-pro-0813
Также доступна под алиасом ~deepseek/deepseek-v4-pro-latest — он всегда указывает на актуальную версию.
Цены DeepSeek V4 Pro 0813 в рублях — от 38 ₽ за 1 млн токенов
Провайдер подбирается автоматически — по доступности, затем по цене.
| Тип операции | Стоимость |
|---|---|
|
Вход
За 1 млн токенов
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
|
38 ₽ |
|
Выход
За 1 млн токенов
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
|
114 ₽ |
|
Кэш: чтение
За 1 млн токенов
Повторное использование кэшированного контента снижает затраты благодаря применению пониженного тарифа на эти токены.
|
1,22 ₽ |
|
Кэш: запись
не поддерживается
|
— |
Возможности DeepSeek V4 Pro 0813
DeepSeek V4 Pro 0813 — это крупномасштабная модель смеси экспертов от DeepSeek. Это GA-релиз DeepSeek V4 Pro.
Характеристики DeepSeek V4 Pro 0813
Контекстное окно
- Всего
- 1M токенов
- На выход
- 384K токенов
Модальности
- Вход
- Текст
- Выход
- Текст
Сильные стороны
- Кодинг
-
Coding Index: 68,8
Сводный индекс Artificial Analysis по кодовым бенчмаркам.
- Рассуждения
-
GPQA Diamond: 92,8 %
Вопросы уровня PhD по биологии, физике и химии (подвыборка Diamond).
- Режим рассуждений
- Вызов инструментов
- Структурированный вывод
- Кэш промпта
Сравнение DeepSeek V4 Pro 0813 с другими нейросетями: бенчмарки и рейтинг
| Модель | Intelligence | Coding | SciCode | GPQA | HLE | Скорость | Отклик | Цена | Убрать |
|---|---|---|---|---|---|---|---|---|---|
|
|
53,4 | 81,6 | 63,1 % | 93,7 % | 59,1 % | 71 ток/с | 137,7 с | 3782 ₽ | |
|
|
53,0 | 68,8 | 49,2 % | 92,8 % | 39,3 % | — | — | 76 ₽ | |
|
|
52,7 | 76,9 | 56,5 % | 96,1 % | 54,7 % | 55 ток/с | 211,4 с | 3289 ₽ | |
|
|
50,8 | 78,0 | 56,4 % | 93,2 % | 54,9 % | — | — | 1644 ₽ | |
|
|
49,6 | 76,5 | 61,0 % | 92,6 % | 55,5 % | — | — | 3782 ₽ |
Зелёным — лучшее значение в столбце, цена — среднее входа и выхода за 1М токенов. Данные независимых замеров — Artificial Analysis (замерено 13 августа 2026).
Все замеры модели 5
- Intelligence Index
- 53,0
- Coding Index
- 68,8
- SciCode
- 49,2 %
- GPQA Diamond
- 92,8 %
- Humanity's Last Exam
- 39,3 %
Провайдеры DeepSeek V4 Pro 0813
Порядок выбора по умолчанию: сначала провайдеры без сбоев, среди них — самый дешёвый, остальные подстраховывают.
| Провайдер | Вход | Выход | Кэш: чтение | Контекст |
|---|---|---|---|---|
|
|
38 ₽ | 114 ₽ | 1,22 ₽ | 1M |
|
|
38 ₽ | 537 ₽ | 38 ₽ | 1M |
|
|
38 ₽ | 300 ₽ | 13 ₽ | 1M |
|
|
40 ₽ | 121 ₽ | 1,35 ₽ | 1M |
|
|
61 ₽ | 660 ₽ | 5,07 ₽ | 1M |
|
|
89 ₽ 172 ₽ 89 ₽ | 267 ₽ 516 ₽ 267 ₽ | 8 ₽ 17 ₽ 8 ₽ | 1M |
|
|
101 ₽ 202 ₽ 101 ₽ | 303 ₽ 607 ₽ 303 ₽ | 3,38 ₽ 6 ₽ 3,38 ₽ | 1M |
|
|
146 ₽ | 441 ₽ | 15 ₽ | 1M |
|
|
151 ₽ | 455 ₽ | 5,07 ₽ | 1M |
|
|
162 ₽ | 486 ₽ | 5,40 ₽ | 1M |
|
|
162 ₽ | 486 ₽ | 5,37 ₽ | 1M |
|
|
199 ₽ | 399 ₽ | 15 ₽ | 1M |
|
|
201 ₽ | 607 ₽ | 6 ₽ | 1M |
|
|
202 ₽ | 607 ₽ | 20 ₽ | 1M |
|
|
202 ₽ | 607 ₽ | 6 ₽ | 1M |
| DigitalOcean | 202 ₽ | 607 ₽ | 6 ₽ | 1M |
|
|
202 ₽ | 607 ₽ | 6 ₽ | 1M |
|
|
202 ₽ | 607 ₽ | 6 ₽ | 1M |
|
|
202 ₽ | 607 ₽ | 6 ₽ | 1M |
|
|
202 ₽ | 607 ₽ | 19 ₽ | 1M |
|
|
253 ₽ | 759 ₽ | 25 ₽ | 1M |
Цены считаются по провайдеру, который фактически обработал запрос. Порядок в таблице — по возрастанию цены. Прочерк — провайдер не поддерживает операцию. Флаг — страна серверов или штаб-квартиры провайдера (подробности — при наведении).
API DeepSeek V4 Pro 0813: подключение и примеры кода
base_url
и ключ, идентификатор модели передаётся в поле
model.
Один ключ открывает доступ ко всем моделям каталога, лимиты и расход — в личном кабинете.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://routerai.ru/api/v1"
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-pro-0813",
messages=[
{"role": "user", "content": "Hello, how are you?"}
]
)
print(response.choices[0].message.content)
import requests
import json
url = "https://routerai.ru/api/v1/chat/completions"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "deepseek/deepseek-v4-pro-0813",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}
response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-v4-pro-0813",
"messages": [
{"role": "user", "content": "Hello, how are you?"}
]
}'
Эндпоинты API для DeepSeek V4 Pro 0813
Chat Completions
Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- deepseek/deepseek-v4-pro-0813
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| temperature | float | 1 | Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод. |
| top_p | float | 1 | Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P. |
| seed | integer | — | Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат. |
| logprobs | boolean | — | Возвращать ли логарифмы вероятностей выходных токенов. |
| top_logprobs | integer | — | Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности. |
| response_format | map | — | Заставляет модель выдавать ответ в определённом формате. |
| stop | array | — | Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop. |
| frequency_penalty | float | 0 | Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных. |
| presence_penalty | float | 0 | Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных. |
| repetition_penalty | float | — | Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются. |
| top_k | integer | — | Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге. |
| min_p | float | — | Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен. |
| logit_bias | map | — | Изменяет вероятность появления указанных токенов в ответе. |
| structured_outputs | boolean | — | Поддержка ответа по строгой JSON-схеме. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Responses API
Создаёт ответ в формате OpenAI Responses API — для агентных сценариев и работы с инструментами. Поддерживает потоковый и обычный режимы.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- deepseek/deepseek-v4-pro-0813
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| temperature | float | 1 | Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод. |
| top_p | float | 1 | Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P. |
| seed | integer | — | Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат. |
| logprobs | boolean | — | Возвращать ли логарифмы вероятностей выходных токенов. |
| top_logprobs | integer | — | Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности. |
| response_format | map | — | Заставляет модель выдавать ответ в определённом формате. |
| stop | array | — | Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop. |
| frequency_penalty | float | 0 | Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных. |
| presence_penalty | float | 0 | Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных. |
| repetition_penalty | float | — | Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются. |
| top_k | integer | — | Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге. |
| min_p | float | — | Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен. |
| logit_bias | map | — | Изменяет вероятность появления указанных токенов в ответе. |
| structured_outputs | boolean | — | Поддержка ответа по строгой JSON-схеме. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Messages API
Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- deepseek/deepseek-v4-pro-0813
Поддерживаемые параметры запроса
| Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| max_tokens | integer | — | Верхний предел количества токенов, которые модель может сгенерировать в ответе. |
| temperature | float | 1 | Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод. |
| top_p | float | 1 | Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P. |
| seed | integer | — | Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат. |
| logprobs | boolean | — | Возвращать ли логарифмы вероятностей выходных токенов. |
| top_logprobs | integer | — | Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности. |
| response_format | map | — | Заставляет модель выдавать ответ в определённом формате. |
| stop | array | — | Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop. |
| frequency_penalty | float | 0 | Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных. |
| presence_penalty | float | 0 | Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных. |
| repetition_penalty | float | — | Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются. |
| top_k | integer | — | Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге. |
| min_p | float | — | Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен. |
| logit_bias | map | — | Изменяет вероятность появления указанных токенов в ответе. |
| structured_outputs | boolean | — | Поддержка ответа по строгой JSON-схеме. |
| tool_choice | map | — | Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы. |
| tools | array | — | Список инструментов (функций), которые модель может вызвать. |
| reasoning | map | — | Настройки рассуждений модели (бюджет токенов, уровень усилий). |
| include_reasoning | boolean | — | Возвращать ли в ответе цепочку рассуждений модели. |
Частые вопросы о DeepSeek V4 Pro 0813
Работает ли DeepSeek V4 Pro 0813 из России без VPN?
Да. Прямой доступ через веб-чат и API RouterAI — без VPN, прокси и зарубежных карт, оплата в рублях.
Сколько стоит DeepSeek V4 Pro 0813?
Вход — 38 ₽ за 1 млн токенов, выход — 114 ₽ за 1 млн токенов. Списывается только фактическое использование, без подписки.
Какой контекст у DeepSeek V4 Pro 0813?
Контекстное окно — 1M токенов на запрос, длина ответа — до 384K токенов.
Поддерживает ли DeepSeek V4 Pro 0813 вызов инструментов?
Да: модель вызывает функции (параметр tools) и умеет отвечать по строгой JSON-схеме — через API в формате OpenAI.
Что с данными в запросах к DeepSeek V4 Pro 0813?
Содержимое запросов RouterAI передаёт только провайдеру модели для обработки и не использует для обучения моделей. Email, телефон и платёжные данные провайдерам не передаются, учётные данные хранятся на серверах в России. Политика конфиденциальности
Чем RouterAI отличается от сервиса DeepSeek?
Один ключ и единый баланс в рублях для всех моделей каталога, API в формате OpenAI, а при сбое провайдера запрос автоматически уходит к одному из 21 остальных.
Попробуйте DeepSeek V4 Pro 0813
В чате или по API — доступ из России за пару минут, оплата в рублях.
Открыть в чате