Загрузка...

Z.ai: GLM 5.2

Идентификатор:
Скопировано!
Чат

Характеристики

Контекстное окно 1M

Дата релиза 16 июня 2026

Мультимодальность

Входящие данные:

  • Текст

Исходящие данные:

  • Текст

Цены

Оплата производится по факту за использованные токены.

Тип
Стоимость
Входящие токены
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
27 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Alibaba

    125 ₽
    Входящие
  • 2
    Morph

    112 ₽
    Входящие
  • 3
    Ionstream

    142 ₽
    Входящие
  • 4
    Ambient

    107 ₽
    Входящие
  • 5
    Chutes

    142 ₽
    Входящие
  • 6
    Inceptron

    95 ₽
    Входящие
  • 7
    Baidu

    28 ₽
    Входящие
  • 8
    Z.AI

    142 ₽
    Входящие
  • 9
    Friendli

    142 ₽
    Входящие
  • 10
    Cloudflare

    142 ₽
    Входящие
  • 11
    DeepInfra

    94 ₽
    Входящие
  • 12
    AtlasCloud

    128 ₽
    Входящие
  • 13
    Parasail

    142 ₽
    Входящие
  • 14
    Io Net

    238 ₽
    Входящие
  • 15
    Phala

    142 ₽
    Входящие
  • 16
    Together

    142 ₽
    Входящие
  • 17
    SiliconFlow

    132 ₽
    Входящие
  • 18
    GMICloud

    142 ₽
    Входящие
  • 19
    Decart

    122 ₽
    Входящие
  • 20
    AkashML

    132 ₽
    Входящие
  • 21
    Venice

    142 ₽
    Входящие
  • 22
    DigitalOcean

    107 ₽
    Входящие
  • 23
    WandB

    141 ₽
    Входящие
  • 24
    Novita

    27 ₽
    Входящие
  • 25
    Wafer

    305 ₽
    Входящие
  • 26
    StreamLake

    27 ₽
    Входящие
  • 27
    Fireworks

    214 ₽
    Входящие
  • 28
    BaseTen

    142 ₽
    Входящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена
Исходящие токены
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
87 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Alibaba

    395 ₽
    Исходящие
  • 2
    Morph

    417 ₽
    Исходящие
  • 3
    Ionstream

    448 ₽
    Исходящие
  • 4
    Ambient

    448 ₽
    Исходящие
  • 5
    Chutes

    448 ₽
    Исходящие
  • 6
    Inceptron

    295 ₽
    Исходящие
  • 7
    Baidu

    89 ₽
    Исходящие
  • 8
    Z.AI

    448 ₽
    Исходящие
  • 9
    Friendli

    448 ₽
    Исходящие
  • 10
    Cloudflare

    448 ₽
    Исходящие
  • 11
    DeepInfra

    305 ₽
    Исходящие
  • 12
    AtlasCloud

    403 ₽
    Исходящие
  • 13
    Parasail

    448 ₽
    Исходящие
  • 14
    Io Net

    522 ₽
    Исходящие
  • 15
    Phala

    448 ₽
    Исходящие
  • 16
    Together

    448 ₽
    Исходящие
  • 17
    SiliconFlow

    417 ₽
    Исходящие
  • 18
    GMICloud

    448 ₽
    Исходящие
  • 19
    Decart

    407 ₽
    Исходящие
  • 20
    AkashML

    448 ₽
    Исходящие
  • 21
    Venice

    448 ₽
    Исходящие
  • 22
    DigitalOcean

    448 ₽
    Исходящие
  • 23
    WandB

    448 ₽
    Исходящие
  • 24
    Novita

    87 ₽
    Исходящие
  • 25
    Wafer

    1044 ₽
    Исходящие
  • 26
    StreamLake

    87 ₽
    Исходящие
  • 27
    Fireworks

    672 ₽
    Исходящие
  • 28
    BaseTen

    448 ₽
    Исходящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена
Чтение кеша
Повторное использование кэшированного контента снижает затраты благодаря применению пониженного тарифа на эти токены.
5,15 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Alibaba

    25 ₽
    Чтение кеша
  • 2
    Morph

    22 ₽
    Чтение кеша
  • 3
    Ionstream

    26 ₽
    Чтение кеша
  • 4
    Ambient

    20 ₽
    Чтение кеша
  • 5
    Chutes

    71 ₽
    Чтение кеша
  • 6
    Inceptron

    17 ₽
    Чтение кеша
  • 7
    Baidu

    5,30 ₽
    Чтение кеша
  • 8
    Z.AI

    26 ₽
    Чтение кеша
  • 9
    Friendli

    26 ₽
    Чтение кеша
  • 10
    Cloudflare

    26 ₽
    Чтение кеша
  • 11
    DeepInfra

    18 ₽
    Чтение кеша
  • 12
    AtlasCloud

    23 ₽
    Чтение кеша
  • 13
    Parasail

    26 ₽
    Чтение кеша
  • 14
    Io Net

    119 ₽
    Чтение кеша
  • 15
    Phala

    71 ₽
    Чтение кеша
  • 16
    Together

    26 ₽
    Чтение кеша
  • 17
    SiliconFlow

    26 ₽
    Чтение кеша
  • 18
    GMICloud

    26 ₽
    Чтение кеша
  • 19
    Decart

    20 ₽
    Чтение кеша
  • 20
    AkashML

    5,15 ₽
    Чтение кеша
  • 21
    Venice

    26 ₽
    Чтение кеша
  • 22
    DigitalOcean

    21 ₽
    Чтение кеша
  • 23
    WandB

    26 ₽
    Чтение кеша
  • 24
    Novita

    5,17 ₽
    Чтение кеша
  • 25
    Wafer

    50 ₽
    Чтение кеша
  • 26
    StreamLake

    5,15 ₽
    Чтение кеша
  • 27
    Fireworks

    21 ₽
    Чтение кеша
  • 28
    BaseTen

    26 ₽
    Чтение кеша

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена

Цены указаны в рублях и могут меняться в зависимости от курса валют

Описание модели

GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и подходит для долгосрочных рабочих процессов агентов, проектного уровня программной инженерии и сложной многоэтапной автоматизации.

Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и следовать стандартам последовательно на протяжении всего рабочего процесса разработки, от требований до много платформенного развертывания, в одной задаче.

API и примеры кода

Наш сервис предоставляет единый API, совместимый с OpenAI SDK. Просто укажите наш base_url и используйте ключ, полученный в личном кабинете.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://routerai.ru/api/v1"
)

response = client.chat.completions.create(
    model="z-ai/glm-5.2",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)
import requests
import json

url = "https://routerai.ru/api/v1/chat/completions"
headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}

data = {
    "model": "z-ai/glm-5.2",
    "messages": [
        {"role": "user", "content": "Hello, how are you?"}
    ]
}

response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-5.2",
    "messages": [
      {"role": "user", "content": "Hello, how are you?"}
    ]
  }'

Эндпоинты

Отправляет сообщения модели и получает ответ. Поддерживает потоковый и непотоковый режимы.

POST https://routerai.ru/api/v1/chat/completions
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
z-ai/glm-5.2

Создаёт ответ в формате OpenAI Responses API. Поддерживает потоковый и непотоковый режимы.

POST https://routerai.ru/api/v1/responses
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
z-ai/glm-5.2

Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).

POST https://routerai.ru/api/v1/messages
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
z-ai/glm-5.2

Параметры

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.