Загрузка...

GLM Latest

Разработчик: Z AI
Идентификатор:
Скопировано!
Это алиас: сейчас указывает на z-ai/glm-5.3 . При выходе новой версии указатель переедет на неё, а идентификатор останется прежним.
Чат

Характеристики GLM Latest

Контекстное окно 1M

Дата релиза 18 августа 2026

Мультимодальность

Входящие данные:

  • Текст

Исходящие данные:

  • Текст

Цены GLM Latest в рублях

Оплата производится по факту за использованные токены.

Тип
Стоимость
Входящие токены
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
84 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Z.AI
    153 ₽
    Входящие
  • 2
    Inceptron
    85 ₽
    Входящие
  • 3
    Venice
    153 ₽
    Входящие
  • 4
    InferenceNet
    98 ₽
    Входящие
  • 5
    AkashML
    142 ₽
    Входящие
  • 6
    Baidu
    153 ₽
    Входящие
  • 7
    AtlasCloud
    153 ₽
    Входящие
  • 8
    Morph
    84 ₽
    Входящие
  • 9
    Together
    153 ₽
    Входящие
  • 10
    Parasail
    153 ₽
    Входящие
  • 11
    Novita
    94 ₽
    Входящие
  • 12
    Crusoe
    153 ₽
    Входящие
  • 13
    Sail Research
    112 ₽
    Входящие
  • 14
    Makora
    114 ₽
    Входящие
  • 15
    Friendli
    137 ₽
    Входящие
  • 16
    Mistral
    153 ₽
    Входящие
  • 17
    DigitalOcean
    99 ₽
    Входящие
  • 18
    BaseTen
    153 ₽
    Входящие
  • 19
    Wafer
    153 ₽
    Входящие
  • 20
    Alibaba
    130 ₽
    Входящие
  • 21
    GMICloud
    114 ₽
    Входящие
  • 22
    Phala
    99 ₽
    Входящие
  • 23
    SiliconFlow
    122 ₽
    Входящие
  • 24
    Reka
    85 ₽
    Входящие
  • 25
    DeepInfra
    98 ₽
    Входящие
  • 26
    Fireworks
    153 ₽
    Входящие
  • 27
    Modal
    153 ₽
    Входящие
  • 28
    Cloudflare
    153 ₽
    Входящие
  • 29
    Decart
    130 ₽
    Входящие
  • 30
    Io Net
    85 ₽
    Входящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена
Исходящие токены
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
266 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Z.AI
    481 ₽
    Исходящие
  • 2
    Inceptron
    319 ₽
    Исходящие
  • 3
    Venice
    481 ₽
    Исходящие
  • 4
    InferenceNet
    328 ₽
    Исходящие
  • 5
    AkashML
    481 ₽
    Исходящие
  • 6
    Baidu
    481 ₽
    Исходящие
  • 7
    AtlasCloud
    481 ₽
    Исходящие
  • 8
    Morph
    266 ₽
    Исходящие
  • 9
    Together
    481 ₽
    Исходящие
  • 10
    Parasail
    481 ₽
    Исходящие
  • 11
    Novita
    298 ₽
    Исходящие
  • 12
    Crusoe
    481 ₽
    Исходящие
  • 13
    Sail Research
    360 ₽
    Исходящие
  • 14
    Makora
    459 ₽
    Исходящие
  • 15
    Friendli
    433 ₽
    Исходящие
  • 16
    Mistral
    481 ₽
    Исходящие
  • 17
    DigitalOcean
    313 ₽
    Исходящие
  • 18
    BaseTen
    481 ₽
    Исходящие
  • 19
    Wafer
    481 ₽
    Исходящие
  • 20
    Alibaba
    409 ₽
    Исходящие
  • 21
    GMICloud
    361 ₽
    Исходящие
  • 22
    Phala
    313 ₽
    Исходящие
  • 23
    SiliconFlow
    385 ₽
    Исходящие
  • 24
    Reka
    290 ₽
    Исходящие
  • 25
    DeepInfra
    328 ₽
    Исходящие
  • 26
    Fireworks
    481 ₽
    Исходящие
  • 27
    Modal
    481 ₽
    Исходящие
  • 28
    Cloudflare
    481 ₽
    Исходящие
  • 29
    Decart
    409 ₽
    Исходящие
  • 30
    Io Net
    288 ₽
    Исходящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена
Чтение кеша
Повторное использование кэшированного контента снижает затраты благодаря применению пониженного тарифа на эти токены.
13 ₽ / 1M токенов
Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

  • 1
    Z.AI
    28 ₽
    Чтение кеша
  • 2
    Inceptron
    15 ₽
    Чтение кеша
  • 3
    Venice
    28 ₽
    Чтение кеша
  • 4
    InferenceNet
    16 ₽
    Чтение кеша
  • 5
    AkashML
    28 ₽
    Чтение кеша
  • 6
    Baidu
    28 ₽
    Чтение кеша
  • 7
    AtlasCloud
    28 ₽
    Чтение кеша
  • 8
    Morph
    13 ₽
    Чтение кеша
  • 9
    Together
    28 ₽
    Чтение кеша
  • 10
    Parasail
    28 ₽
    Чтение кеша
  • 11
    Novita
    17 ₽
    Чтение кеша
  • 12
    Crusoe
    28 ₽
    Чтение кеша
  • 13
    Sail Research
    20 ₽
    Чтение кеша
  • 14
    Makora
    20 ₽
    Чтение кеша
  • 15
    Friendli
    25 ₽
    Чтение кеша
  • 16
    Mistral
    15 ₽
    Чтение кеша
  • 17
    DigitalOcean
    18 ₽
    Чтение кеша
  • 18
    BaseTen
    15 ₽
    Чтение кеша
  • 19
    Wafer
    28 ₽
    Чтение кеша
  • 20
    Alibaba
    26 ₽
    Чтение кеша
  • 21
    GMICloud
    21 ₽
    Чтение кеша
  • 22
    Phala
    18 ₽
    Чтение кеша
  • 23
    SiliconFlow
    22 ₽
    Чтение кеша
  • 24
    Reka
    17 ₽
    Чтение кеша
  • 25
    DeepInfra
    16 ₽
    Чтение кеша
  • 26
    Fireworks
    28 ₽
    Чтение кеша
  • 27
    Modal
    28 ₽
    Чтение кеша
  • 28
    Cloudflare
    28 ₽
    Чтение кеша
  • 29
    Decart
    21 ₽
    Чтение кеша
  • 30
    Io Net
    17 ₽
    Чтение кеша

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

  • Автоматический выбор
  • Отказоустойчивость
  • Лучшая цена

Цены указаны в рублях и могут меняться в зависимости от курса валют

Что умеет GLM Latest

GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для сложных задач в области программной инженерии и задач агентов с длительным горизонтом. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и улучшает GLM-5.2 в кодировании и в балансе между производительностью и эффективностью использования токенов.

Режим рассуждений всегда включен и не может быть отключен. Поддерживаются усилия рассуждений low, high и max; по умолчанию используется max.

API GLM Latest: подключение и примеры кода

Наш сервис предоставляет единый API, совместимый с OpenAI SDK. Просто укажите наш base_url и используйте ключ, полученный в личном кабинете.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://routerai.ru/api/v1"
)

response = client.chat.completions.create(
    model="~z-ai/glm-latest",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)
import requests
import json

url = "https://routerai.ru/api/v1/chat/completions"
headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}

data = {
    "model": "~z-ai/glm-latest",
    "messages": [
        {"role": "user", "content": "Hello, how are you?"}
    ]
}

response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))
curl -X POST "https://routerai.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "~z-ai/glm-latest",
    "messages": [
      {"role": "user", "content": "Hello, how are you?"}
    ]
  }'

Эндпоинты API

Chat Completions

Основной эндпоинт: принимает историю сообщений и возвращает ответ модели. Поддерживает потоковый (SSE) и обычный режимы.

POST https://routerai.ru/api/v1/chat/completions
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
z-ai/glm-5.3

Поддерживаемые параметры запроса

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.

Responses API

Создаёт ответ в формате OpenAI Responses API — для агентных сценариев и работы с инструментами. Поддерживает потоковый и обычный режимы.

POST https://routerai.ru/api/v1/responses
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
z-ai/glm-5.3

Поддерживаемые параметры запроса

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.

Messages API

Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).

POST https://routerai.ru/api/v1/messages
Документация
Authorization
Bearer YOUR_API_KEY
Content-Type
application/json
Model
z-ai/glm-5.3

Поддерживаемые параметры запроса

Параметр
Тип
По умолчанию
Описание
max_tokens
integer
Верхний предел количества токенов, которые модель может сгенерировать в ответе.
temperature
float
1
Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.
top_p
float
1
Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.
seed
integer
Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.
logprobs
boolean
Возвращать ли логарифмы вероятностей выходных токенов.
top_logprobs
integer
Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.
response_format
map
Заставляет модель выдавать ответ в определённом формате.
stop
array
Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.
frequency_penalty
float
0
Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.
presence_penalty
float
0
Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.
repetition_penalty
float
Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.
top_k
integer
Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.
min_p
float
Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.
logit_bias
map
Изменяет вероятность появления указанных токенов в ответе.
structured_outputs
boolean
Поддержка ответа по строгой JSON-схеме.
tool_choice
map
Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.
tools
array
Список инструментов (функций), которые модель может вызвать.
reasoning
map
Настройки рассуждений модели (бюджет токенов, уровень усилий).
include_reasoning
boolean
Возвращать ли в ответе цепочку рассуждений модели.