Z.ai: GLM 4.7 Flash

Name: Z AI Z.ai: GLM 4.7 Flash API
Brand: RouterAI
Price: 0.01 RUB
Availability: InStock

Идентификатор:

Чат

Характеристики

Контекстное окно 203K

Дата релиза 19 января 2026

Мультимодальность

Входящие данные:

Текст

Исходящие данные:

Текст

Цены

Оплата производится по факту за использованные токены.

Тип

Стоимость

Входящие токены

5,92 ₽ / 1M токенов

Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

1

Cloudflare

5,97 ₽

Входящие
2

Novita

6 ₽

Входящие
3

DeepInfra

5,92 ₽

Входящие
4

Venice

12 ₽

Входящие

Умная маршрутизация запросов

Ваши запросы автоматически направляются к провайдеру с самой низкой ценой. Если провайдер недоступен, система мгновенно переключается на следующего по цене, обеспечивая непрерывную работу вашего приложения без потери запросов.

Автоматический выбор
Отказоустойчивость
Лучшая цена

Исходящие токены

39 ₽ / 1M токенов

Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

1

Cloudflare

39 ₽

Исходящие
2

Novita

39 ₽

Исходящие
3

DeepInfra

39 ₽

Исходящие
4

Venice

49 ₽

Исходящие

Умная маршрутизация запросов

Автоматический выбор
Отказоустойчивость
Лучшая цена

Чтение кеша

0,99 ₽ / 1M токенов

Подробнее

Цены по провайдерам

RouterAI работает с несколькими провайдерами для обеспечения максимальной доступности и оптимальных цен.

1

Cloudflare

0,99 ₽

Чтение кеша
2

Novita

0,99 ₽

Чтение кеша
3

DeepInfra

0,99 ₽

Чтение кеша
4

Venice

0,99 ₽

Чтение кеша

Умная маршрутизация запросов

Автоматический выбор
Отказоустойчивость
Лучшая цена

Цены указаны в рублях и могут меняться в зависимости от курса валют

Описание модели

Как модель класса 30B SOTA, GLM-4.7-Flash предлагает новый вариант, который балансирует между производительностью и эффективностью. Она дополнительно оптимизирована для агентного кодирования, укрепляя возможности кодирования, планирования задач на длительный срок и сотрудничества с инструментами, и достигла ведущих результатов среди моделей с открытым исходным кодом того же размера на нескольких актуальных публичных рейтингах.

API и примеры кода

Наш сервис предоставляет единый API, совместимый с OpenAI SDK. Просто укажите наш base_url и используйте ключ, полученный в личном кабинете.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://routerai.ru/api/v1"
)

response = client.chat.completions.create(
    model="z-ai/glm-4.7-flash",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)

import requests
import json

url = "https://routerai.ru/api/v1/chat/completions"
headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}

data = {
    "model": "z-ai/glm-4.7-flash",
    "messages": [
        {"role": "user", "content": "Hello, how are you?"}
    ]
}

response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result, indent=2))

curl -X POST "https://routerai.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-4.7-flash",
    "messages": [
      {"role": "user", "content": "Hello, how are you?"}
    ]
  }'

Эндпоинты

Отправляет сообщения модели и получает ответ. Поддерживает потоковый и непотоковый режимы.

POST https://routerai.ru/api/v1/chat/completions

Документация

Authorization

Bearer YOUR_API_KEY

Content-Type

application/json

Model

z-ai/glm-4.7-flash

Создаёт ответ в формате OpenAI Responses API. Поддерживает потоковый и непотоковый режимы.

POST https://routerai.ru/api/v1/responses

Документация

Authorization

Bearer YOUR_API_KEY

Content-Type

application/json

Model

z-ai/glm-4.7-flash

Создаёт сообщение в формате Anthropic Messages API. Поддерживает текст, изображения, инструменты и размышления (thinking).

POST https://routerai.ru/api/v1/messages

Документация

Authorization

Bearer YOUR_API_KEY

Content-Type

application/json

Model

z-ai/glm-4.7-flash

Параметры

Параметр

Тип

По умолчанию

Описание

max_tokens

integer

—

Верхний предел количества токенов, которые модель может сгенерировать в ответе.

temperature

float

Влияет на разнообразие ответов модели: чем выше, тем более случайным будет вывод.

top_p

float

Ограничивает выбор модели долей наиболее вероятных токенов: учитываются только токены, чьи вероятности в сумме дают P.

seed

integer

—

Если задан, инференс выполняется детерминированно — повторные запросы с тем же seed и параметрами должны давать одинаковый результат.

logprobs

boolean

—

Возвращать ли логарифмы вероятностей выходных токенов.

top_logprobs

integer

—

Число от 0 до 20: сколько наиболее вероятных токенов возвращать на каждой позиции, каждый с логарифмом вероятности.

response_format

map

—

Заставляет модель выдавать ответ в определённом формате.

stop

array

—

Немедленно останавливает генерацию, если модель встречает любой из токенов, указанных в массиве stop.

frequency_penalty

float

Управляет повторением токенов в зависимости от того, как часто они встречаются во входных данных.

presence_penalty

float

Регулирует, насколько часто модель повторяет токены, уже встречавшиеся во входных данных.

repetition_penalty

float

—

Снижает вероятность повторения токенов из входных данных, пропорционально тому, как часто они встречаются.

top_k

integer

—

Ограничивает выбор модели K наиболее вероятными токенами на каждом шаге.

min_p

float

—

Минимальная вероятность токена относительно вероятности самого вероятного токена, чтобы он был рассмотрен.

logit_bias

map

—

Изменяет вероятность появления указанных токенов в ответе.

structured_outputs

boolean

—

Поддержка ответа по строгой JSON-схеме.

tool_choice

map

—

Управляет тем, какую функцию (инструмент) вызовет модель, если они переданы.

tools

array

—

Список инструментов (функций), которые модель может вызвать.

reasoning

map

—

Настройки рассуждений модели (бюджет токенов, уровень усилий).

include_reasoning

boolean

—

Возвращать ли в ответе цепочку рассуждений модели.

Вернуться к списку моделей

Z.ai: GLM 4.7 Flash

Характеристики

Мультимодальность

Входящие данные:

Исходящие данные:

Цены

Цены по провайдерам

Cloudflare

Novita

DeepInfra

Venice

Умная маршрутизация запросов

Цены по провайдерам

Cloudflare

Novita

DeepInfra

Venice

Умная маршрутизация запросов

Цены по провайдерам

Cloudflare

Novita

DeepInfra

Venice

Умная маршрутизация запросов

Описание модели

API и примеры кода

Эндпоинты

Параметры