Qwen3 Embedding 8B
- Разработчик:
- Qwen
- Релиз:
- Идентификатор:
-
qwen/qwen3-embedding-8b
Цены Qwen3 Embedding 8B в рублях — от 1,11 ₽ за 1 млн токенов
Доступно
3
провайдера,
цены от
1,11 ₽
до
4,44 ₽
за 1 млн токенов.
Провайдер подбирается автоматически — по доступности, затем по цене.
| Тип операции | Стоимость |
|---|---|
|
Вход
За 1 млн токенов
Токены, полученные и обработанные моделью при анализе пользовательского запроса и контекста. Включают текст сообщения, предыдущую историю диалога и все передаваемые данные.
|
1,11 ₽ |
|
Выход
За 1 млн токенов
Токены, генерируемые моделью в виде ответа пользователю. Каждый символ, слово или часть ответа, созданные моделью, включаются в подсчёт выходных токенов.
|
0 ₽ |
|
Кэш: чтение
не поддерживается
|
— |
|
Кэш: запись
не поддерживается
|
— |
Возможности Qwen3 Embedding 8B
Серия моделей Qwen3 Embedding — это последняя собственная модель семейства Qwen, специально разработанная для задач текстового встраивания и ранжирования. Эта серия наследует исключительные многоязычные возможности, понимание длинных текстов и навыки рассуждения своей базовой модели. Серия Qwen3 Embedding представляет собой значительные достижения в различных задачах текстового встраивания и ранжирования, включая поиск текста, поиск кода, классификацию текста, кластеризацию текста и двуязычный майнинг.
Характеристики Qwen3 Embedding 8B
Контекстное окно
- Всего
- 33K токенов
- На выход
- 32K токенов
Модальности
- Вход
- Текст
- Выход
- Embeddings
Провайдеры Qwen3 Embedding 8B
Модель развёрнута у
3
провайдеров:
вход 1,11–4,44 ₽
за 1 млн токенов.
Порядок выбора по умолчанию:
сначала провайдеры без сбоев, среди них — самый дешёвый, остальные подстраховывают.
| Провайдер | Вход | Контекст |
|---|---|---|
|
|
1,11 ₽ | 33K |
|
|
1,11 ₽ | 32K |
|
|
4,44 ₽ | 33K |
Цены считаются по провайдеру, который фактически обработал запрос. Порядок в таблице — по возрастанию цены. Прочерк — провайдер не поддерживает операцию. Флаг — страна серверов или штаб-квартиры провайдера (на мобильном нажмите на первый столбец, на большом экране — на строку).
API Qwen3 Embedding 8B:
подключение и примеры кода
API RouterAI совместим с OpenAI SDK: в существующем коде достаточно заменить
base_url
и ключ, идентификатор модели передаётся в поле
model.
Один ключ открывает доступ ко всем моделям каталога, лимиты и расход — в личном кабинете.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://routerai.ru/api/v1"
)
response = client.embeddings.create(
model="qwen/qwen3-embedding-8b",
input="Your text to embed goes here",
encoding_format="float"
)
print(response.data[0].embedding)
import requests
import json
url = "https://routerai.ru/api/v1/embeddings"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "qwen/qwen3-embedding-8b",
"input": "Your text to embed goes here",
"encoding_format": "float"
}
response = requests.post(url, headers=headers, json=data)
result = response.json()
print(json.dumps(result))
curl -X POST "https://routerai.ru/api/v1/embeddings" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-embedding-8b",
"input": "Your text to embed goes here",
"encoding_format": "float"
}'
Эндпоинт API для Qwen3 Embedding 8B
Схемы запроса и ответа повторяют OpenAI — существующие клиенты и SDK работают без изменений.
Embeddings
Преобразует текст в числовые векторы (эмбеддинги) фиксированной длины.
- Authorization
- Bearer YOUR_API_KEY
- Content-Type
- application/json
- Model
- qwen/qwen3-embedding-8b
Частые вопросы о Qwen3 Embedding 8B
-
Работает ли Qwen3 Embedding 8B из России без VPN?
Да. Прямой доступ через веб-чат и API RouterAI — без VPN, прокси и зарубежных карт, оплата в рублях.
-
Сколько стоит Qwen3 Embedding 8B?
Вход — 1,11 ₽ за 1 млн токенов, выход — 0 ₽ за 1 млн токенов. Списывается только фактическое использование, без подписки.
-
Какой контекст у Qwen3 Embedding 8B?
Контекстное окно — 33K токенов на запрос, длина ответа — до 32K токенов.
-
Что с данными в запросах к Qwen3 Embedding 8B?
Содержимое запросов RouterAI передаёт только провайдеру модели для обработки и не использует для обучения моделей. Email, телефон и платёжные данные провайдерам не передаются, учётные данные хранятся на серверах в России. Политика конфиденциальности
-
Чем RouterAI отличается от сервиса Qwen?
Один ключ и единый баланс в рублях для всех моделей каталога, API в формате OpenAI, а при сбое провайдера запрос автоматически уходит к одному из 3 остальных.
Попробуйте Qwen3 Embedding 8B
В чате или по API — доступ из России за пару минут, оплата в рублях.