Серия моделей Qwen3 Embedding — это новейшая запатентованная модель семейства Qwen, специально разработанная для задач встраивания текста и ранжирования. Эта серия унаследовала исключительные многоязычные возможности, понимание длинных текстов и навыки рассуждения своей базовой модели. Серия Qwen3 Embedding представляет собой значительные достижения в решении множества задач по встраиванию и ранжированию текста, включая извлечение текста, извлечение кода, классификацию текста, кластеризацию текста и интеллектуальный анализ битового текста.
Модальности
Вход: Текст
Выход: Эмбеддинги
Цена (ввод)за 1M токенов ввода
Эмбеддингот1,04 ₽/M
Контекст33K
Релиз28 окт. 2025 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| SiliconFlow fp8 | лучший провайдер: 1ru_openrouter | 4,16 ₽/M | — | — | — | — |
| второй провайдер: 2routerai | 4,39 ₽/M | — | — | |||
| третий провайдер: 3polza | 4,5 ₽/M | — | — | |||
| deepinfra/us n/a | лучший провайдер: 1ru_openrouter | 1,04 ₽/M | — | — | — | — |
| второй провайдер: 2polza | 1,12 ₽/M | — | — | |||
| — | — | — | ||||
| VSellm n/a | лучший провайдер: 1VSellm | 1 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 1,25 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 1,35 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Nebius n/a | лучший провайдер: 1ru_openrouter | 1,04 ₽/M | — | — | — | — |
| второй провайдер: 2routerai | 1,1 ₽/M | — | — | |||
| третий провайдер: 3polza | 1,12 ₽/M | — | — | |||
| DeepInfra n/a | лучший провайдер: 1routerai | 1,1 ₽/M | — | — | — | — |
| второй провайдер: 2polza | 1,12 ₽/M | — | — | |||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 2 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 1,3 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 1,35 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AITUNNEL n/a | лучший провайдер: 1AITUNNEL | 2 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ModelGate n/a | лучший провайдер: 1ModelGate | 5,5 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| VseGPT n/a | лучший провайдер: 1VseGPT | 9 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| PlusVibe API n/a | лучший провайдер: 1PlusVibe API | 5 ₽/M | — | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: qwen/qwen3-embedding-8b.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-embedding-8b",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Qwen
Все модели (65)Вводот169 ₽/M
Выводот507 ₽/M
Кэшот21 ₽/M
Вводот2,11 ₽/M
Выводот6,2 ₽/M
Кэшот0,21 ₽/M
Вводот31 ₽/M
Выводот153 ₽/M
Кэшот3 ₽/M
запуск0,61 ₽/запуск
Ввод (аудио)от823 ₽/M
Ввод (аудио)от365 ₽/M
Вводот220 ₽/M
Выводот659 ₽/M
Кэшот27 ₽/M
Ввод296 ₽/M
Вывод889 ₽/M
Кэш37 ₽/M
Вводот922 ₽/M
Выводот922 ₽/M
изображениеот6,08 ₽/шт
Вводот1 303 ₽/M
Выводот1 303 ₽/M
изображениеот8,1 ₽/шт
Вводот35 ₽/M
Выводот57 ₽/M
Кэшот4 ₽/M
Вводот3,12 ₽/M
Выводот15 ₽/M
Кэшот1,04 ₽/M