Qwen3-8B — это плотная причинно-языковая модель с 8,2 млрд параметров из серии Qwen3, предназначенная как для сложных рассуждений, так и для эффективного диалога. Он поддерживает плавное переключение между режимом «думания» для математики, кодирования и логических выводов и режимом «недумания» для общего разговора. Модель идеально настроена для выполнения инструкций, интеграции агентов, творческого письма и многоязычного использования на более чем 100 языках и диалектах. Он изначально поддерживает окно контекста токена 32 000 и может расширяться до 131 000 токенов с масштабированием YaRN.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот22 ₽/M
Выводот22 ₽/M
Кэшот11 ₽/M
Контекст131K
Релиз28 апр. 2025 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| AtlasCloud fp8 | лучший провайдер: 1polza | 5,54 ₽/M | 44 ₽/M | 5,54 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Alibaba fp8 | лучший провайдер: 1polza | 13 ₽/M | 50 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 14 ₽/M | 56 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 15 ₽/M | 57 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 15 ₽/M | 59 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Fireworks n/a | лучший провайдер: 1polza | 22 ₽/M | 22 ₽/M | 11 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Alibaba n/a | лучший провайдер: 1routerai | 13 ₽/M | 49 ₽/M | — | 5,8 % | — |
| второй провайдер: 2ru_openrouter | 12 ₽/M | 50 ₽/M | — | |||
| третий провайдер: 3polza | 13 ₽/M | 50 ₽/M | — | |||
| bothub n/a | лучший провайдер: 1bothub | 16 ₽/M | 61 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 16 ₽/M | 62 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| GPUniq n/a | лучший провайдер: 1GPUniq | 17 ₽/M | 66 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 23 ₽/M | 90 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| GPTunneL n/a | лучший провайдер: 1GPTunneL | 36 ₽/M | 140 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.
Агентные задачиНиже среднего
0.8%Многошаговые агентные сценарииПрограммированиеНиже среднего
9.0%Способность решать задачи программированияБыстрый старт
Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: qwen/qwen3-8b-04-28.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-8b-04-28",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Qwen
Все модели (67)Вводот439 ₽/M
Выводот1 318 ₽/M
Кэшот55 ₽/M
Вводот17 ₽/M
Выводот52 ₽/M
Кэшот1,77 ₽/M
Вводот167 ₽/M
Выводот501 ₽/M
Кэшот21 ₽/M
Вводот2,11 ₽/M
Выводот6,2 ₽/M
Кэшот0,21 ₽/M
Вводот31 ₽/M
Выводот153 ₽/M
Кэшот3 ₽/M
запускот0,61 ₽/запуск
Ввод (аудио)от823 ₽/M
Ввод (аудио)от365 ₽/M
Вводот220 ₽/M
Выводот659 ₽/M
Кэшот27 ₽/M
Ввод296 ₽/M
Вывод889 ₽/M
Кэш37 ₽/M
Вводот922 ₽/M
Выводот922 ₽/M
изображениеот6,08 ₽/шт
Вводот1 303 ₽/M
Выводот1 303 ₽/M
изображениеот8,1 ₽/шт