Qwen3-VL-8B-Thinking — это оптимизированный для рассуждений вариант мультимодальной модели Qwen3-VL-8B, предназначенный для расширенных визуальных и текстовых рассуждений в сложных сценах, документах и временных последовательностях. Он объединяет расширенное мультимодальное выравнивание и обработку длинного контекста (собственные 256 КБ, с возможностью расширения до 1 миллион токенов) для таких задач, как научный визуальный анализ, причинно-следственные выводы и математические рассуждения над входными изображениями или видео. По сравнению с версией Instruct, версия Thinking обеспечивает более глубокое слияние визуального языка и продуманные пути рассуждения, которые повышают производительность при выполнении логических задач с длинной цепочкой, решении STEM-задач и многоэтапном понимании видео. Он обеспечивает более сильную временную привязку с помощью Interleaved-MRoPE и встраивания с учетом временных меток, сохраняя при этом надежное распознавание текста, многоязычное понимание и генерацию текста на уровне больших текстовых LLM.
Модальности
Вход: ИзображенияВход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот20 ₽/M
Выводот231 ₽/M
Контекст131K
Релиз14 окт. 2025 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|
| Alibaba fp8 | лучший провайдер: 1polza | 20 ₽/M | 234 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| Alibaba n/a | лучший провайдер: 1routerai | 20 ₽/M | 228 ₽/M | 0 % | 6,5 % |
| второй провайдер: 2ru_openrouter | 20 ₽/M | 231 ₽/M | |||
| третий провайдер: 3polza | 20 ₽/M | 234 ₽/M | |||
| GPUniq n/a | лучший провайдер: 1GPUniq | 17 ₽/M | 86 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| VSellm n/a | лучший провайдер: 1VSellm | 11 ₽/M | 110 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 22 ₽/M | 252 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 22 ₽/M | 260 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 23 ₽/M | 271 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 24 ₽/M | 280 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 24 ₽/M | 284 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| Cloud.ru FM n/a | лучший провайдер: 1Cloud.ru FM | 31 ₽/M | 359 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 35 ₽/M | 406 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| cloud-ru n/a | лучший провайдер: 1polza | 41 ₽/M | 478 ₽/M | — | — |
| — | — | ||||
| — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: qwen/qwen3-vl-8b-thinking.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-vl-8b-thinking",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Qwen
Все модели (67)Вводот439 ₽/M
Выводот1 318 ₽/M
Кэшот55 ₽/M
Вводот0,76 ₽/M
Выводот2,37 ₽/M
Кэшот0,08 ₽/M
Вводот167 ₽/M
Выводот501 ₽/M
Кэшот21 ₽/M
Вводот2,11 ₽/M
Выводот6,2 ₽/M
Кэшот0,21 ₽/M
Вводот31 ₽/M
Выводот153 ₽/M
Кэшот3 ₽/M
запускот0,6 ₽/запуск
Ввод (аудио)от823 ₽/M
Ввод (аудио)от365 ₽/M
Вводот220 ₽/M
Выводот659 ₽/M
Кэшот27 ₽/M
Ввод296 ₽/M
Вывод889 ₽/M
Кэш37 ₽/M
Вводот922 ₽/M
Выводот922 ₽/M
изображениеот5,99 ₽/шт
Вводот1 303 ₽/M
Выводот1 303 ₽/M
изображениеот7,99 ₽/шт