Qwen3-Max-Thinking — это флагманская модель рассуждения в серии Qwen3, разработанная для решения сложных когнитивных задач, требующих глубокого многоэтапного рассуждения. За счет значительного масштабирования возможностей модели и вычислений с подкреплением обучения он обеспечивает значительный выигрыш в фактической точности, комплексном рассуждении, следовании инструкциям, согласовании с человеческими предпочтениями и агентском поведении.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот85 ₽/M
Выводот428 ₽/M
Контекст262K
Релиз9 февр. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| Alibaba fp8 | лучший провайдер: 1polza | 88 ₽/M | 440 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Alibaba n/a | лучший провайдер: 1ru_openrouter | 85 ₽/M | 428 ₽/M | — | 5,5 % | 2,2 % |
| второй провайдер: 2routerai | 86 ₽/M | 428 ₽/M | — | |||
| третий провайдер: 3polza | 88 ₽/M | 440 ₽/M | — | |||
| VSellm n/a | лучший провайдер: 1VSellm | 55 ₽/M | 219 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ModelGate n/a | лучший провайдер: 1ModelGate | 86 ₽/M | 429 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 94 ₽/M | 467 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 98 ₽/M | 488 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 100 ₽/M | 501 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 103 ₽/M | 513 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 105 ₽/M | 526 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 145 ₽/M | 720 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AITUNNEL n/a | лучший провайдер: 1AITUNNEL | 156 ₽/M | 780 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Cloud.ru FM n/a | лучший провайдер: 1Cloud.ru FM | 205 ₽/M | 1 025 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| cloud-ru n/a | лучший провайдер: 1polza | 273 ₽/M | 1 366 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: qwen/qwen3-max-thinking-20260123.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-max-thinking-20260123",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Qwen
Все модели (65)Вводот169 ₽/M
Выводот506 ₽/M
Кэшот21 ₽/M
Вводот2,11 ₽/M
Выводот6,2 ₽/M
Кэшот0,21 ₽/M
Вводот31 ₽/M
Выводот153 ₽/M
Кэшот3 ₽/M
запуск0,61 ₽/запуск
Ввод (аудио)от823 ₽/M
Ввод (аудио)от365 ₽/M
Вводот220 ₽/M
Выводот659 ₽/M
Кэшот27 ₽/M
Ввод296 ₽/M
Вывод889 ₽/M
Кэш37 ₽/M
Вводот922 ₽/M
Выводот922 ₽/M
изображениеот6,07 ₽/шт
Вводот1 303 ₽/M
Выводот1 303 ₽/M
изображениеот8,1 ₽/шт
Вводот35 ₽/M
Выводот57 ₽/M
Кэшот4 ₽/M
Вводот3,12 ₽/M
Выводот15 ₽/M
Кэшот1,04 ₽/M