GLM-5.3-FlashX — это высокоскоростной вариант GLM-5.3-Flash от Z.ai, собственной мультимодальной модели, обеспечивающей скорость вывода до 200 токенов/с. Построенный на той же гибридной разреженной и линейной архитектуре внимания (320B общих параметров, 18B активных), он подходит для эффективного кодирования, визуального понимания и задач агента с большим горизонтом с контекстным окном размером 1M токенов.
Модальности
Вход: ТекстВход: ИзображенияВход: Видео
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот4,56 ₽/M
Выводот15 ₽/M
Кэшот0,96 ₽/M
Контекст1.0M
Релиз18 сент. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| Z.AI fp8 | лучший провайдер: 1ru_openrouter | 41 ₽/M | 137 ₽/M | 9,37 ₽/M | 2,1 % | — |
| второй провайдер: 2polza | 42 ₽/M | 141 ₽/M | 10 ₽/M | |||
| третий провайдер: 3routerai | 45 ₽/M | 151 ₽/M | 11 ₽/M | |||
| PlusVibe API n/a | лучший провайдер: 1PlusVibe API | 4,56 ₽/M | 15 ₽/M | 0,96 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| provod n/a | лучший провайдер: 1provod | 31 ₽/M | 106 ₽/M | 6,33 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| VSellm n/a | лучший провайдер: 1VSellm | 41 ₽/M | 138 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 46 ₽/M | 156 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 46 ₽/M | 156 ₽/M | 11 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 48 ₽/M | 160 ₽/M | 9,63 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 49 ₽/M | 164 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 50 ₽/M | 169 ₽/M | 12 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 68 ₽/M | 230 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AITUNNEL n/a | лучший провайдер: 1AITUNNEL | 74 ₽/M | 250 ₽/M | 15 ₽/M | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: z-ai/glm-5.3-flashx-20260918.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "z-ai/glm-5.3-flashx-20260918",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Z.ai
Все модели (18)Вводот5,2 ₽/M
Выводот16 ₽/M
Кэшот1,04 ₽/M
Вводот6,25 ₽/M
Выводот22 ₽/M
Кэшот1,04 ₽/M
Вводот6,21 ₽/M
Выводот20 ₽/M
Кэшот0,62 ₽/M
Вводот49 ₽/M
Выводот220 ₽/M
Кэшот11 ₽/M
Вводот2,42 ₽/M
Выводот8,5 ₽/M
Кэшот0,62 ₽/M
Ввод104 ₽/M
Вывод328 ₽/M
Кэш10 ₽/M
Вводот37 ₽/M
Выводот123 ₽/M
Кэшот9 ₽/M
Вводот101 ₽/M
Выводот338 ₽/M
Кэшот20 ₽/M
Вводот101 ₽/M
Выводот338 ₽/M
Кэшот20 ₽/M
Вводот66 ₽/M
Выводот211 ₽/M
Кэшот14 ₽/M
Вводот6,25 ₽/M
Выводот44 ₽/M
Кэшот1,14 ₽/M
Вводот44 ₽/M
Выводот193 ₽/M
Кэшот8,33 ₽/M