Ling-3.0-flash — это модель Mixture-of-Experts (MoE) со 124 миллиардами параметров, в которой на каждый токен активируется примерно 5,1 миллиарда параметров. Модель разработана с учетом эффективности токенов и агентского вывода в производственном масштабе в качестве ключевых приоритетов, что позволяет разработчикам выполнять более полезную работу в рамках ограниченных бюджетов токенов, задержек и затрат на обслуживание.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот2,08 ₽/M
Выводот7,29 ₽/M
Кэшот0 ₽/M
Контекст262K
Релиз23 июл. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| DeepInfra bf16 | лучший провайдер: 1ru_openrouter | 6,25 ₽/M | 20 ₽/M | 1,04 ₽/M | 0 % | — |
| второй провайдер: 2routerai | 6,58 ₽/M | 20 ₽/M | 1,32 ₽/M | |||
| — | — | — | ||||
| Novita n/a | лучший провайдер: 1routerai | 2,3 ₽/M | 6,91 ₽/M | 0,46 ₽/M | 2,4 % | — |
| второй провайдер: 2ru_openrouter | 2,08 ₽/M | 7,29 ₽/M | 0 ₽/M | |||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 2,63 ₽/M | 7,88 ₽/M | 0,53 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 2,7 ₽/M | 8,12 ₽/M | 0,54 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 3 ₽/M | 8 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 2,84 ₽/M | 8,5 ₽/M | 0,57 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 11 ₽/M | 34 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.
ПрограммированиеСредний
50.6%Способность решать задачи программированияБыстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: inclusionai/ling-3.0-flash-20260723.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "inclusionai/ling-3.0-flash-20260723",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.