DeepSeek V4.1 Flash — это модель от DeepSeek, созданная с использованием редких специалистов, и первая модель, построенная на архитектуре причинного кодировщика-декодера (CED) компании. Он активирует 8B параметров на входе и 16B на выходе из магистральной сети с 552B параметрами, асимметричное разделение, которое обеспечивает низкий уровень вычислений на каждый токен по сравнению с общим размером модели. Понимание изображений заложено в архитектуре, при этом визуальные и текстовые встраивания обучаются совместно с самого начала предварительного обучения, а не добавляются позже, как в более ранней экспериментальной версии V4 Flash Vision ExpОткрывается в новой вкладке. Он подходит для программистов, агентов терминалов и компьютеров, а также для долгосрочных задач, которые должны выполняться до завершения на многих этапах, и для долгосрочного контекстного анализа. Кэширование со сжатием KV сокращает кэш-память примерно на четверть по сравнению с флэш-памятью предыдущего поколения, что значительно снижает затраты на агентные рабочие нагрузки. DeepSeek позиционирует его как экономичный уровень семейства V4.1 и сообщает, что он превосходит V4 Pro по производительности, скорости и времени выполнения задач.
Модальности
Вход: ТекстВход: Изображения
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот12 ₽/M
Выводот36 ₽/M
Кэшот0 ₽/M
Контекст1.0M
Релиз10 сент. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| DeepInfra fp8 | лучший провайдер: 1ru_openrouter | 12 ₽/M | 36 ₽/M | 0 ₽/M | 0,3 % | 16 % |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 14 ₽/M | 42 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 15 ₽/M | 44 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 15 ₽/M | 46 ₽/M | 0,46 ₽/M | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.
Индекс интеллектаНиже среднего
39.5%Общая интеллектуальная производительностьБыстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: deepseek/deepseek-v4.1-flash-20260910.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-v4.1-flash-20260910",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Deepseek
Все модели (19)Вводот2,03 ₽/M
Выводот8,08 ₽/M
Кэшот0,2 ₽/M
Вводот24 ₽/M
Выводот71 ₽/M
Кэшот1,04 ₽/M
Ввод16 ₽/M
Вывод49 ₽/M
Кэш0,52 ₽/M
Вводот20 ₽/M
Выводот58 ₽/M
Кэшот0,66 ₽/M
Ввод99 ₽/M
Вывод296 ₽/M
Кэш3,28 ₽/M
Вводот2,05 ₽/M
Выводот6,14 ₽/M
Кэшот0,21 ₽/M
Ввод16 ₽/M
Вывод49 ₽/M
Кэш0,52 ₽/M
Вводот39 ₽/M
Выводот76 ₽/M
Кэшот3,12 ₽/M
Вводот5,2 ₽/M
Выводот10 ₽/M
Кэшот1,04 ₽/M
Вводот23 ₽/M
Выводот34 ₽/M
Кэшот2,08 ₽/M
Вводот29 ₽/M
Выводот45 ₽/M
Кэшот29 ₽/M
Вводот30 ₽/M
Выводот107 ₽/M
Кэшот15 ₽/M