Deepseek

DeepSeek: DeepSeek V4.1 Flash (batch)

deepseek/deepseek-v4.1-flash-20260910

DeepSeek V4.1 Flash — это модель от DeepSeek, созданная с использованием редких специалистов, и первая модель, построенная на архитектуре причинного кодировщика-декодера (CED) компании. Он активирует 8B параметров на входе и 16B на выходе из магистральной сети с 552B параметрами, асимметричное разделение, которое обеспечивает низкий уровень вычислений на каждый токен по сравнению с общим размером модели. Понимание изображений заложено в архитектуре, при этом визуальные и текстовые встраивания обучаются совместно с самого начала предварительного обучения, а не добавляются позже, как в более ранней экспериментальной версии V4 Flash Vision ExpОткрывается в новой вкладке. Он подходит для программистов, агентов терминалов и компьютеров, а также для долгосрочных задач, которые должны выполняться до завершения на многих этапах, и для долгосрочного контекстного анализа. Кэширование со сжатием KV сокращает кэш-память примерно на четверть по сравнению с флэш-памятью предыдущего поколения, что значительно снижает затраты на агентные рабочие нагрузки. DeepSeek позиционирует его как экономичный уровень семейства V4.1 и сообщает, что он превосходит V4 Pro по производительности, скорости и времени выполнения задач.

Модальности
Вход: ТекстВход: Изображения
Выход: Текст
Цена ввод / вывод
Вводот12 ₽/M
Выводот36 ₽/M
Кэшот0 ₽/M
за 1M токенов
Контекст1.0M
Релиз10 сент. 2026 г.

Доступные площадки

Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.

ПлощадкаПровайдерВходВыходКэшОшибки tool-callingОшибки structured output
DeepInfra
fp8
лучший провайдер: 1ru_openrouter12 ₽/M36 ₽/M0 ₽/M0,3 %16 %
———
———
AllTokens
n/a
лучший провайдер: 1AllTokens14 ₽/M42 ₽/M———
———
———
Neurly
n/a
лучший провайдер: 1Neurly15 ₽/M44 ₽/M———
———
———
bothub
n/a
лучший провайдер: 1bothub15 ₽/M46 ₽/M0,46 ₽/M——
———
———

Бенчмарки

Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.

Индекс интеллектаНиже среднего
39.5%Общая интеллектуальная производительность

Быстрый старт

Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: deepseek/deepseek-v4.1-flash-20260910.

curl -s "https://llmmart.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4.1-flash-20260910",
    "messages": [
      {"role": "user", "content": "Привет!"}
    ]
  }'

Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.

Ещё модели от Deepseek

Все модели (19)