Meta.llama

Meta: Llama 4 Scout

meta-llama/llama-4-scout-17b-16e-instruct

Llama 4 Scout 17B Instruct (16E) — это языковая модель смешанных экспертов (MoE), разработанная Meta, которая активирует 17 миллиардов параметров из 109B. Он поддерживает собственный мультимодальный ввод (текст и изображение) и многоязычный вывод (текст и код) на 12 поддерживаемых языках. Разработанный для взаимодействия в стиле помощника и визуального мышления, Scout использует 16 экспертов для каждого прохода вперед и имеет длину контекста в 10 миллионов токенов, а обучающий корпус составляет около 40 триллионов токенов. Llama 4 Scout, созданный для обеспечения высокой эффективности и локального или коммерческого развертывания, включает в себя раннее объединение для плавной интеграции модальностей. Он настроен для использования в многоязычном чате, субтитрах и задачах понимания изображений. Выпущенный под лицензией сообщества Llama 4, последний раз он обучался на данных до августа 2024 года и был публично запущен 5 апреля 2025 года.

Модальности
Вход: ТекстВход: Изображения
Выход: Текст
Цена ввод / вывод
Вводот11 ₽/M
Выводот33 ₽/M
Кэшот12 ₽/M
за 1M токенов
Контекст1.3M
Релиз5 апр. 2025 г.

Доступные площадки

Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.

ПлощадкаПровайдерВходВыходКэшОшибки tool-callingОшибки structured output
Novita
bf16
лучший провайдер: 1routerai20 ₽/M64 ₽/M———
второй провайдер: 2ru_openrouter20 ₽/M65 ₽/M—
третий провайдер: 3polza20 ₽/M66 ₽/M—
DeepInfra
fp8
лучший провайдер: 1routerai11 ₽/M33 ₽/M——2,7 %
второй провайдер: 2polza11 ₽/M33 ₽/M—
третий провайдер: 3ru_openrouter11 ₽/M33 ₽/M—
ModelGate
n/a
лучший провайдер: 1ModelGate11 ₽/M33 ₽/M———
———
———
SprutDock
n/a
лучший провайдер: 1SprutDock12 ₽/M37 ₽/M———
———
———
AllTokens
n/a
лучший провайдер: 1AllTokens13 ₽/M38 ₽/M———
———
———
groq
n/a
лучший провайдер: 1polza12 ₽/M38 ₽/M6,12 ₽/M——
———
———
proxyapi
n/a
лучший провайдер: 1proxyapi13 ₽/M39 ₽/M———
———
———
bothub
n/a
лучший провайдер: 1bothub13 ₽/M40 ₽/M———
———
———
Neurly
n/a
лучший провайдер: 1Neurly14 ₽/M41 ₽/M———
———
———
GPUniq
n/a
лучший провайдер: 1GPUniq14 ₽/M43 ₽/M———
———
———
ZvenoAI
n/a
лучший провайдер: 1ZvenoAI19 ₽/M58 ₽/M———
———
———
Friendli
n/a
лучший провайдер: 1polza11 ₽/M67 ₽/M11 ₽/M——
———
———
AITUNNEL
n/a
лучший провайдер: 1AITUNNEL20 ₽/M60 ₽/M———
———
———
Together
n/a
лучший провайдер: 1polza20 ₽/M66 ₽/M———
———
———
WandB
n/a
лучший провайдер: 1polza19 ₽/M74 ₽/M19 ₽/M——
———
———
VseGPT
n/a
лучший провайдер: 1VseGPT22 ₽/M80 ₽/M———
———
———
google-vertex
n/a
лучший провайдер: 1routerai27 ₽/M76 ₽/M———
———
———
google-vertex/us-east5
n/a
лучший провайдер: 1ru_openrouter27 ₽/M77 ₽/M———
второй провайдер: 2polza28 ₽/M78 ₽/M—
———
GPTunneL
n/a
лучший провайдер: 1GPTunneL50 ₽/M180 ₽/M———
———
———

Бенчмарки

Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.

Результаты по категориям

Визуализация данных
903
UI-компоненты
778
Категории кода
799
Игровая разработка
786
Веб-сайты
758

Арена моделей

Визуализация данныхТоп 119%
903Рейтинг Elo
39.3%Побед
UI-компонентыТоп 121%
778Рейтинг Elo
25.5%Побед
Категории кодаТоп 126%
799Рейтинг Elo
26.6%Побед
Игровая разработкаТоп 127%
786Рейтинг Elo
27.4%Побед
Веб-сайтыТоп 134%
758Рейтинг Elo
22.7%Побед

Метрики из арены дизайна

Быстрый старт

Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: meta-llama/llama-4-scout-17b-16e-instruct.

curl -s "https://llmmart.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-4-scout-17b-16e-instruct",
    "messages": [
      {"role": "user", "content": "Привет!"}
    ]
  }'

Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.

Ещё модели от Meta.llama

Meta: Llama 4 Scout — цены и детали API | LLM Mart