NVIDIA Nemotron 3 Super — это открытая гибридная модель MoE со 120 битами параметров, активирующая всего 12 миллиардов параметров для максимальной эффективности и точности вычислений в сложных мультиагентных приложениях. Построенный на гибридной архитектуре Mamba-Transformer Mixture-of-Experts с прогнозированием нескольких токенов (MTP), он обеспечивает более чем на 50 % более высокий уровень генерации токенов по сравнению с ведущими открытыми моделями. Модель оснащена контекстным окном токена 1M для долгосрочной согласованности действий агентов, анализа перекрестных документов и многоэтапного планирования задач. Скрытое МО позволяет вызвать 4 экспертов по цене заключения только одного, улучшая интеллект и обобщение. Обучение RL в нескольких средах в более чем 10 средах обеспечивает высочайшую точность тестов, включая AIME 2025, TerminalBench и SWE-Bench Verified. Nemotron 3 Super, полностью открытый для весов, наборов данных и рецептов в рамках открытой лицензии NVIDIA, позволяет легко настраивать и безопасно развертывать где угодно — от рабочей станции до облака.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот9,37 ₽/M
Выводот44 ₽/M
Контекст262K
Релиз11 мар. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|
| dekallm fp8 | лучший провайдер: 1ru_openrouter | 8,33 ₽/M | 49 ₽/M | 7,4 % | 1,9 % |
| второй провайдер: 2routerai | 8,68 ₽/M | 49 ₽/M | |||
| — | — | ||||
| DeepInfra bf16 | лучший провайдер: 1routerai | 9,23 ₽/M | 43 ₽/M | 33 % | — |
| второй провайдер: 2ru_openrouter | 9,37 ₽/M | 44 ₽/M | |||
| — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 10 ₽/M | 50 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 11 ₽/M | 51 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 9,9 ₽/M | 56 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 11 ₽/M | 60 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 11 ₽/M | 61 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| GPUniq n/a | лучший провайдер: 1GPUniq | 12 ₽/M | 65 ₽/M | — | — |
| — | — | ||||
| — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 15 ₽/M | 77 ₽/M | — | — |
| — | — | ||||
| — | — |
Бенчмарки
Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.
Агентные задачиНиже среднего
1.7%Многошаговые агентные сценарииПрограммированиеНиже среднего
37.7%Способность решать задачи программированияИндекс интеллектаНиже среднего
12.8%Общая интеллектуальная производительностьБыстрый старт
Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: nvidia/nemotron-3-super-120b-a12b-20230311.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/nemotron-3-super-120b-a12b-20230311",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Nvidia
NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B
nvidia/nemotron-3.5-asr-streaming-multilingual-0.6b-20260813
Ввод (аудио)от365 ₽/M
Вводот4,16 ₽/M
Выводот20 ₽/M
Кэшот2,08 ₽/M
Вводот22 ₽/M
Выводот22 ₽/M
Вводот55 ₽/M
Выводот241 ₽/M
Кэшот11 ₽/M
Ввод80 ₽/M
Вывод478 ₽/M
Ввод (аудио)от2 746 ₽/M
Вводот5,2 ₽/M
Выводот22 ₽/M
Кэшот3,12 ₽/M
Ввод65 ₽/M
Вывод65 ₽/M