Nvidia

NVIDIA: Nemotron 3 Ultra

nvidia/nemotron-3-ultra-550b-a55b-20260604

NVIDIA Nemotron 3 Ultra — это открытая модель рассуждений и оркестрации от NVIDIA с 55B активных параметров из общего числа 550B (MoE). Построенный на гибридной архитектуре, состоящей из нескольких экспертов Transformer-Mamba, он поддерживает ввод и вывод текста с контекстным окном, содержащим до 1 млн токенов. Он подходит для длительных агентских рабочих процессов, включая оркестровку агентов, кодирование агентов, глубокие исследования и сложные корпоративные задачи. Он особенно силен в многоэтапном рассуждении и планировании, с высокопроизводительным выводом, предназначенным для конвейеров агентов большого объема. Это часть семейства открытых моделей агентного искусственного интеллекта NVIDIA Nemotron.

Модальности
Вход: Текст
Выход: Текст
Цена ввод / вывод
Вводот55 ₽/M
Выводот241 ₽/M
Кэшот11 ₽/M
за 1M токенов
Контекст262K
Релиз4 июн. 2026 г.

Доступные площадки

Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.

ПлощадкаПровайдерВходВыходКэшОшибки tool-callingОшибки structured output
DeepInfra
bf16
лучший провайдер: 1polza56 ₽/M245 ₽/M11 ₽/M——
———
———
Venice
fp8
лучший провайдер: 1routerai68 ₽/M339 ₽/M20 ₽/M0 %—
второй провайдер: 2ru_openrouter69 ₽/M343 ₽/M21 ₽/M
третий провайдер: 3polza70 ₽/M348 ₽/M21 ₽/M
AllTokens
n/a
лучший провайдер: 1AllTokens60 ₽/M264 ₽/M———
———
———
SprutDock
n/a
лучший провайдер: 1SprutDock62 ₽/M272 ₽/M12 ₽/M——
———
———
bothub
n/a
лучший провайдер: 1bothub67 ₽/M293 ₽/M13 ₽/M——
———
———
DeepInfra
fp4
лучший провайдер: 1routerai54 ₽/M239 ₽/M11 ₽/M0,8 %0 %
второй провайдер: 2ru_openrouter55 ₽/M241 ₽/M11 ₽/M
третий провайдер: 3polza56 ₽/M245 ₽/M11 ₽/M
BaseTen
fp4
лучший провайдер: 1routerai65 ₽/M261 ₽/M13 ₽/M13 %—
второй провайдер: 2ru_openrouter66 ₽/M263 ₽/M14 ₽/M
третий провайдер: 3polza67 ₽/M268 ₽/M13 ₽/M
Nebius
fp4
лучший провайдер: 1polza112 ₽/M334 ₽/M———
———
———
Crusoe
fp4
лучший провайдер: 1polza112 ₽/M357 ₽/M28 ₽/M——
———
———
Neurly
n/a
лучший провайдер: 1Neurly68 ₽/M298 ₽/M———
———
———
GPUniq
n/a
лучший провайдер: 1GPUniq72 ₽/M318 ₽/M———
———
———
Together
n/a
лучший провайдер: 1polza67 ₽/M401 ₽/M22 ₽/M——
———
———
proxyapi
n/a
лучший провайдер: 1proxyapi80 ₽/M401 ₽/M24 ₽/M——
———
———
ZvenoAI
n/a
лучший провайдер: 1ZvenoAI97 ₽/M425 ₽/M———
———
———

Бенчмарки

Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.

Результаты по категориям

ASCII-арт
1104
3D
1150
SVG
1067
Игровая разработка
1152
UI-компоненты
1147
Категории кода
1153
Визуализация данных
1150
Веб-сайты
1147

Арена моделей

ASCII-артТоп 61%
1104Рейтинг Elo
37.9%Побед
3DТоп 65%
1150Рейтинг Elo
39.4%Побед
SVGТоп 67%
1067Рейтинг Elo
33.0%Побед
Игровая разработкаТоп 68%
1152Рейтинг Elo
36.8%Побед
UI-компонентыТоп 74%
1147Рейтинг Elo
36.4%Побед
Категории кодаТоп 75%
1153Рейтинг Elo
36.2%Побед
Визуализация данныхТоп 76%
1150Рейтинг Elo
37.6%Побед
Веб-сайтыТоп 85%
1147Рейтинг Elo
34.9%Побед

Метрики из арены дизайна

Быстрый старт

Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: nvidia/nemotron-3-ultra-550b-a55b-20260604.

curl -s "https://llmmart.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/nemotron-3-ultra-550b-a55b-20260604",
    "messages": [
      {"role": "user", "content": "Привет!"}
    ]
  }'

Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.

Ещё модели от Nvidia

NVIDIA: Nemotron 3 Ultra — цены и детали API | LLM Mart