Гермес 4 — это крупномасштабная модель мышления, созданная на основе Мета-Лламы-3.1-405B и выпущенная Nous Research. Он вводит гибридный режим рассуждения, в котором модель может выбирать внутренние размышления с помощью <think>...</think> трассировок или реагировать напрямую, обеспечивая гибкость между скоростью и глубиной. Пользователи могут управлять поведением рассуждения с помощью логического значения, включающего рассуждение. Узнайте больше в нашей документацииОткрывается в новой вкладке Модель настраивается с помощью инструкций с помощью расширенного корпуса после обучения (~ 60 миллиардов токенов), подчеркивающего следы рассуждения, улучшающего производительность в математике, кодировании, STEM и логическом рассуждении, сохраняя при этом широкую полезность помощника. Он также поддерживает структурированные выходные данные, включая режим JSON, соблюдение схемы, вызов функций и использование инструментов. Hermes 4 обучен управляемости, более низкому проценту отказов и ориентирован на нейтральное поведение, ориентированное на пользователя.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот110 ₽/M
Выводот330 ₽/M
Контекст131K
Релиз26 авг. 2025 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| Nebius fp8 | лучший провайдер: 1routerai | 110 ₽/M | 329 ₽/M | — | — | — |
| второй провайдер: 2ru_openrouter | 110 ₽/M | 330 ₽/M | — | |||
| третий провайдер: 3polza | 113 ₽/M | 338 ₽/M | — | |||
| AllTokens n/a | лучший провайдер: 1AllTokens | 120 ₽/M | 359 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 125 ₽/M | 375 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 130 ₽/M | 391 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 132 ₽/M | 394 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 135 ₽/M | 405 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| VseGPT n/a | лучший провайдер: 1VseGPT | 150 ₽/M | 450 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 180 ₽/M | 550 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: nousresearch/hermes-4-405b.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nousresearch/hermes-4-405b",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.