Mercury 2 — это LLM с чрезвычайно быстрым мышлением и первый LLM с диффузией рассуждений (dLLM). Вместо последовательной генерации токенов Mercury 2 производит и обрабатывает несколько токенов параллельно, достигая >1000 токенов в секунду на стандартных графических процессорах. Mercury 2 в 5+ раз быстрее, чем ведущие LLM с оптимизированной скоростью, такие как Claude 4.5 Haiku и GPT 5 Mini, и при этом стоит гораздо дешевле. Mercury 2 поддерживает настраиваемые уровни рассуждения, контекст 128 КБ, использование собственных инструментов и вывод JSON с выравниванием по схеме. Создан для рабочих процессов кодирования, в которых увеличивается задержка, голосовая связь/поиск в реальном времени и зацикливание агентов. Совместимость с OpenAI API. Подробности читайте в записи блога.Открывается в новой вкладке.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот27 ₽/M
Выводот82 ₽/M
Кэшот3,12 ₽/M
Контекст128K
Релиз4 мар. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| inception n/a | лучший провайдер: 1ru_openrouter | 27 ₽/M | 82 ₽/M | 3,12 ₽/M | 7,9 % | 2,1 % |
| второй провайдер: 2routerai | 27 ₽/M | 82 ₽/M | 2,74 ₽/M | |||
| третий провайдер: 3polza | 28 ₽/M | 85 ₽/M | 2,82 ₽/M | |||
| SprutDock n/a | лучший провайдер: 1SprutDock | 31 ₽/M | 94 ₽/M | 3,12 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 32 ₽/M | 94 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 32 ₽/M | 96 ₽/M | 3,21 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 33 ₽/M | 98 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 34 ₽/M | 101 ₽/M | 3,38 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 45 ₽/M | 140 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.
Результаты по категориям
ASCII-арт
1019
SVG
1009
3D
999
Визуализация данных
1016
UI-компоненты
999
Категории кода
1028
Игровая разработка
1012
Веб-сайты
1038
Арена моделей
ASCII-артТоп 65%
1019Рейтинг Elo
26.5%Побед
SVGТоп 80%
1009Рейтинг Elo
24.9%Побед
3DТоп 104%
999Рейтинг Elo
21.6%Побед
Визуализация данныхТоп 104%
1016Рейтинг Elo
22.0%Побед
UI-компонентыТоп 105%
999Рейтинг Elo
19.1%Побед
Категории кодаТоп 108%
1028Рейтинг Elo
21.3%Побед
Игровая разработкаТоп 109%
1012Рейтинг Elo
20.0%Побед
Веб-сайтыТоп 112%
1038Рейтинг Elo
21.8%Побед
Метрики из арены дизайна
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: inception/mercury-2-20260304.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "inception/mercury-2-20260304",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.