Mercury 2.5 — это LLM с самым быстрым рассуждением и новейшая диффузная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 производит и обрабатывает несколько токенов параллельно, достигая скорости 1107 токенов в секунду на стандартных графических процессорах. Он обеспечивает прирост интеллекта на 10+ пунктов по сравнению с Mercury 2, качество которого сравнимо с экономическими оптимизированными моделями Frontier, такими как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждений, параллельные вызовы инструментов и вывод JSON по схеме. Он создан для производственных рабочих нагрузок, в которых задержка увеличивается: поисковые агенты, голосовые конвейеры и подагенты кодирования. Подробности читайте в записи блога.Открывается в новой вкладке.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот4,16 ₽/M
Выводот17 ₽/M
Кэшот0 ₽/M
Контекст260K
Релиз8 сент. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| inception n/a | лучший провайдер: 1ru_openrouter | 4,16 ₽/M | 17 ₽/M | 0 ₽/M | 2,9 % | 4,4 % |
| второй провайдер: 2routerai | 4,39 ₽/M | 16 ₽/M | 0,44 ₽/M | |||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 5 ₽/M | 19 ₽/M | 0,5 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 5 ₽/M | 19 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Neurly n/a | лучший провайдер: 1Neurly | 5,22 ₽/M | 20 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 5,43 ₽/M | 20 ₽/M | 0,54 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 7,5 ₽/M | 28 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: inception/mercury-2.5-20260908.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "inception/mercury-2.5-20260908",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.