Qwen2.5 7B — новейшая серия моделей Qwen с большим языком. Qwen2.5 вносит следующие улучшения в Qwen2. Значительно больше знаний и значительно улучшенные возможности в области кодирования и математики благодаря нашим специализированным экспертным моделям в этих областях. Значительные улучшения в следовании инструкциям, генерации длинных текстов (более 8 000 токенов), понимании структурированных данных (например, таблиц) и генерации структурированных выходных данных, особенно JSON. Более устойчив к разнообразию системных подсказок, улучшает реализацию ролевых игр и настройку условий для чат-ботов. Длинный контекст. Поддержка до 128 000 токенов и возможность генерировать до 8 000 токенов. Многоязычная поддержка более 29 языков, включая китайский, английский, французский, испанский, португальский, немецкий, итальянский, русский, японский, корейский, вьетнамский, тайский, арабский и другие. Использование этой модели регулируется ЛИЦЕНЗИОННЫМ СОГЛАШЕНИЕМ Tongyi Qianwen.
Модальности
Вход: Текст
Выход: Текст
Цена ввод / выводза 1M токенов
Вводот4,5 ₽/M
Выводот11 ₽/M
Кэшот4,5 ₽/M
Контекст33K
Релиз16 окт. 2024 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход | Выход | Кэш | Ошибки tool-calling | Ошибки structured output |
|---|---|---|---|---|---|---|
| Together fp8 | лучший провайдер: 1polza | 34 ₽/M | 34 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AtlasCloud n/a | лучший провайдер: 1polza | 4,5 ₽/M | 11 ₽/M | 4,5 ₽/M | — | — |
| — | — | — | ||||
| — | — | — | ||||
| SprutDock n/a | лучший провайдер: 1SprutDock | 13 ₽/M | 25 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| AllTokens n/a | лучший провайдер: 1AllTokens | 13 ₽/M | 25 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| proxyapi n/a | лучший провайдер: 1proxyapi | 13 ₽/M | 26 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Phala n/a | лучший провайдер: 1routerai | 11 ₽/M | 22 ₽/M | — | 1,7 % | 0,1 % |
| второй провайдер: 2ru_openrouter | 11 ₽/M | 22 ₽/M | — | |||
| третий провайдер: 3polza | 11 ₽/M | 23 ₽/M | — | |||
| Neurly n/a | лучший провайдер: 1Neurly | 13 ₽/M | 27 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| bothub n/a | лучший провайдер: 1bothub | 14 ₽/M | 27 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| ZvenoAI n/a | лучший провайдер: 1ZvenoAI | 18 ₽/M | 36 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — | ||||
| Together n/a | лучший провайдер: 1polza | 34 ₽/M | 34 ₽/M | — | — | — |
| — | — | — | ||||
| — | — | — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: qwen/qwen-2.5-7b-instruct.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen-2.5-7b-instruct",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Qwen
Все модели (67)Вводот439 ₽/M
Выводот1 318 ₽/M
Кэшот55 ₽/M
Вводот17 ₽/M
Выводот52 ₽/M
Кэшот2,08 ₽/M
Вводот169 ₽/M
Выводот507 ₽/M
Кэшот21 ₽/M
Вводот2,11 ₽/M
Выводот6,2 ₽/M
Кэшот0,21 ₽/M
Вводот31 ₽/M
Выводот153 ₽/M
Кэшот3 ₽/M
запускот0,61 ₽/запуск
Ввод (аудио)от823 ₽/M
Ввод (аудио)от365 ₽/M
Вводот220 ₽/M
Выводот659 ₽/M
Кэшот27 ₽/M
Ввод296 ₽/M
Вывод889 ₽/M
Кэш37 ₽/M
Вводот922 ₽/M
Выводот922 ₽/M
изображениеот6,08 ₽/шт
Вводот1 303 ₽/M
Выводот1 303 ₽/M
изображениеот8,1 ₽/шт