Anthropic: Claude Opus 5.5Claude Opus 5.5 — это флагманская модель Anthropic, требующая рассуждений, кодирования и долгосрочной агентской работы, пришедшая на смену Claude Opus 5. Она особенно сильна в мног…Вход: ТекстВход: ИзображенияВход: Файл→Выход: Текст22 сент. 2026 г.1M contextВводот104 ₽/MВыводот516 ₽/MКэшот10 ₽/M
Xiaomi: MiMo-V2.6-Pro-UltraSpeedMiMo-V2.6-Pro-UltraSpeed — это высокоскоростная версия флагманской базовой модели Xiaomi MiMo-V2.6-Pro. Созданный на основе той же контрольной точки 1T MiMo-V2.6-Pro, он соответс…Вход: ТекстВход: ИзображенияВход: ВидеоВход: Аудио→Выход: Текст21 сент. 2026 г.1.0M contextВводот478 ₽/MВыводот956 ₽/MКэшот4,16 ₽/M
Xiaomi: MiMo-V2.6-FlashMiMo-V2.6-Flash — это базовая модель с открытым исходным кодом, разработанная Xiaomi. Построенный на архитектуре Mixture-of-Experts с общим числом параметров 309B и активацией 15B…Вход: ТекстВход: ИзображенияВход: ВидеоВход: Аудио→Выход: Текст21 сент. 2026 г.1.0M contextВводот12 ₽/MВыводот24 ₽/MКэшот0,24 ₽/M
Xiaomi: MiMo-V2.6-ProMiMo-V2.6-Pro — флагманская базовая модель, разработанная Xiaomi. Созданный в масштабе более 1Т параметров, он предназначен для того, чтобы расширить возможности самых ресурсоемких…Вход: ТекстВход: ИзображенияВход: ВидеоВход: Аудио→Выход: Текст21 сент. 2026 г.1.0M contextВводот24 ₽/MВыводот49 ₽/MКэшот2 ₽/M
SpaceXAI: Grok 4.7Grok 4.7 — это флагманская модель SpaceXAI для кодирования, агентских задач и информационной работы, пришедшая на смену Grok 4.6. Он особенно силен в длительных задачах разработки…Вход: ТекстВход: ИзображенияВход: Файл→Выход: Текст21 сент. 2026 г.500K contextВводот9 ₽/MВыводот23 ₽/MКэшот2 ₽/M
PrismML: Ternary Bonsai 2 27BBonsai 2 27B — это модель рассуждений с 27B параметрами от PrismML, полученная из Qwen3.8-27B. Он поддерживает кодирование, математику, вызов инструментов и понимание изображений с…Вход: ТекстВход: Изображения→Выход: Текст18 сент. 2026 г.262K contextВводот8,33 ₽/MВыводот55 ₽/M
Z.ai: GLM 5.3 FlashXGLM-5.3-FlashX — это высокоскоростной вариант GLM-5.3-Flash от Z.ai, собственной мультимодальной модели, обеспечивающей скорость вывода до 200 токенов/с. Построенный на той же гибр…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст18 сент. 2026 г.1.0M contextВводот4,56 ₽/MВыводот15 ₽/MКэшот0,96 ₽/M
ParetoPareto — это мультимодальная составная модель, созданная для исследований, кодирования и агентских рабочих процессов, обеспечивающая высочайшую производительность при выполнении ши…Вход: ТекстВход: Изображения→Выход: Текст17 сент. 2026 г.262K contextВводот275 ₽/MВыводот823 ₽/MКэшот27 ₽/M
Inference.net: Schematron V2 TurboSchematron V2 Turbo — это модель извлечения 3B-параметров HTML-JSON от Inference.net. Он отдает приоритет пропускной способности для рабочих нагрузок по извлечению больших объемов.…Вход: Текст→Выход: Текст12 сент. 2026 г.128K contextВводот3,12 ₽/MВыводот17 ₽/MКэшот3,12 ₽/M
Inference.net: Schematron V2 SmallSchematron V2 Small — это модель извлечения 3B-параметров HTML-JSON от Inference.net. Он отдает приоритет качеству извлечения для сложных схем и длинных страниц. Инструкции по извл…Вход: Текст→Выход: Текст12 сент. 2026 г.128K contextВводот5,2 ₽/MВыводот25 ₽/MКэшот5,2 ₽/M
inclusionAI: Ling 3.0 Flash VLLing 3.0 Flash VL создан на базе Ling 3.0 Flash (всего 124 ББ / 5,5 МБ активного MoE от InclusionAI), что еще больше усиливает его языковые возможности, добавляя при этом собственн…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст10 сент. 2026 г.131K contextВводот2,08 ₽/MВыводот6,25 ₽/MКэшот0 ₽/M
DeepSeek: DeepSeek V4.1 Flash129DeepSeek V4.1 Flash — это модель от DeepSeek, созданная с использованием редких специалистов, и первая модель, построенная на архитектуре причинного кодировщика-декодера (CED) комп…Вход: ТекстВход: Изображения→Выход: Текст10 сент. 2026 г.1.0M contextВводот2,03 ₽/MВыводот8,08 ₽/MКэшот0,2 ₽/M
DeepSeek: DeepSeek V4.1 Flash (batch)DeepSeek V4.1 Flash — это модель от DeepSeek, созданная с использованием редких специалистов, и первая модель, построенная на архитектуре причинного кодировщика-декодера (CED) комп…Вход: ТекстВход: Изображения→Выход: Текст10 сент. 2026 г.1.0M contextВводот12 ₽/MВыводот36 ₽/MКэшот0 ₽/M
Inception: Mercury 2.5Mercury 2.5 — это LLM с самым быстрым рассуждением и новейшая диффузная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 производит и обрабатывает нес…Вход: Текст→Выход: Текст8 сент. 2026 г.260K contextВводот4,16 ₽/MВыводот17 ₽/MКэшот0 ₽/M
Nex AGI: Nex-N2.5-MiniNex-N2.5 — это агентная модель, созданная для превращения целей в работающие, проверенные результаты. Его основная сила — агентное кодирование в рамках цикла визуальной обратной св…Вход: ТекстВход: Изображения→Выход: Текст8 сент. 2026 г.262K contextВводот3,21 ₽/MВыводот13 ₽/MКэшот0,32 ₽/M
Nex AGI: Nex-N2.5-ProNex-N2.5 — это агентная модель, созданная для превращения целей в работающие, проверенные результаты. Его основная сила — агентное кодирование в рамках цикла визуальной обратной св…Вход: ТекстВход: Изображения→Выход: Текст8 сент. 2026 г.262K contextВводот9,63 ₽/MВыводот32 ₽/MКэшот2,01 ₽/M
Qwen: Qwen3.8 Max (0902)Qwen3.8 Max 0902 — это обновленная версия Qwen3.8 Max от команды Qwen из Alibaba. Это смешанная экспертная модель с 2,4 триллиона параметров, которая принимает ввод текста, изображ…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст3 сент. 2026 г.1M contextВводот169 ₽/MВыводот506 ₽/MКэшот21 ₽/M
Meta: Muse Spark 1.3 ContributorMuse Spark 1.3 Contributor — это экономичный уровень участника мультимодальной модели рассуждения Meta для экспериментирования, обучения и ранних стадий агентных, многоагентных раб…Вход: ТекстВход: ИзображенияВход: ВидеоВход: ФайлВход: Аудио→Выход: Текст2 сент. 2026 г.1.0M contextВводот11 ₽/MВыводот22 ₽/MКэшот0 ₽/M
Meta: Muse Spark 1.3Muse Spark 1.3 — это мультимодальная модель рассуждения от Meta для длительных агентных, мультиагентных рабочих процессов и рабочих процессов кодирования. Он предназначен для отсле…Вход: ТекстВход: ИзображенияВход: ВидеоВход: ФайлВход: Аудио→Выход: Текст2 сент. 2026 г.1.0M contextВводот137 ₽/MВыводот466 ₽/MКэшот17 ₽/M
Google: Gemini 3.8 FlashGemini 3.8 Flash — это самая интеллектуальная модель Flash от Google, которая значительно превосходит версию 3.7 Flash в разработке программного обеспечения, агентских задачах и мн…Вход: ТекстВход: ИзображенияВход: ВидеоВход: ФайлВход: Аудио→Выход: Текст2 сент. 2026 г.1.0M contextВводот4,72 ₽/MВыводот24 ₽/MКэшот0,47 ₽/M
Inception: Mercury 2.5 PreviewMercury 2.5 — самая быстрая модель рассуждений и новейшая diffusion LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 создаёт и уточняет несколько токе…Вход: Текст→Выход: Текст31 авг. 2026 г.260K contextВвод5,31 ₽/MВывод20 ₽/M
IBM: Granite 4.2 8BGranite 4.2 8B — плотная модель рассуждений от IBM. Подходит для математики, генерации кода, многоязычного диалога и агентных рабочих процессов с многошаговыми рассуждениями. Подде…Вход: Текст→Выход: Текст31 авг. 2026 г.131K contextВводот11 ₽/MВыводот17 ₽/MКэшот5,2 ₽/M
Tencent: Hy4 previewTencent: Hy4 preview — модель mixture-of-experts от Tencent с 49B активными параметрами из 770B общих. Рассчитана на кодинг-агентов, сложные рабочие процессы с инструментами и прод…Вход: Текст→Выход: Текст28 авг. 2026 г.1.0M contextВводот9,17 ₽/MВыводот28 ₽/MКэшот0,46 ₽/M
inclusionAI: Ling 3.0 Flash FinLing 3.0 Flash Fin — это модель, ориентированная на финансы и состоящая из экспертов от InclusionAI, построенная на основе Ling 3.0 Flash и имеющая 5,1 млрд активных параметров из…Вход: Текст→Выход: Текст27 авг. 2026 г.262K contextВводот6,25 ₽/MВыводот20 ₽/MКэшот1,04 ₽/M
Qwen: Qwen3.8 FlashQwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Он подходит для помощи в кодировании, агентских рабочих процессах, визуальном понимании, анализе документов и код…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст26 авг. 2026 г.1M contextВводот2,11 ₽/MВыводот6,2 ₽/MКэшот0,21 ₽/M
Z.ai: GLM 5.3 Flash672GLM-5.3-Flash — нативная мультимодальная модель от Z.ai. Он подходит для эффективного кодирования и долгосрочных агентских задач. Его гибридная архитектура с разреженным и линейным…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст26 авг. 2026 г.1.3M contextВводот5,06 ₽/MВыводот16 ₽/MКэшот1,12 ₽/M
Z.ai: GLM 5.3 Flash (batch)GLM-5.3-Flash — нативная мультимодальная модель Z.ai. Подходит для эффективного кодинга и длительных агентных задач. Гибридная архитектура разреженного и линейного внимания сохраня…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст26 авг. 2026 г.1.0M contextВводот6,25 ₽/MВыводот22 ₽/MКэшот1,04 ₽/M
Meta: Muse Spark 1.2 ContributorУровень участника Muse Spark 1.2 — это модель рассуждения от Meta, предназначенная для разработчиков, которые хотят начать создавать с еще меньшими затратами. Это значительно дешев…Вход: ТекстВход: ИзображенияВход: ВидеоВход: ФайлВход: Аудио→Выход: Текст21 авг. 2026 г.1.0M contextВводот11 ₽/MВыводот22 ₽/MКэшот0 ₽/M
DeepSeek: DeepSeek V4 Flash Vision ExpDeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой машинного зрения. Открывается в новой вкладке DeepSeek, добавляя понимание изображен…Вход: ТекстВход: Изображения→Выход: Текст21 авг. 2026 г.1.0M contextВводот24 ₽/MВыводот71 ₽/MКэшот1,04 ₽/M
DeepSeek: DeepSeek V4 Flash Vision Exp (batch)DeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой машинного зрения. Открывается в новой вкладке DeepSeek, добавляя понимание изображен…Вход: ТекстВход: Изображения→Выход: Текст21 авг. 2026 г.1.0M contextВвод16 ₽/MВывод49 ₽/MКэш0,52 ₽/M
Tencent: Hy-MT2-1.8BHy-MT2-1.8B — это компактная модель трансляции с параметрами 1,8B от Tencent. Он поддерживает 33 языковые пары и пять китайских диалектов и пар языков меньшинств, а также рабочие п…Вход: Текст→Выход: Текст20 авг. 2026 г.8K contextВводот4,94 ₽/MВыводот20 ₽/M
Tencent: Hy-MT2-30B-A3BHy-MT2-30B-A3B — флагманская модель перевода Tencent в семействе Hy-MT2. Он поддерживает 33 языковые пары и пять китайских диалектов и пар языков меньшинств, а также рабочие процес…Вход: Текст→Выход: Текст20 авг. 2026 г.8K contextВводот7,87 ₽/MВыводот31 ₽/MКэшот3,37 ₽/M
Tencent: Hy-MT2-7BHy-MT2-7B — это модель перевода с 7B параметрами от Tencent. Он поддерживает 33 языковые пары и пять китайских диалектов и пар языков меньшинств, а также рабочие процессы для струк…Вход: Текст→Выход: Текст19 авг. 2026 г.8K contextВводот8,33 ₽/MВыводот32 ₽/M
Z.ai: GLM 5.383.7KGLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для комплексной разработки программного обеспечения и долгосрочных задач агентов. Он поддерживает ввод и вывод…Вход: Текст→Выход: Текст18 авг. 2026 г.1.3M contextВводот6,21 ₽/MВыводот20 ₽/MКэшот0,62 ₽/M
Z.ai: GLM 5.3 (batch)GLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для комплексной разработки программного обеспечения и долгосрочных задач агентов. Он поддерживает ввод и вывод…Вход: Текст→Выход: Текст18 авг. 2026 г.1.0M contextВводот49 ₽/MВыводот220 ₽/MКэшот11 ₽/M
Qwen: Qwen3.8 27BQwen3.8 27B — это модель с открытым весом и плотным языком видения от Qwen. Он подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимоде…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст14 авг. 2026 г.1M contextВводот31 ₽/MВыводот153 ₽/MКэшот3 ₽/M
Google: Gemini 3.7 FlashGemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентских рабочих процессов, кодирования и сложных многоэтапных рассуждений. Он предназначен для задач, требующи…Вход: ТекстВход: ИзображенияВход: ВидеоВход: ФайлВход: Аудио→Выход: Текст13 авг. 2026 г.1.0M contextВводот12 ₽/MВыводот58 ₽/MКэшот1 ₽/M
ByteDance Seed: Seed 2.1 TurboSeed 2.1 Turbo — это мультимодальная модель от ByteDance Seed для кодирования и долгосрочных рабочих процессов агентов. Он подходит для комплексной доставки программного обеспечени…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст12 авг. 2026 г.262K contextВводот55 ₽/MВыводот275 ₽/M
Qwen: Qwen3.8 2.4T A95BQwen3.8 2.4T A95B — это модель с открытым весом, состоящая из разреженной смеси экспертов от Qwen и открытого варианта Qwen3.8 Max, с 95 миллиардами активных параметров из общего ч…Вход: Текст→Выход: Текст12 авг. 2026 г.1.0M contextВводот220 ₽/MВыводот659 ₽/MКэшот27 ₽/M
Qwen: Qwen3.8 2.4T A95B (batch)Qwen3.8 2.4T A95B — открытая разреженная MoE-модель Qwen, открытый вариант Qwen3.8 Max: 95 млрд активных параметров из 2,4 трлн общих. Подходит для кодинга, исследований, сложных р…Вход: Текст→Выход: Текст12 авг. 2026 г.1.0M contextВвод296 ₽/MВывод889 ₽/MКэш37 ₽/M