Inference.net: Schematron V2 TurboSchematron V2 Turbo — это модель извлечения 3B-параметров HTML-JSON от Inference.net. Он отдает приоритет пропускной способности для рабочих нагрузок по извлечению больших объемов.…Вход: Текст→Выход: Текст12 сент. 2026 г.128K contextВводот3,12 ₽/MВыводот17 ₽/MКэшот3,12 ₽/M
Inference.net: Schematron V2 SmallSchematron V2 Small — это модель извлечения 3B-параметров HTML-JSON от Inference.net. Он отдает приоритет качеству извлечения для сложных схем и длинных страниц. Инструкции по извл…Вход: Текст→Выход: Текст12 сент. 2026 г.128K contextВводот5,2 ₽/MВыводот25 ₽/MКэшот5,2 ₽/M
inclusionAI: Ling 3.0 Flash VLLing 3.0 Flash VL создан на базе Ling 3.0 Flash (всего 124 ББ / 5,5 МБ активного MoE от InclusionAI), что еще больше усиливает его языковые возможности, добавляя при этом собственн…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст10 сент. 2026 г.131K contextВводот2,08 ₽/MВыводот6,25 ₽/MКэшот0 ₽/M
DeepSeek: DeepSeek V4.1 Flash129DeepSeek V4.1 Flash — это модель от DeepSeek, созданная с использованием редких специалистов, и первая модель, построенная на архитектуре причинного кодировщика-декодера (CED) комп…Вход: ТекстВход: Изображения→Выход: Текст10 сент. 2026 г.1.0M contextВводот2,03 ₽/MВыводот8,08 ₽/MКэшот0,2 ₽/M
DeepSeek: DeepSeek V4.1 Flash (batch)DeepSeek V4.1 Flash — это модель от DeepSeek, созданная с использованием редких специалистов, и первая модель, построенная на архитектуре причинного кодировщика-декодера (CED) комп…Вход: ТекстВход: Изображения→Выход: Текст10 сент. 2026 г.1.0M contextВводот12 ₽/MВыводот36 ₽/MКэшот0 ₽/M
IBM: Granite 4.2 8BGranite 4.2 8B — плотная модель рассуждений от IBM. Подходит для математики, генерации кода, многоязычного диалога и агентных рабочих процессов с многошаговыми рассуждениями. Подде…Вход: Текст→Выход: Текст31 авг. 2026 г.131K contextВводот11 ₽/MВыводот17 ₽/MКэшот5,2 ₽/M
inclusionAI: Ling 3.0 Flash FinLing 3.0 Flash Fin — это модель, ориентированная на финансы и состоящая из экспертов от InclusionAI, построенная на основе Ling 3.0 Flash и имеющая 5,1 млрд активных параметров из…Вход: Текст→Выход: Текст27 авг. 2026 г.262K contextВводот6,25 ₽/MВыводот20 ₽/MКэшот1,04 ₽/M
Z.ai: GLM 5.3 Flash1.7KGLM-5.3-Flash — нативная мультимодальная модель от Z.ai. Он подходит для эффективного кодирования и долгосрочных агентских задач. Его гибридная архитектура с разреженным и линейным…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст26 авг. 2026 г.1.3M contextВводот5,06 ₽/MВыводот16 ₽/MКэшот1,12 ₽/M
Z.ai: GLM 5.3 Flash (batch)GLM-5.3-Flash — нативная мультимодальная модель Z.ai. Подходит для эффективного кодинга и длительных агентных задач. Гибридная архитектура разреженного и линейного внимания сохраня…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст26 авг. 2026 г.1.0M contextВводот6,25 ₽/MВыводот22 ₽/MКэшот1,04 ₽/M
DeepSeek: DeepSeek V4 Flash Vision ExpDeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой машинного зрения. Открывается в новой вкладке DeepSeek, добавляя понимание изображен…Вход: ТекстВход: Изображения→Выход: Текст21 авг. 2026 г.1.0M contextВводот24 ₽/MВыводот71 ₽/MКэшот1,04 ₽/M
Z.ai: GLM 5.383.7KGLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для комплексной разработки программного обеспечения и долгосрочных задач агентов. Он поддерживает ввод и вывод…Вход: Текст→Выход: Текст18 авг. 2026 г.1.3M contextВводот6,21 ₽/MВыводот20 ₽/MКэшот0,62 ₽/M
Z.ai: GLM 5.3 (batch)GLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для комплексной разработки программного обеспечения и долгосрочных задач агентов. Он поддерживает ввод и вывод…Вход: Текст→Выход: Текст18 авг. 2026 г.1.0M contextВводот49 ₽/MВыводот220 ₽/MКэшот11 ₽/M
Qwen: Qwen3.8 27BQwen3.8 27B — это модель с открытым весом и плотным языком видения от Qwen. Он подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимоде…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст14 авг. 2026 г.1M contextВводот31 ₽/MВыводот153 ₽/MКэшот3 ₽/M
Qwen: Qwen3.8 2.4T A95BQwen3.8 2.4T A95B — это модель с открытым весом, состоящая из разреженной смеси экспертов от Qwen и открытого варианта Qwen3.8 Max, с 95 миллиардами активных параметров из общего ч…Вход: Текст→Выход: Текст12 авг. 2026 г.1.0M contextВводот220 ₽/MВыводот659 ₽/MКэшот27 ₽/M
Qwen: Qwen3.8 2.4T A95B (batch)Qwen3.8 2.4T A95B — открытая разреженная MoE-модель Qwen, открытый вариант Qwen3.8 Max: 95 млрд активных параметров из 2,4 трлн общих. Подходит для кодинга, исследований, сложных р…Вход: Текст→Выход: Текст12 авг. 2026 г.1.0M contextВвод296 ₽/MВывод889 ₽/MКэш37 ₽/M
DeepSeek: DeepSeek V4 Pro 0813DeepSeek V4 Pro 0813 — это крупномасштабная смешанная модель от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.Вход: Текст→Выход: Текст12 авг. 2026 г.1.0M contextВводот20 ₽/MВыводот58 ₽/MКэшот0,66 ₽/M
NVIDIA: Nemotron 3.5 LightningNVIDIA Nemotron 3.5 Lightning — это открытая смешанная модель от NVIDIA с 3B активных параметров из 30B. Он подходит для высокопроизводительных агентских рабочих нагрузок и специал…Вход: Текст→Выход: Текст11 авг. 2026 г.262K contextВводот4,16 ₽/MВыводот20 ₽/MКэшот4,32 ₽/M
Meta: Muse Glimmer 30BMuse Glimmer 30B — это плотная мультимодальная модель с открытым весом от Meta Superintelligence Labs, созданная на основе Muse Spark и оптимизированная для автономных агентов на п…Вход: ТекстВход: Изображения→Выход: Текст9 авг. 2026 г.131K contextВводот33 ₽/MВыводот121 ₽/MКэшот4,16 ₽/M
DeepSeek: DeepSeek V4 Flash 0731105DeepSeek V4 Flash 0731 — это редкая смешанная модель от DeepSeek с 13B активных параметров из 284B. Эта повторно обученная версия подходит для кодирования, рассуждений и рабочих пр…Вход: Текст→Выход: Текст31 июл. 2026 г.1.3M contextВводот2,05 ₽/MВыводот6,14 ₽/MКэшот0,21 ₽/M
Thinking Machines: Inkling SmallInkling Small — это открытая мультимодальная смешанная модель экспертов от Thinking Machines Lab с 12B активных параметров из 276B. Он позиционируется как меньший по размеру и боле…Вход: ТекстВход: ИзображенияВход: Аудио→Выход: Текст30 июл. 2026 г.1.0M contextВводот49 ₽/MВыводот132 ₽/MКэшот11 ₽/M
Thinking Machines: Inkling Small (batch)Inkling Small — открытая мультимодальная MoE-модель Thinking Machines Lab с 12B активными параметрами из 276B общих. Меньший и более эффективный член семейства Inkling; подходит дл…Вход: ТекстВход: ИзображенияВход: Аудио→Выход: Текст30 июл. 2026 г.524K contextВвод66 ₽/MВывод159 ₽/M
inclusionAI: Ling 3.0 FlashLing-3.0-flash — это модель Mixture-of-Experts (MoE) со 124 миллиардами параметров, в которой на каждый токен активируется примерно 5,1 миллиарда параметров. Модель разработана с…Вход: Текст→Выход: Текст23 июл. 2026 г.262K contextВводот2,08 ₽/MВыводот7,29 ₽/MКэшот0 ₽/M
MEMeituan: LongCat 2.0LongCat 2.0 — это языковая модель от Meituan, состоящая из разреженной смеси экспертов, с 48B активных параметров из общего числа 1,6T. Он подходит для кодирования, изменений на ур…Вход: Текст→Выход: Текст20 июл. 2026 г.1.0M contextВводот33 ₽/MВыводот132 ₽/MКэшот1,04 ₽/M
Thinking Machines: InklingInkling — это открытая мультимодальная смешанная модель экспертов от Thinking Machines Lab с 41 млрд активных параметров из 975 млрд. Он предназначен для рассуждений общего назначе…Вход: ТекстВход: ИзображенияВход: Аудио→Выход: Текст17 июл. 2026 г.1.0M contextВводот104 ₽/MВыводот444 ₽/MКэшот18 ₽/M
Thinking Machines: Inkling (batch)Inkling — это открытая мультимодальная смешанная модель экспертов от Thinking Machines Lab с 41 млрд активных параметров из 975 млрд. Он предназначен для рассуждений общего назначе…Вход: ТекстВход: ИзображенияВход: Аудио→Выход: Текст17 июл. 2026 г.524K contextВвод148 ₽/MВывод600 ₽/MКэш25 ₽/M
MoonshotAI: Kimi K3Kimi K3 — это мультимодальная модель рассуждения с открытым весом и параметром 2,8T от Moonshot AI. Он подходит для сложного кодирования, работы с знаниями и долгосрочных агентских…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст16 июл. 2026 г.1.0M contextВводот26 ₽/MВыводот130 ₽/MКэшот3 ₽/M
MoonshotAI: Kimi K3 (batch)Kimi K3 — открытая мультимодальная модель рассуждений Moonshot AI на 2,8T параметров. Подходит для сложного кодинга, работы с знаниями и длительных агентных рабочих процессов; особ…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст16 июл. 2026 г.1.0M contextВводот251 ₽/MВыводот1 252 ₽/MКэшот25 ₽/M
Kwaipilot: KAT-Coder-Pro V2.5KAT-Coder-Pro V2.5 — это модель агентного кодирования флагманского уровня, которая может напрямую передавать ей всю проблему или весь бизнес-процесс, позволяя ему автономно находит…Вход: Текст→Выход: Текст10 июл. 2026 г.262K contextВводот81 ₽/MВыводот325 ₽/MКэшот17 ₽/M
Tencent: Hy3Hy3 — это модель смеси экспертов с 295 битами параметров от Tencent (21 миллиард активных экспертов, 192 эксперта с топ-8 маршрутизацией), созданная для рассуждений, агентских рабо…Вход: Текст→Выход: Текст6 июл. 2026 г.262K contextВводот12 ₽/MВыводот49 ₽/MКэшот2,95 ₽/M
Z.ai: GLM 5.212.2MacademiaФинансыЗдоровьеGLM 5.2 — это крупномасштабная модель рассуждения от Z.ai. Он поддерживает ввод и вывод текста с помощью контекстного окна с токеном 1M и подходит для долгосрочных рабочих процессо…Вход: Текст→Выход: Текст16 июн. 2026 г.1.0M contextВводот2,42 ₽/MВыводот8,5 ₽/MКэшот0,62 ₽/M
MoonshotAI: Kimi K2.7 Code299MoonshotAI: Kimi K2.7 Code — это ориентированная на кодирование модель семейства Kimi K2 от Moonshot AI, созданная для надежного выполнения комплексных задач программирования в дли…Вход: ТекстВход: Изображения→Выход: Текст12 июн. 2026 г.262K contextВводот34 ₽/MВыводот163 ₽/MКэшот3 ₽/M
MoonshotAI: Kimi K2.7 Code (batch)MoonshotAI: Kimi K2.7 Code — это ориентированная на кодирование модель семейства Kimi K2 от Moonshot AI, созданная для надежного выполнения сквозных задач программирования в длител…Вход: ТекстВход: Изображения→Выход: Текст12 июн. 2026 г.262K contextВвод126 ₽/MВывод531 ₽/M
NVIDIA: Nemotron 3.5 Content SafetyNVIDIA Nemotron 3.5 Content Safety — это компактная 4B-параметрическая мультимодальная модель ограждения от NVIDIA, доработанная с помощью Google Gemma-3-4B. Он модерирует как вход…Вход: ТекстВход: Изображения→Выход: Текст4 июн. 2026 г.131K contextВводот22 ₽/MВыводот22 ₽/M
NVIDIA: Nemotron 3 UltraNVIDIA Nemotron 3 Ultra — это открытая модель рассуждений и оркестрации от NVIDIA с 55B активных параметров из общего числа 550B (MoE). Построенный на гибридной архитектуре, состоя…Вход: Текст→Выход: Текст4 июн. 2026 г.262K contextВводот55 ₽/MВыводот241 ₽/MКэшот11 ₽/M
NVIDIA: Nemotron 3 Ultra (batch)NVIDIA Nemotron 3 Ultra — это открытая модель рассуждений и оркестрации от NVIDIA с 55B активных параметров из общего числа 550B (MoE). Построенный на гибридной архитектуре, состоя…Вход: Текст→Выход: Текст4 июн. 2026 г.512K contextВвод80 ₽/MВывод478 ₽/M
MiniMax: MiniMax M3academiaФинансыЗдоровьеMiniMax-M3 – мультимодальная модель фундамента от MiniMax. Он поддерживает ввод текста, изображений и видео с выводом текста, контекстное окно с токеном 1M и подходит для долгосроч…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст31 мая 2026 г.1.0M contextВводот24 ₽/MВыводот71 ₽/MКэшот5 ₽/M
MiniMax: MiniMax M3 (batch)MiniMax-M3 – мультимодальная модель фундамента от MiniMax. Он поддерживает ввод текста, изображений и видео с выводом текста, контекстное окно с токеном 1M и подходит для долгосроч…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст31 мая 2026 г.524K contextВвод44 ₽/MВывод178 ₽/MКэш8,89 ₽/M
StepFun: Step 3.7 FlashМаркетингПрограммированиеНаукаStep 3.7 Flash — это новейшая высокоэффективная мультимодальная модель Mixture of Experts от StepFun. Он сочетает в себе языковую основу с 196B параметрами и видеокодер для естеств…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст28 мая 2026 г.262K contextВводот18 ₽/MВыводот101 ₽/MКэшот3,12 ₽/M
Qwen: Qwen3.6 35B A3BQwen3.6-35B-A3B — это мультимодальная модель с открытым весом от Alibaba Cloud с 35 миллиардами общих параметров и 3 миллиардами активных параметров на каждый токен. Он использует…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст27 апр. 2026 г.262K contextВводот5,2 ₽/MВыводот77 ₽/MКэшот14 ₽/M
Qwen: Qwen3.6 27BQwen3.6 27B — это плотная языковая модель с 27 миллиардами параметров, разработанная командой Qwen из Alibaba, выпущенная в апреле 2026 года. Она обладает гибридными мультимодальны…Вход: ТекстВход: ИзображенияВход: Видео→Выход: Текст27 апр. 2026 г.262K contextВводот33 ₽/MВыводот220 ₽/MКэшот3,12 ₽/M