MAI-Voice-2.1-Flash — это модель преобразования текста в речь с малой задержкой от Microsoft AI, оптимизированная для реагирования в реальном времени. Он воспроизводит естественную, выразительную речь на 23 языках с человеческой интонацией, ритмом и эмоциональными нюансами. Он подходит для голосовых агентов, помощников, колл-центров и других интерактивных приложений, где задержка и стоимость имеют наибольшее значение. В OpenRouter установите для голоса полный голосовой идентификатор с суффиксом модели, например «en-US-Harper:MAI-Voice-2.1-Flash». Локаль голоса задает язык синтеза. Установите для параметра response_format значение «mp3» или «pcm» (моно 24 кГц). Харпер и Грант поддерживают стили речи агента, колл-центра, обучения и рассказчика, а многие местные голоса добавляют стили эмоций, такие как возбуждение, счастье, грусть и шепот. Полный список голосов находится в поле support_voices API моделей. См. руководство по преобразованию текста в речь.
Модальности
Цена вводаза 1M токенов ввода
Ввод1 681 ₽/M
Контекст—
Релиз1 окт. 2026 г.
Доступные площадки
Модель доступна на этих площадках.
Вы можете выбрать конкретную площадку, провайдера, обеспечивающего доступ к ней, либо воспользоваться нашими типовыми правилами маршрутизации.
| Площадка | Провайдер | Вход |
|---|---|---|
| Azure n/a | лучший провайдер: 1routerai | 1 656 ₽/M |
| второй провайдер: 2ru_openrouter | 1 681 ₽/M | |
| — |
Бенчмарки
Для этой модели пока нет опубликованных результатов бенчмарков.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI: укажите base_url LLM Mart. В примере уже подставлен slug: microsoft/mai-voice-2.1-flash.
curl -s "https://llmmart.ru/api/v1/audio/speech" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "microsoft/mai-voice-2.1-flash",
"input": "Привет!",
"voice": "alloy"
}' \
-o speech.mp3from openai import OpenAI
client = OpenAI(
api_key="sk-...", # API-ключ из личного кабинета
base_url="https://llmmart.ru/api/v1",
)
response = client.audio.speech.create(
model="microsoft/mai-voice-2.1-flash",
voice="alloy",
input="Привет! Это тест синтеза речи.",
)
response.stream_to_file("speech.mp3")import { writeFile } from "fs/promises";
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.LLM_ROUTER_API_KEY,
baseURL: "https://llmmart.ru/api/v1",
});
const audio = await client.audio.speech.create({
model: "microsoft/mai-voice-2.1-flash",
voice: "alloy",
input: "Привет! Это тест синтеза речи.",
});
await writeFile("speech.mp3", Buffer.from(await audio.arrayBuffer()));Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.
Ещё модели от Microsoft
- 33K contextВводот4,25 ₽/M
- Ввод2 465 ₽/M
- 4K contextВводот561 ₽/MВыводот4 257 ₽/Mизображениеот8,2 ₽/шт
- 4K contextВводот196 ₽/MВыводот2 129 ₽/Mизображениеот8,2 ₽/шт
- минутаот0,19 ₽/мин
- 4K contextВводот561 ₽/MВыводот12 100 ₽/Mизображениеот68 ₽/шт
- Вводот1 681 ₽/M
- Вводот2 465 ₽/M
- минутаот0,67 ₽/мин
- 4K contextВводот561 ₽/MВыводот5 266 ₽/Mизображениеот68 ₽/шт
- 16K contextВводот7,43 ₽/MВыводот16 ₽/M
- 66K contextВводот69 ₽/MВыводот69 ₽/M