microsoft logo
microsoft

Microsoft: MAI-Transcribe 1.5

MAI-Transcribe 1.5 is a multilingual speech-to-text model from Microsoft AI. Priced at $0.36 per hour. 0 token context window.

Przegląd

Specyfikacja modelu

Kontekst
Brak danych
Maksymalne wyjście
Brak danych
Architektura
audio->transcription
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Audio Hours
$0.36
/hour
API

Szybki start

Wywołaj ten model przez zgodne z OpenAI API OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"microsoft/mai-transcribe-1.5","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
audio
Wyjście
transcription
API

Obsługiwane parametry API

max_completion_tokensmax_tokenstemperaturetop_p
Dostępni dostawcy

1 Dostawca

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Azure

unknown
Kontekst
Brak danych
Maksymalne wyjście
Brak danych
Wejście
$360000.00
Wyjście
Bezpłatnie
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
microsoft

modele

Wszystkie modele
microsoft logomicrosoft

Microsoft: MAI-Image-2.5 Pro

Microsoft's MAI-Image-2.5 is a high-quality image generation model available via Azure AI Foundry. It produces photorealistic and artistic images from text prompts with support for various aspect ratios.

Kontekst
4K
Wejście
text · image
Wyjście
image
Wejście: $5.00Wyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
microsoft logomicrosoft

Microsoft: MAI-Voice-2-Flash

MAI-Voice-2-Flash is a low-latency text-to-speech model from Microsoft for voice agents, assistants, call centers, accessibility, narration, and other interactive applications. It generates expressive 24 kHz mono speech across 15 languages...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Wejście: $15.00Wyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
microsoft logomicrosoft

Microsoft: MAI-Voice-2

MAI-Voice-2 is an expressive text-to-speech model from Microsoft. It is suited for conversational assistants, media narration, accessibility, education, and other long-form voice applications. It supports 15 languages across 18 locales,...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Wejście: $22.00Wyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
microsoft logomicrosoft

Microsoft: MAI-Image-2.5

Microsoft's MAI-Image-2.5 is a high-quality image generation model available via Azure AI Foundry. It produces photorealistic and artistic images from text prompts with support for various aspect ratios.

Kontekst
4K
Wejście
text · image
Wyjście
image
Wejście: $5.00Wyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu