mistralai logo
mistralai

Mistral: Voxtral Mini TTS

出典の説明(英語)

Voxtral Mini TTS is Mistral's text-to-speech model featuring zero-shot voice cloning and multilingual support. It converts text input into natural-sounding audio output.

概要

モデル仕様

コンテキスト
4,096 tokens
最大出力
3,276 tokens
アーキテクチャ
text->speech
トークナイザー
Mistral
知識カットオフ
情報なし
モデレーション
いいえ
OPENROUTER

料金の詳細

OpenRouterと同期した料金です。トークン料金は100万トークン単位です。

文字
$16
100万文字あたり
API

モデル設定

対応音声

en_paul_saden_paul_neutralen_paul_happyen_paul_frustrateden_paul_exciteden_paul_confidenten_paul_cheerfulen_paul_angrygb_oliver_neutralgb_oliver_sadgb_oliver_excitedgb_oliver_curiousgb_oliver_confidentgb_oliver_cheerfulgb_oliver_angrygb_jane_sarcasmgb_jane_confusedgb_jane_shamefulgb_jane_sadgb_jane_neutralgb_jane_jealousygb_jane_frustratedgb_jane_curiousgb_jane_confidentfr_marie_sadfr_marie_neutralfr_marie_happyfr_marie_excitedfr_marie_curiousfr_marie_angry
API

クイックスタート

ローカルにOPENROUTER_API_KEYを設定してください。Pythonにはrequestsが必要です。JavaScriptはNode.jsで実行し、キーはサーバー側で管理してください。

対応する音声を選択してください。一覧がない場合はYOUR_VOICE_IDを置き換えてください。

APIドキュメント

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"mistralai/voxtral-mini-tts-2603","input":"Hello!","voice":"en_paul_sad","response_format":"mp3"}' \
  --output speech.mp3
機能とモダリティ

入力出力

入力
text
出力
speech
API

対応APIパラメータ

利用可能なプロバイダー

3 プロバイダー

確認日: 2026年9月16日

OpenRouterでプロバイダーを見る

可用性、遅延、スループット、ルーティングは常時変化します。最新情報は出典ページで確認してください。

OpenRouter

Mistral

情報なし
コンテキスト
4K
最大出力
3K

Mistral

情報なし
コンテキスト
4K
最大出力
3K

Mistral

情報なし
コンテキスト
4K
最大出力
3K
mistralai

4 モデル

すべてのモデル
mistralai logomistralai

Mistral: Voxtral Small 24B 2507 STT

Voxtral Small 24B 2507 STT is a speech transcription model from Mistral AI. It is suited for transcription, translation, and audio understanding workloads that benefit from its larger model capacity.

コンテキスト
情報なし
入力
audio
出力
transcription
音声の長さ: $0.00005 1秒あたり
モデル詳細を見る
mistralai logomistralai

Mistral: Voxtral Mini 3B 2507

Voxtral Mini 3B 2507 is a speech and audio understanding model from Mistral AI. It is suited for transcription, translation, and compact audio processing workloads.

コンテキスト
情報なし
入力
audio
出力
transcription
音声の長さ: $0.000017 1秒あたり
モデル詳細を見る
mistralai logomistralai

Mistral: Voxtral Mini Transcribe

Voxtral Mini Transcribe is Mistral's speech-to-text model, derived from the Voxtral Mini family. It accepts audio input and returns transcribed text via the standard transcription API. Suited for transcribing meetings,...

コンテキスト
情報なし
入力
audio
出力
transcription
音声の長さ: $0.00005 1秒あたり
モデル詳細を見る
mistralai logomistralai

Mistral: Mistral Medium 3.5

Mistral Medium 3.5 is a dense 128B instruction-following model from Mistral AI. It supports text and image inputs with text output, and is designed for agentic workflows, coding, and complex...

コンテキスト
262K
入力
text · image · file
出力
text
入力: $1.5出力: $7.5100万トークンあたり
モデル詳細を見る