mistralai logo
mistralai

Mistral: Voxtral Mini 3B 2507

Descrizione della fonte (inglese)

Voxtral Mini 3B 2507 is a speech and audio understanding model from Mistral AI. It is suited for transcription, translation, and compact audio processing workloads.

Panoramica

Specifiche del modello

Contesto
Non indicato
Output massimo
Non indicato
Architettura
audio->transcription
Tokenizer
Mistral
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Durata audio
$0.000017
al secondo
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=mistralai/voxtral-mini-3b-2507' \
  -F 'file=@audio.wav'
Capacità e modalità

InputOutput

Input
audio
Output
transcription
API

Parametri API supportati

Provider disponibili

1 Provider

Verificato: 16 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

DeepInfra

bf16
Contesto
Non indicato
Output massimo
Non indicato
mistralai

4 modelli

Tutti i modelli
mistralai logomistralai

Mistral: Voxtral Small 24B 2507 STT

Voxtral Small 24B 2507 STT is a speech transcription model from Mistral AI. It is suited for transcription, translation, and audio understanding workloads that benefit from its larger model capacity.

Contesto
Non indicato
Input
audio
Output
transcription
Durata audio: $0.00005 al secondo
Vedi i dettagli del modello
mistralai logomistralai

Mistral: Voxtral Mini Transcribe

Voxtral Mini Transcribe is Mistral's speech-to-text model, derived from the Voxtral Mini family. It accepts audio input and returns transcribed text via the standard transcription API. Suited for transcribing meetings,...

Contesto
Non indicato
Input
audio
Output
transcription
Durata audio: $0.00005 al secondo
Vedi i dettagli del modello
mistralai logomistralai

Mistral: Mistral Medium 3.5

Mistral Medium 3.5 is a dense 128B instruction-following model from Mistral AI. It supports text and image inputs with text output, and is designed for agentic workflows, coding, and complex...

Contesto
262K
Input
text · image · file
Output
text
Input: $1.5Output: $7.5per milione di token
Vedi i dettagli del modello
mistralai logomistralai

Mistral: Mistral Medium 3.5 (batch)

Mistral Medium 3.5 is a dense 128B instruction-following model from Mistral AI. It supports text and image inputs with text output, and is designed for agentic workflows, coding, and complex...

Contesto
262K
Input
text · image · file
Output
text
Input: $0.75Output: $3.75per milione di token
Vedi i dettagli del modello