mistralai logo
mistralai

Mistral: Voxtral Mini 3B 2507

Descripción de la fuente (inglés)

Voxtral Mini 3B 2507 is a speech and audio understanding model from Mistral AI. It is suited for transcription, translation, and compact audio processing workloads.

Resumen

Especificaciones del modelo

Contexto
No indicado
Salida máxima
No indicado
Arquitectura
audio->transcription
Tokenizador
Mistral
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Duración del audio
$0.000017
por segundo
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=mistralai/voxtral-mini-3b-2507' \
  -F 'file=@audio.wav'
Capacidades y modalidades

EntradaSalida

Entrada
audio
Salida
transcription
API

Parámetros API compatibles

Proveedores disponibles

1 Proveedor

Verificado: 16 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

DeepInfra

bf16
Contexto
No indicado
Salida máxima
No indicado
mistralai

4 modelos

Todos los modelos
mistralai logomistralai

Mistral: Voxtral Small 24B 2507 STT

Voxtral Small 24B 2507 STT is a speech transcription model from Mistral AI. It is suited for transcription, translation, and audio understanding workloads that benefit from its larger model capacity.

Contexto
No indicado
Entrada
audio
Salida
transcription
Duración del audio: $0.00005 por segundo
Ver detalles del modelo
mistralai logomistralai

Mistral: Voxtral Mini Transcribe

Voxtral Mini Transcribe is Mistral's speech-to-text model, derived from the Voxtral Mini family. It accepts audio input and returns transcribed text via the standard transcription API. Suited for transcribing meetings,...

Contexto
No indicado
Entrada
audio
Salida
transcription
Duración del audio: $0.00005 por segundo
Ver detalles del modelo
mistralai logomistralai

Mistral: Mistral Medium 3.5

Mistral Medium 3.5 is a dense 128B instruction-following model from Mistral AI. It supports text and image inputs with text output, and is designed for agentic workflows, coding, and complex...

Contexto
262K
Entrada
text · image · file
Salida
text
Entrada: $1.5Salida: $7.5por millón de tokens
Ver detalles del modelo
mistralai logomistralai

Mistral: Mistral Medium 3.5 (batch)

Mistral Medium 3.5 is a dense 128B instruction-following model from Mistral AI. It supports text and image inputs with text output, and is designed for agentic workflows, coding, and complex...

Contexto
262K
Entrada
text · image · file
Salida
text
Entrada: $0.75Salida: $3.75por millón de tokens
Ver detalles del modelo