google logo
google

Google: Gemini 3.5 Transcribe

Descripción de la fuente (inglés)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

Resumen

Especificaciones del modelo

Contexto
98.304 tokens
Salida máxima
32.768 tokens
Arquitectura
audio->transcription
Tokenizador
Gemini
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$2
por millón de tokens
Salida
$12
por millón de tokens
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
Capacidades y modalidades

Entrada → Salida

Entrada
audio
Salida
transcription
API

Parámetros API compatibles

Proveedores disponibles

1 Proveedor

Verificado: 25 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

Google AI Studio

No indicado
Contexto
98K
Salida máxima
33K
google

4 modelos

Todos los modelos