google logo
google

Google: Gemini 3.5 Transcribe

Descrizione della fonte (inglese)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

Panoramica

Specifiche del modello

Contesto
98.304 tokens
Output massimo
32.768 tokens
Architettura
audio->transcription
Tokenizer
Gemini
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$2
per milione di token
Output
$12
per milione di token
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
Capacità e modalità

Input → Output

Input
audio
Output
transcription
API

Parametri API supportati

Provider disponibili

1 Provider

Verificato: 25 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Google AI Studio

Non indicato
Contesto
98K
Output massimo
33K
google

4 modelli

Tutti i modelli