google logo
google

Google: Gemini 3.5 Transcribe

Descrição da fonte (inglês)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

Visão geral

Especificações do modelo

Contexto
98.304 tokens
Saída máxima
32.768 tokens
Arquitetura
audio->transcription
Tokenizador
Gemini
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$2
por milhão de tokens
Saída
$12
por milhão de tokens
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
Recursos e modalidades

Entrada → Saída

Entrada
audio
Saída
transcription
API

Parâmetros de API compatíveis

Provedores disponíveis

1 Provedor

Verificado: 25 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Google AI Studio

Não informado
Contexto
98K
Saída máxima
33K
google

4 modelos

Todos os modelos