google logo
google

Google: Gemini 3.1 Flash TTS Preview

Descrição da fonte (inglês)

Gemini 3.1 Flash TTS Preview is a text-to-speech model from Google, and a substantial generational step up from Gemini 2.5 Flash TTS. It takes text input and produces audio output...

Visão geral

Especificações do modelo

Contexto
32.768 tokens
Saída máxima
16.384 tokens
Arquitetura
text->speech
Tokenizador
Gemini
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$1
por milhão de tokens de texto
Saída
$20
por milhão de tokens de áudio
API

Configuração do modelo

Vozes compatíveis

ZephyrPuckCharonKoreFenrirLedaOrusAoedeCallirrhoeAutonoeEnceladusIapetusUmbrielAlgiebaDespinaErinomeAlgenibRasalgethiLaomedeiaAchernarAlnilamSchedarGacruxPulcherrimaAchirdZubenelgenubiVindemiatrixSadachbiaSadaltagerSulafat
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Escolha uma voz compatível. Substitua YOUR_VOICE_ID se nenhuma voz estiver listada.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-3.1-flash-tts-preview","input":"Hello!","voice":"Zephyr","response_format":"mp3"}' \
  --output speech.mp3
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
speech
API

Parâmetros de API compatíveis

Provedores disponíveis

1 Provedor

Verificado: 16 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Google

Não informado
Contexto
33K
Saída máxima
16K
google

4 modelos

Todos os modelos
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.75Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.375Saída: $1.875por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.75Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.375Saída: $1.875por milhão de tokens
Ver detalhes do modelo