google logo
google

Google: Gemini 3.5 Transcribe

Description de la source (anglais)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

Présentation

Caractéristiques du modèle

Contexte
98 304 tokens
Sortie maximale
32 768 tokens
Architecture
audio->transcription
Tokenizer
Gemini
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$2
par million de tokens
Sortie
$12
par million de tokens
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
Capacités et modalités

Entrée → Sortie

Entrée
audio
Sortie
transcription
API

Paramètres API pris en charge

Fournisseurs disponibles

1 Fournisseur

Vérifié: 25 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Google AI Studio

Non indiqué
Contexte
98K
Sortie maximale
33K
google

4 modèles

Tous les modèles