google logo
google

Google: Gemini 3.5 Transcribe

Beschreibung der Quelle (Englisch)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

Überblick

Modellspezifikationen

Kontext
98.304 tokens
Maximale Ausgabe
32.768 tokens
Architektur
audio->transcription
Tokenizer
Gemini
Wissensstand
Nicht angegeben
Moderiert
Nein
OPENROUTER

Vollständige Preise

Mit OpenRouter synchronisierte Preise; Tokenpreise gelten pro eine Million Token.

Eingabe
$2
pro 1 Mio. Token
Ausgabe
$12
pro 1 Mio. Token
API

Schnellstart

Setzen Sie OPENROUTER_API_KEY lokal. Python benötigt requests; JavaScript läuft in Node.js. Bewahren Sie den Schlüssel auf dem Server auf.

API-Dokumentation

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
Fähigkeiten und Modalitäten

Eingabe → Ausgabe

Eingabe
audio
Ausgabe
transcription
API

Unterstützte API-Parameter

Verfügbare Anbieter

1 Anbieter

Geprüft: 25. September 2026

Live-Anbieter bei OpenRouter

Verfügbarkeit, Latenz, Durchsatz und Routing ändern sich laufend. Aktuelle Betriebsdaten stehen auf der Quellseite.

OpenRouter

Google AI Studio

Nicht angegeben
Kontext
98K
Maximale Ausgabe
33K
google

4 Modelle

Alle Modelle