google logo
google

Google: Gemini 3.5 Transcribe

Opis źródłowy (angielski)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

Przegląd

Specyfikacja modelu

Kontekst
98 304 tokens
Maksymalne wyjście
32 768 tokens
Architektura
audio->transcription
Tokenizer
Gemini
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$2
za milion tokenów
Wyjście
$12
za milion tokenów
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
Możliwości i modalności

Wejście → Wyjście

Wejście
audio
Wyjście
transcription
API

Obsługiwane parametry API

Dostępni dostawcy

1 Dostawca

Sprawdzono: 25 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Google AI Studio

Brak danych
Kontekst
98K
Maksymalne wyjście
33K
google

4 modele

Wszystkie modele