google logo
google

Google: Gemini 3.5 Transcribe

출처 설명 (영어)

Gemini 3.5 Transcribe is a speech-to-text model from Google. It is suited for synchronous transcription that needs word-level timestamps or speaker diarization, with support for up to eight speakers. Audio...

개요

모델 사양

컨텍스트
98,304 tokens
최대 출력
32,768 tokens
아키텍처
audio->transcription
토크나이저
Gemini
지식 기준일
정보 없음
검토됨
아니요
OPENROUTER

전체 가격

OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.

입력
$2
백만 토큰당
출력
$12
백만 토큰당
API

빠른 시작

로컬에 OPENROUTER_API_KEY를 설정하세요. Python에는 requests가 필요하며 JavaScript는 Node.js에서 실행됩니다. 키는 서버에 보관하세요.

API 문서

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=google/gemini-3.5-transcribe' \
  -F 'file=@audio.wav'
기능 및 모달리티

입력 → 출력

입력
audio
출력
transcription
API

지원 API 매개변수

사용 가능한 제공업체

1 제공업체

확인일: 2026년 9월 25일

OpenRouter 실시간 제공업체

가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.

OpenRouter

Google AI Studio

정보 없음
컨텍스트
98K
최대 출력
33K
google

4 개 모델

모든 모델