모델 사양
- 컨텍스트
- 1,048,576 tokens
- 최대 출력
- 65,535 tokens
- 아키텍처
- text+image+file+audio+video->text
- 토크나이저
- Gemini
- 지식 기준일
- 2025-01-31
- 검토됨
- 아니요
전체 가격
OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.
- 입력
- $0.15 백만 토큰당
- 출력
- $1.25 백만 토큰당
- 캐시 읽기
- $0.03 백만 토큰당
- 이미지 입력
- $0.15 백만 토큰당
- 오디오 입력
- $0.5 백만 토큰당
- Input Audio Cache
- $0.1 백만 토큰당
모델 구성
추론
- 추론 필수 여부
- 아니요
- 기본 매개변수
- 아니요
빠른 시작
로컬에 OPENROUTER_API_KEY를 설정하세요. Python에는 requests가 필요하며 JavaScript는 Node.js에서 실행됩니다. 키는 서버에 보관하세요.
기본 모델 ID로 비동기 배치를 제출합니다. 작업 ID는 제출 확인이며 완료를 뜻하지 않습니다.
curl --fail-with-body https://openrouter.ai/api/beta/batches \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"endpoint":"/v1/chat/completions","model":"google/gemini-2.5-flash","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'
# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
-H "Authorization: Bearer $OPENROUTER_API_KEY"입력 → 출력
아니요
지원 API 매개변수
include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p1 제공업체
확인일: 2026년 9월 18일
가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.
- 컨텍스트
- 1.0M
- 최대 출력
- 66K
- 입력
- $0.15
- 출력
- $1.25
- 캐시 읽기
- $0.03
- 캐시 쓰기
- 정보 없음