fish-audio logo
fish-audio

Fish Audio: Transcribe 1

Opis źródłowy (angielski)

Transcribe 1 is a speech-to-text model from Fish Audio. It is suited for audio transcription with automatic language detection and can return timestamped word-level segments when alignment details are requested.

Przegląd

Specyfikacja modelu

Kontekst
Brak danych
Maksymalne wyjście
Brak danych
Architektura
audio->transcription
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Czas audio
$0.0001
za sekundę
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=fish-audio/transcribe-1' \
  -F 'file=@audio.wav'
Możliwości i modalności

WejścieWyjście

Wejście
audio
Wyjście
transcription
API

Obsługiwane parametry API

Dostępni dostawcy

1 Dostawca

Sprawdzono: 7 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Fish Audio

Brak danych
Kontekst
Brak danych
Maksymalne wyjście
Brak danych
fish-audio

4 modele

Wszystkie modele
fish-audio logofish-audio

Fish Audio: S1

S1 is a multilingual text-to-speech model from Fish Audio. It is suited for voice applications that need broad emotional expression, using parenthetical controls to guide speaking style across its supported...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Bajty UTF-8: $15 za milion bajtów UTF-8
Zobacz szczegóły modelu
fish-audio logofish-audio

Fish Audio: S2 Pro

S2 Pro is a multilingual text-to-speech model from Fish Audio. It is suited for expressive narration and multi-speaker dialogue, with natural-language controls for speaking style and emotion.

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Bajty UTF-8: $15 za milion bajtów UTF-8
Zobacz szczegóły modelu
fish-audio logofish-audio

Fish Audio: S2.1 Pro Free (free)

S2.1 Pro Free is the no-cost variant of Fish Audio S2.1 Pro, intended for testing, prototyping, and low-volume applications. It provides the same synthesis capabilities without production latency or availability...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Wejście: Bezpłatnie za milion tokenówWyjście: Bezpłatnie za milion tokenów
Zobacz szczegóły modelu
fish-audio logofish-audio

Fish Audio: S2.1 Pro

S2.1 Pro is a production-oriented text-to-speech model from Fish Audio. It is suited for multilingual voice applications, expressive narration, and dialogue synthesis, with open-ended natural-language controls for speaking style and...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Bajty UTF-8: $15 za milion bajtów UTF-8
Zobacz szczegóły modelu