fish-audio logo
fish-audio

Fish Audio: S1

Opis źródłowy (angielski)

S1 is a multilingual text-to-speech model from Fish Audio. It is suited for voice applications that need broad emotional expression, using parenthetical controls to guide speaking style across its supported...

Przegląd

Specyfikacja modelu

Kontekst
Brak danych
Maksymalne wyjście
Brak danych
Architektura
text->speech
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Bajty UTF-8
$15
za milion bajtów UTF-8
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Wybierz obsługiwany głos. Zastąp YOUR_VOICE_ID, jeśli nie podano głosu.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"fish-audio/s1","input":"Hello!","voice":"YOUR_VOICE_ID","response_format":"mp3"}' \
  --output speech.mp3
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
speech
API

Obsługiwane parametry API

Dostępni dostawcy

1 Dostawca

Sprawdzono: 7 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Fish Audio

Brak danych
Kontekst
Brak danych
Maksymalne wyjście
Brak danych
fish-audio

4 modele

Wszystkie modele
fish-audio logofish-audio

Fish Audio: Transcribe 1

Transcribe 1 is a speech-to-text model from Fish Audio. It is suited for audio transcription with automatic language detection and can return timestamped word-level segments when alignment details are requested.

Kontekst
Brak danych
Wejście
audio
Wyjście
transcription
Czas audio: $0.0001 za sekundę
Zobacz szczegóły modelu
fish-audio logofish-audio

Fish Audio: S2 Pro

S2 Pro is a multilingual text-to-speech model from Fish Audio. It is suited for expressive narration and multi-speaker dialogue, with natural-language controls for speaking style and emotion.

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Bajty UTF-8: $15 za milion bajtów UTF-8
Zobacz szczegóły modelu
fish-audio logofish-audio

Fish Audio: S2.1 Pro Free (free)

S2.1 Pro Free is the no-cost variant of Fish Audio S2.1 Pro, intended for testing, prototyping, and low-volume applications. It provides the same synthesis capabilities without production latency or availability...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Wejście: Bezpłatnie za milion tokenówWyjście: Bezpłatnie za milion tokenów
Zobacz szczegóły modelu
fish-audio logofish-audio

Fish Audio: S2.1 Pro

S2.1 Pro is a production-oriented text-to-speech model from Fish Audio. It is suited for multilingual voice applications, expressive narration, and dialogue synthesis, with open-ended natural-language controls for speaking style and...

Kontekst
Brak danych
Wejście
text
Wyjście
speech
Bajty UTF-8: $15 za milion bajtów UTF-8
Zobacz szczegóły modelu