fish-audio logo
fish-audio

Fish Audio: S2.1 Pro

Description de la source (anglais)

S2.1 Pro is a production-oriented text-to-speech model from Fish Audio. It is suited for multilingual voice applications, expressive narration, and dialogue synthesis, with open-ended natural-language controls for speaking style and...

Présentation

Caractéristiques du modèle

Contexte
Non indiqué
Sortie maximale
Non indiqué
Architecture
text->speech
Tokenizer
Other
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Octets UTF-8
$15
par million d’octets UTF-8
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Choisissez une voix compatible. Remplacez YOUR_VOICE_ID si aucune voix n’est indiquée.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"fish-audio/s2.1-pro","input":"Hello!","voice":"YOUR_VOICE_ID","response_format":"mp3"}' \
  --output speech.mp3
Capacités et modalités

EntréeSortie

Entrée
text
Sortie
speech
API

Paramètres API pris en charge

Fournisseurs disponibles

1 Fournisseur

Vérifié: 7 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Fish Audio

Non indiqué
Contexte
Non indiqué
Sortie maximale
Non indiqué
fish-audio

4 modèles

Tous les modèles
fish-audio logofish-audio

Fish Audio: Transcribe 1

Transcribe 1 is a speech-to-text model from Fish Audio. It is suited for audio transcription with automatic language detection and can return timestamped word-level segments when alignment details are requested.

Contexte
Non indiqué
Entrée
audio
Sortie
transcription
Durée audio: $0.0001 par seconde
Voir la fiche du modèle
fish-audio logofish-audio

Fish Audio: S1

S1 is a multilingual text-to-speech model from Fish Audio. It is suited for voice applications that need broad emotional expression, using parenthetical controls to guide speaking style across its supported...

Contexte
Non indiqué
Entrée
text
Sortie
speech
Octets UTF-8: $15 par million d’octets UTF-8
Voir la fiche du modèle
fish-audio logofish-audio

Fish Audio: S2 Pro

S2 Pro is a multilingual text-to-speech model from Fish Audio. It is suited for expressive narration and multi-speaker dialogue, with natural-language controls for speaking style and emotion.

Contexte
Non indiqué
Entrée
text
Sortie
speech
Octets UTF-8: $15 par million d’octets UTF-8
Voir la fiche du modèle
fish-audio logofish-audio

Fish Audio: S2.1 Pro Free (free)

S2.1 Pro Free is the no-cost variant of Fish Audio S2.1 Pro, intended for testing, prototyping, and low-volume applications. It provides the same synthesis capabilities without production latency or availability...

Contexte
Non indiqué
Entrée
text
Sortie
speech
Entrée: Gratuit par million de tokensSortie: Gratuit par million de tokens
Voir la fiche du modèle