fish-audio logo
fish-audio

Fish Audio: S2.1 Pro Free (free)

Descrizione della fonte (inglese)

S2.1 Pro Free is the no-cost variant of Fish Audio S2.1 Pro, intended for testing, prototyping, and low-volume applications. It provides the same synthesis capabilities without production latency or availability...

Panoramica

Specifiche del modello

Contesto
Non indicato
Output massimo
Non indicato
Architettura
text->speech
Tokenizer
Other
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
Gratuito
per milione di token
Output
Gratuito
per milione di token
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Scegli una voce supportata. Sostituisci YOUR_VOICE_ID se non sono elencate voci.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"fish-audio/s2.1-pro-free:free","input":"Hello!","voice":"YOUR_VOICE_ID","response_format":"mp3"}' \
  --output speech.mp3
Capacità e modalità

InputOutput

Input
text
Output
speech
API

Parametri API supportati

Provider disponibili

1 Provider

Verificato: 7 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Fish Audio

Non indicato
Contesto
Non indicato
Output massimo
Non indicato
fish-audio

4 modelli

Tutti i modelli
fish-audio logofish-audio

Fish Audio: Transcribe 1

Transcribe 1 is a speech-to-text model from Fish Audio. It is suited for audio transcription with automatic language detection and can return timestamped word-level segments when alignment details are requested.

Contesto
Non indicato
Input
audio
Output
transcription
Durata audio: $0.0001 al secondo
Vedi i dettagli del modello
fish-audio logofish-audio

Fish Audio: S1

S1 is a multilingual text-to-speech model from Fish Audio. It is suited for voice applications that need broad emotional expression, using parenthetical controls to guide speaking style across its supported...

Contesto
Non indicato
Input
text
Output
speech
Byte UTF-8: $15 per milione di byte UTF-8
Vedi i dettagli del modello
fish-audio logofish-audio

Fish Audio: S2 Pro

S2 Pro is a multilingual text-to-speech model from Fish Audio. It is suited for expressive narration and multi-speaker dialogue, with natural-language controls for speaking style and emotion.

Contesto
Non indicato
Input
text
Output
speech
Byte UTF-8: $15 per milione di byte UTF-8
Vedi i dettagli del modello
fish-audio logofish-audio

Fish Audio: S2.1 Pro

S2.1 Pro is a production-oriented text-to-speech model from Fish Audio. It is suited for multilingual voice applications, expressive narration, and dialogue synthesis, with open-ended natural-language controls for speaking style and...

Contesto
Non indicato
Input
text
Output
speech
Byte UTF-8: $15 per milione di byte UTF-8
Vedi i dettagli del modello