fish-audio logo
fish-audio

Fish Audio: S2.1 Pro Free (free)

Descrição da fonte (inglês)

S2.1 Pro Free is the no-cost variant of Fish Audio S2.1 Pro, intended for testing, prototyping, and low-volume applications. It provides the same synthesis capabilities without production latency or availability...

Visão geral

Especificações do modelo

Contexto
Não informado
Saída máxima
Não informado
Arquitetura
text->speech
Tokenizador
Other
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
Grátis
por milhão de tokens
Saída
Grátis
por milhão de tokens
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Escolha uma voz compatível. Substitua YOUR_VOICE_ID se nenhuma voz estiver listada.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"fish-audio/s2.1-pro-free:free","input":"Hello!","voice":"YOUR_VOICE_ID","response_format":"mp3"}' \
  --output speech.mp3
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
speech
API

Parâmetros de API compatíveis

Provedores disponíveis

1 Provedor

Verificado: 7 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Fish Audio

Não informado
Contexto
Não informado
Saída máxima
Não informado
fish-audio

4 modelos

Todos os modelos
fish-audio logofish-audio

Fish Audio: Transcribe 1

Transcribe 1 is a speech-to-text model from Fish Audio. It is suited for audio transcription with automatic language detection and can return timestamped word-level segments when alignment details are requested.

Contexto
Não informado
Entrada
audio
Saída
transcription
Duração do áudio: $0.0001 por segundo
Ver detalhes do modelo
fish-audio logofish-audio

Fish Audio: S1

S1 is a multilingual text-to-speech model from Fish Audio. It is suited for voice applications that need broad emotional expression, using parenthetical controls to guide speaking style across its supported...

Contexto
Não informado
Entrada
text
Saída
speech
Bytes UTF-8: $15 por milhão de bytes UTF-8
Ver detalhes do modelo
fish-audio logofish-audio

Fish Audio: S2 Pro

S2 Pro is a multilingual text-to-speech model from Fish Audio. It is suited for expressive narration and multi-speaker dialogue, with natural-language controls for speaking style and emotion.

Contexto
Não informado
Entrada
text
Saída
speech
Bytes UTF-8: $15 por milhão de bytes UTF-8
Ver detalhes do modelo
fish-audio logofish-audio

Fish Audio: S2.1 Pro

S2.1 Pro is a production-oriented text-to-speech model from Fish Audio. It is suited for multilingual voice applications, expressive narration, and dialogue synthesis, with open-ended natural-language controls for speaking style and...

Contexto
Não informado
Entrada
text
Saída
speech
Bytes UTF-8: $15 por milhão de bytes UTF-8
Ver detalhes do modelo