fish-audio logo
fish-audio

Fish Audio: S1

Descripción de la fuente (inglés)

S1 is a multilingual text-to-speech model from Fish Audio. It is suited for voice applications that need broad emotional expression, using parenthetical controls to guide speaking style across its supported...

Resumen

Especificaciones del modelo

Contexto
No indicado
Salida máxima
No indicado
Arquitectura
text->speech
Tokenizador
Other
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Bytes UTF-8
$15
por millón de bytes UTF-8
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Elige una voz compatible. Sustituye YOUR_VOICE_ID si no se indica ninguna voz.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/v1/audio/speech \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"fish-audio/s1","input":"Hello!","voice":"YOUR_VOICE_ID","response_format":"mp3"}' \
  --output speech.mp3
Capacidades y modalidades

EntradaSalida

Entrada
text
Salida
speech
API

Parámetros API compatibles

Proveedores disponibles

1 Proveedor

Verificado: 7 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

Fish Audio

No indicado
Contexto
No indicado
Salida máxima
No indicado
fish-audio

4 modelos

Todos los modelos
fish-audio logofish-audio

Fish Audio: Transcribe 1

Transcribe 1 is a speech-to-text model from Fish Audio. It is suited for audio transcription with automatic language detection and can return timestamped word-level segments when alignment details are requested.

Contexto
No indicado
Entrada
audio
Salida
transcription
Duración del audio: $0.0001 por segundo
Ver detalles del modelo
fish-audio logofish-audio

Fish Audio: S2 Pro

S2 Pro is a multilingual text-to-speech model from Fish Audio. It is suited for expressive narration and multi-speaker dialogue, with natural-language controls for speaking style and emotion.

Contexto
No indicado
Entrada
text
Salida
speech
Bytes UTF-8: $15 por millón de bytes UTF-8
Ver detalles del modelo
fish-audio logofish-audio

Fish Audio: S2.1 Pro Free (free)

S2.1 Pro Free is the no-cost variant of Fish Audio S2.1 Pro, intended for testing, prototyping, and low-volume applications. It provides the same synthesis capabilities without production latency or availability...

Contexto
No indicado
Entrada
text
Salida
speech
Entrada: Gratis por millón de tokensSalida: Gratis por millón de tokens
Ver detalles del modelo
fish-audio logofish-audio

Fish Audio: S2.1 Pro

S2.1 Pro is a production-oriented text-to-speech model from Fish Audio. It is suited for multilingual voice applications, expressive narration, and dialogue synthesis, with open-ended natural-language controls for speaking style and...

Contexto
No indicado
Entrada
text
Salida
speech
Bytes UTF-8: $15 por millón de bytes UTF-8
Ver detalles del modelo