Fish Audio · Audio
Fish Audio S2.1 Pro
Fish Audio's expressive TTS with inline emotion cues, multi-speaker synthesis in one call, and zero-shot voice cloning across 80+ languages.
From Fish Audio, Fish Audio S2.1 Pro is a cloud text-to-speech model. It converts written text into natural, spoken audio. Output is available as MP3, WAV, and FLAC. It runs through Runware using your own API key, from $0.015 per 1,000 characters.
Modality
Audio
Available on
Runware
Model ID
fishaudio/s2.1-pro
Specs
- Pricing
- $0.015 / 1k chars
- Type
- Text-to-speech
- Output formats
- MP3, WAV, FLAC
About the creator
Fish Audio
Fish Audio builds expressive speech models with inline emotion cues, multi-speaker synthesis, and zero-shot voice cloning across 80+ languages.
fish.audio ↗