All Audio Models [37]

Browse All Audio AI models on Segmind. Compare pricing, latency, and capabilities.

All Audio
Text To Audio
Coming Soon

Seed Audio 2.0

Text To Audio

Sarvam Bulbul v3 TTS

1.7s
Text To Audio

Lyria 3 Pro

35.4s
Text To Audio

Lyria 3

16.0s
Text To Audio

Kokoro 82M

1.9s
Audio To Text

Whisper Large V3

9.5s
Text To Audio

Sonilo Text to Audio

16.4s
Video To Audio

Sonilo Video to Audio

30.9s
Text To Audio

Seed Audio 1.0

27.7s
Text To Audio

Grok Text-to-Speech

5.6s
Text To Audio

Gemini 3.1 Flash TTS

12.4s
Text To Audio

Sam Audio Large

11.0s
Text To Audio

Gemini TTS 2.5 Flash

10.3s
Text To Audio

Gemini TTS 2.5 Pro

17.0s
Text To Audio

Chatterbox Turbo TTS

6.7s
Audio To Text

TTS Elevenlabs With Timing

2.9s
Audio To Text

Elevenlabs Forced Alignment

0.7s
Audio To Audio

Elevenlabs Audio Isolation

4.1s
Audio To Text

Elevenlabs Dialogue With Timing

3.7s
Audio To Text

Elevenlabs Voice Design

21.0s
Audio To Text

Elevenlabs Voice Cloning

9.3s
Text To Audio

Elevenlabs Dialogue

6.8s
Text To Audio

VeenaMax TTS

13.0s
Text To Audio

Veena TTS

45.2s
Text To Audio

Chatterbox TTS

19.6s
Text To Audio

Lyria 2

33.0s
Text To Audio

Ace Step Music

10.7s
Text To Audio

Dia (Text to Speech)

13.7s
Text To Audio

3B Orpheus TTS (0.1)

6.2s
Audio To Text

Elevenlabs Transcript

3.3s
Text To Audio

Meta MusicGen Medium

31.5s
Text To Audio

MyShell Text To Speech

8.3s
Text To Audio

Openvoice

17.0s
Text To Audio

ElevenLabs Dubbing

81.0s
Text To Audio

Elevenlabs Sound Generation

4.4s
Audio To Audio

Elevenlabs Speech To Speech

5.8s
Text To Audio

Elevenlabs Text To Speech

8.7s

Every Model that you need and more