Audio
Explore models in this category — 13 models
hexgrad
hexgrad/Kokoro-82M
12M6.7K82M
argmaxinc
argmaxinc/whisperkit-coreml
9.2M2000
pyannote
pyannote/speaker-diarization-3.1
9.1M3.1K0
coqui
coqui/XTTS-v2
8.7M3.7K0
openai
openai/whisper-large-v3-turbo
7.9M3.2K808.9M
jonatasgrosman
jonatasgrosman/wav2vec2-large-xlsr-53-japanese
5.8M62304.4M
pyannote
pyannote/speaker-diarization-community-1
5.5M1K0
openai
openai/whisper-large-v3
5M6.1K1.5B
jonatasgrosman
jonatasgrosman/wav2vec2-large-xlsr-53-portuguese
4.9M55302M
Qwen
Qwen/Qwen3-ASR-0.6B
4.1M330938M
Systran
faster-whisper-large-v3
2.2M2.9K1.5B
Qwen
Qwen2-Audio 7B
607.9K5517.6B
mistralai
Voxtral Small 24B
245.8K51924B