Audio
Explore models in this category β 15 models
jonatasgrosman
jonatasgrosman/wav2vec2-large-xlsr-53-japanese
16.8M88304.4M
hexgrad
hexgrad/Kokoro-82M
11.6M7K82M
argmaxinc
argmaxinc/whisperkit-coreml
10.9M2330
pyannote
pyannote/speaker-diarization-3.1
7.2M4K0
coqui
coqui/XTTS-v2
6.8M3.8K0
openai
openai/whisper-large-v3-turbo
6.4M3.4K808.9M
jonatasgrosman
jonatasgrosman/wav2vec2-large-xlsr-53-portuguese
5.7M58302M
pyannote
pyannote/speaker-diarization-community-1
5.4M2.2K0
openai
openai/whisper-large-v3
4.4M6.4K1.5B
pyannote
pyannote/voice-activity-detection
4.4M2410
Qwen
Qwen/Qwen3-ASR-1.7B
4.2M1.1K2.3B
Qwen
Qwen/Qwen3-ASR-0.6B
4.1M337938M
Systran
faster-whisper-large-v3
2.2M2.9K1.5B
Qwen
Qwen2-Audio 7B
607.9K5517.6B
mistralai
Voxtral Small 24B
245.8K51924B