AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
View all Papers Organization Card
Hugging Face for Audio š§
A one-stop shop for all things Audio at HF. Stay tuned for loads of interesting updates!
šØOpen ASR Leaderboard - OUT NOWW!
-
Open ASR Leaderboard configuration for Transformers š¤ models
š1Run evaluation on your ML model and get performance metrics
-
Open ASR Leaderboard configuration for NVIDIA NeMo ASR models
š1Run evaluation scripts for language model performance
-
Open ASR Leaderboard configuration for Boson's Higgs Audio v3
šDisplay a webābased directory listing of files and folders
-
Open ASR Leaderboard configuration for Phi4
šNormalize and evaluate your text data
Transformer supported versions of X-Codec models: https://github.com/zhenye234/xcodec?tab=readme-ov-file#available-models
-
hf-audio/xcodec-hubert-general-balanced
Feature Extraction ⢠0.2B ⢠Updated ⢠773 ⢠3 -
hf-audio/xcodec-wavlm-more-data
Feature Extraction ⢠0.2B ⢠Updated ⢠1.21k ⢠1 -
hf-audio/xcodec-wavlm-mls
Feature Extraction ⢠0.2B ⢠Updated ⢠715 -
hf-audio/xcodec-hubert-general
Feature Extraction ⢠0.2B ⢠Updated ⢠9.65k
-
Open ASR Leaderboard configuration for Transformers š¤ models
š1Run evaluation on your ML model and get performance metrics
-
Open ASR Leaderboard configuration for NVIDIA NeMo ASR models
š1Run evaluation scripts for language model performance
-
Open ASR Leaderboard configuration for Boson's Higgs Audio v3
šDisplay a webābased directory listing of files and folders
-
Open ASR Leaderboard configuration for Phi4
šNormalize and evaluate your text data
Transformer supported versions of X-Codec models: https://github.com/zhenye234/xcodec?tab=readme-ov-file#available-models
-
hf-audio/xcodec-hubert-general-balanced
Feature Extraction ⢠0.2B ⢠Updated ⢠773 ⢠3 -
hf-audio/xcodec-wavlm-more-data
Feature Extraction ⢠0.2B ⢠Updated ⢠1.21k ⢠1 -
hf-audio/xcodec-wavlm-mls
Feature Extraction ⢠0.2B ⢠Updated ⢠715 -
hf-audio/xcodec-hubert-general
Feature Extraction ⢠0.2B ⢠Updated ⢠9.65k
spaces 35
pinned
Running on CPU Upgrade
Agents
Featured
1.49k
Open ASR Leaderboard
š
Compare speechātoātext models across datasets
pinned
Running
Agents
43
Open TTS Leaderboard
š£
Listen to and rate TTS model audio samples
Running
Open TTS Leaderboard API evaluation environment
š
Running
Open ASR Leaderboard configuration for Phonon2
š
Running
Open ASR Leaderboard configuration for TheWhisper
š
Normalize and evaluate text data for NLP tasks
Sleeping
Open ASR Leaderboard configuration for Soundsgood AI's Zipformer Model
š
Evaluate and normalize audio files with AI tools
models 10
hf-audio/vocos-encodec-24khz
10.1M ⢠Updated ⢠20 ⢠2
hf-audio/vocos-mel-24khz
13.5M ⢠Updated ⢠32 ⢠2
hf-audio/xcodec2
Audio-to-Audio ⢠0.8B ⢠Updated ⢠21 ⢠7
hf-audio/xcodec-hubert-general-balanced
Feature Extraction ⢠0.2B ⢠Updated ⢠773 ⢠3
hf-audio/xcodec-hubert-general
Feature Extraction ⢠0.2B ⢠Updated ⢠9.65k
hf-audio/xcodec-wavlm-mls
Feature Extraction ⢠0.2B ⢠Updated ⢠715
hf-audio/xcodec-hubert-librispeech
Feature Extraction ⢠0.2B ⢠Updated ⢠828 ⢠1
hf-audio/xcodec-wavlm-more-data
Feature Extraction ⢠0.2B ⢠Updated ⢠1.21k ⢠1
hf-audio/w2v-bert-2.0-mongolian-colab-CV16.0
Automatic Speech Recognition ⢠0.6B ⢠Updated ⢠31 ⢠1
hf-audio/wav2vec2-bert-CV16-en
Automatic Speech Recognition ⢠0.6B ⢠Updated ⢠1.49k ⢠8
datasets 8
hf-audio/multilingual_evals
Preview ⢠Updated ⢠4.15k
hf-audio/open-asr-leaderboard-results
Viewer ⢠Updated ⢠63 ⢠13k ⢠2
hf-audio/open-asr-leaderboard
Benchmark ⢠Updated ⢠126k ⢠25.1k ⢠85
hf-audio/leaderboard_longform
Viewer ⢠Updated ⢠27 ⢠2.16k
hf-audio/open-asr-leaderboard-multilingual-datasets
Viewer ⢠Updated ⢠118k ⢠1.46k ⢠4
hf-audio/asr-leaderboard-longform
Viewer ⢠Updated ⢠169 ⢠1.25k ⢠7
hf-audio/gradient_accumulation_example
Viewer ⢠Updated ⢠1 ⢠393
hf-audio/esb-datasets-test-only
Updated ⢠53 ⢠5