Datasets
Dataset
common_voice_22_0
by fsicoli
Dataset Card for Common Voice Corpus 22. 0 This dataset is an unofficial version of the Mozilla Common Voice Corpus 22.
CC0-1.0automatic-speech-recognition 24435 19100B < n < 1T rows
published 27 Jun 2025
Preview
Cannot get the config names for the dataset.
Cite this
CC0-1.0Cite
Tags
task_categories:automatic-speech-recognitionlanguage:ablanguage:aflanguage:amlanguage:arlanguage:aslanguage:astlanguage:azlanguage:balanguage:baslanguage:belanguage:bglanguage:bnlanguage:brlanguage:calanguage:ckblanguage:cnhlanguage:cslanguage:cvlanguage:cylanguage:dalanguage:delanguage:dvlanguage:dyulanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:gllanguage:gnlanguage:halanguage:helanguage:hilanguage:hsblanguage:hu