Categories
AI News iRaluca

One Dataset Now Holds More Open Speech Than Everything Else Combined

ESPnet just released 1.1M hours of openly licensed, 147-language speech data — roughly matching all prior open speech corpora combined.