Open access
Aug 2026
Speech-to-text model comparison using XLS-R, XLSR-53, and Wav2Vec 2.0
Findings indicate that language-specific fine-tuning plays a more critical role than multilingual generalization in achieving accurate ASR for Indonesian and provide practical guidance for deploying ASR systems in low-resource language scenarios.
Juan Hebert, Amalia Zahra
· Bulletin of Electrical Engin... · 0 citations