Portuguese ASR model fine-tuned on XLSR-53 for 16kHz audio input
Russian ASR model fine-tuned on Common Voice and CSS10 datasets
Multimodal Transformer for document image understanding and layout
ClinicalBERT model trained on MIMIC notes for clinical NLP tasks