Speech Recognition
shenasa-ai/speech2text
A Deep-Learning-Based Persian Speech Recognition System
Jupyter NotebookMITupdated May 22, 2023
Automatic Speech Recognition (ASR) - German
$ git clone https://github.com/AASHISHAG/deepspeech-german.gitA Deep-Learning-Based Persian Speech Recognition System
WhisperX: Automatic Speech Recognition with Word-level Timestamps (& Diarization)
kaldi-asr/kaldi is the official location of the Kaldi project.
Gradio WebUI for creators and developers, featuring key TTS (Edge-TTS, kokoro) and zero-shot Voice Cloning (E2 & F5-TTS, CosyVoice), with Whisper audio processing, YouTube download, Demucs vocal isolation, and multilingual translation.
Data from GitHub ยท snapshot Sep 24, 2026