Miso TTS is an 8 billion, highly emotive text-to-speech model
MiniMax H3 inference engine for Mac computers
Robust Speech Recognition via Large-Scale Weak Supervision
Data manipulation and transformation for audio signal processing
Industrial-level controllable zero-shot text-to-speech system
A tool for transcoding lossless audio files
Audio codecs extracted from Android Open Source Project
mp3 decoder with multi-thread support
TorchMultimodal is a PyTorch library
Precise MPEG Audio
mp3 decoder with multi-thread support
A Conversational Speech Generation Model
Music Player Daemon SACD/DVD-A ISO decoder plugins
Ogg Vorbis decoder with multi-thread support
All-mode ham radio operations center: 9 modes TX, APRS, awards
Folder-based music player
Implementation of NÜWA, attention network for text to video synthesis
A Very Low-Bitrate Codec for Speech Compression
State-of-the-art deep learning based audio codec
Real Time Speech Enhancement in the Waveform Domain (Interspeech 2020)