157 models, 30 providers, one command to find what runs on hardware
Fast State-of-the-Art Static Embeddings
A high-quality rapid TTS voice cloning model
Fast ML inference & training for ONNX models in Rust
Lightning-fast, on-device TTS, running natively via ONNX
Real-time NVIDIA GPU dashboard
fast C++ library for GPU linear algebra & scientific computing
Calculate token/s & GPU memory requirement for any LLM
Generative Adversarial Networks for Efficient and High Fidelity Speech
Tiny pre-trained IBM model for multivariate time series forecasting