Audio foundation model excelling in audio understanding
Revolutionizing Database Interactions with Private LLM Technology
Qwen3-ASR is an open-source series of ASR models
Official code base for LeWorldModel: Stable End-to-End Joint-Embedding
Open-source industrial-grade ASR models
super expressive prompting model based on ltx2.3
HY-Motion model for 3D character animation generation
Robust Speech Recognition Across Languages, Dialects
A Multi-Modal World Model for Reconstructing, Generating, Simulation
scikit-learn compatible tabular foundation model
VGGSfM: Visual Geometry Grounded Deep Structure From Motion
Open-source image generative foundation model
ChatGLM-6B: An Open Bilingual Dialogue Language Model
Easy Docker setup for Stable Diffusion with user-friendly UI
Runtime extension of Proximus enabling Deployment on AMD Ryzen™ AI
Example Discord bot written in Python that uses the completions API
Let us control diffusion models
A GUI tool for generating subtitle from videos, generating srt files
Efficient Image Captioning code in Torch, runs on GPU
Custom BLEURT model for evaluating text similarity using PyTorch
Portuguese ASR model fine-tuned on XLSR-53 for 16kHz audio input
Tiny pre-trained IBM model for multivariate time series forecasting
Russian ASR model fine-tuned on Common Voice and CSS10 datasets