Audio foundation model excelling in audio understanding
Revolutionizing Database Interactions with Private LLM Technology
Qwen3-ASR is an open-source series of ASR models
Official code base for LeWorldModel: Stable End-to-End Joint-Embedding
Open-source industrial-grade ASR models
HY-Motion model for 3D character animation generation
Robust Speech Recognition Across Languages, Dialects
A Multi-Modal World Model for Reconstructing, Generating, Simulation
scikit-learn compatible tabular foundation model
VGGSfM: Visual Geometry Grounded Deep Structure From Motion
Open-source image generative foundation model
AI Suite for upscaling, interpolating & restoring images/videos
AI-powered tool to quickly remove watermarks from images flawlessly
ChatGLM-6B: An Open Bilingual Dialogue Language Model
Easy Docker setup for Stable Diffusion with user-friendly UI
Example Discord bot written in Python that uses the completions API
Let us control diffusion models
A GUI tool for generating subtitle from videos, generating srt files
Efficient Image Captioning code in Torch, runs on GPU