Block Diffusion for Ultra-Fast Speculative Decoding
A Customizable Image-to-Video Model based on HunyuanVideo
Multimodal model achieving SOTA performance
RGBD video generation model conditioned on camera input
Large-language-model & vision-language-model based on Linear Attention
Let us control diffusion models
Implementation of model parallel autoregressive transformers on GPUs
A library for Multilingual Unsupervised or Supervised word Embeddings
NVFP4 DiffusionGemma model for fast multimodal text generation
Multimodal agent model for coding, orchestration, and autonomy
High-performance MoE model with MLA, MTP, and multilingual reasoning