A Customizable Image-to-Video Model based on HunyuanVideo
Moonshot's most powerful AI model
Block Diffusion for Ultra-Fast Speculative Decoding
RGBD video generation model conditioned on camera input
Multimodal model achieving SOTA performance
FAIR Sequence Modeling Toolkit 2
Large-language-model & vision-language-model based on Linear Attention
A state-of-the-art open visual language model
Let us control diffusion models
Implementation of model parallel autoregressive transformers on GPUs
An implementation of model parallel GPT-2 and GPT-3-style models
A library for Multilingual Unsupervised or Supervised word Embeddings
NVFP4 DiffusionGemma model for fast multimodal text generation
Multimodal agent model for coding, orchestration, and autonomy
High-performance MoE model with MLA, MTP, and multilingual reasoning