Foundational video generation model with 13.6B parameters
Chinese and English multimodal conversational language model
Handwritten Text Recognition (HTR) system implemented with TensorFlow
Unsupervised Learning for Image Registration
Semi-Structured Agentic Framework. Workflows build themselves
RGBD video generation model conditioned on camera input
Unleashing 10,000+ Word Generation from Long Context LLMs
The best ChatGPT that $100 can buy
ImageBind One Embedding Space to Bind Them All
Trainable, memory-efficient, and GPU-friendly PyTorch reproduction
A Unified Framework for Image Customization
A fast TTS architecture with conditional flow matching
Constrained Value Alignment via Safe Reinforcement Learning
ChatGLM2-6B: An Open Bilingual Chat LLM
Open Multilingual Multimodal Chat LMs
Synchronized Translation for Videos
VITS2 backbone with multilingual-bert
Official code for Style Aligned Image Generation via Shared Attention
Official release of InternLM series
Clarity in the current fast-paced mess of Open Source innovation
Neural machine translation and sequence learning using TensorFlow
Libraries for optimizing AI models, inference speed, and GPU usage
CPT: A Pre-Trained Unbalanced Transformer
GLIDE: a diffusion-based text-conditional image synthesis model
A CLI tool/python module for generating images from text