Reproduction of Poetiq's record-breaking submission to the ARC-AGI-1
FAIR Sequence Modeling Toolkit 2
VGGSfM: Visual Geometry Grounded Deep Structure From Motion
State-of-the-art Image & Video CLIP, Multimodal Large Language Models
Language modeling in a sentence representation space
An AI-powered security review GitHub Action using Claude
GPT4V-level open-source multi-modal model based on Llama3-8B
A series of math-specific large language models of our Qwen2 series
Implementation of the Surya Foundation Model for Heliophysics
A SOTA open-source image editing model
Diversity-driven optimization and large-model reasoning ability
Chinese and English multimodal conversational language model
High-Fidelity and Controllable Generation of Textured 3D Assets
Multi-modal large language model designed for audio understanding
Open-source framework for intelligent speech interaction
Open-weight, large-scale hybrid-attention reasoning model
Large-language-model & vision-language-model based on Linear Attention
MedicalGPT: Training Your Own Medical GPT Model with ChatGPT Training
LLM-based Reinforcement Learning audio edit model
Capable of understanding text, audio, vision, video
FlashMLA: Efficient Multi-head Latent Attention Kernels
CodeGeeX: An Open Multilingual Code Generation Model (KDD 2023)
Memory-efficient and performant finetuning of Mistral's models
CodeGeeX2: A More Powerful Multilingual Code Generation Model
ChatGLM-6B: An Open Bilingual Dialogue Language Model