DeepSeek 4 Flash local inference engine for Metal
Run GLM-5.2 (744B MoE) on a 25GB-RAM consumer machine
A 2.78-trillion-parameter Kimi K3 running inference on a single CPU
Run a 1-billion parameter LLM on a $10 board with 256MB RAM
Run the full 2.78-trillion-parameter Kimi K3 model
Llama 2 Everywhere (L2E)