它主打在消费级 GPU 上做模型微调,官方称训练速度最高可提升 2 倍,显存占用降低约 70%。
① 支持 Qwen、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等模型
② LoRA、QLoRA、全量微调、RL、GRPO、DPO、FP8 都支持
③ Windows、macOS、Linux 都能用,也支持 AMD、Intel GPU
④ 可导出 GGUF、FP8,并提供 OpenAI 兼容 API
⑤ 能直接给 Claude Code、Codex 等 Agent 当本地推理后端
从训练到部署基本都能在本地完成,想自己折腾模型的话,这个可以留意。
🔗 https://github.com/unslothai/unsloth