Unsloth
活跃简介
Unsloth Studio 是一个用于本地训练和运行开源大模型的 Web UI 工具,支持 Gemma 4、Qwen3.6、DeepSeek 等模型,为 Agent 开发者提供模型微调和部署能力。
核心特性
- 高效微调引擎 — 自定义 Triton 内核加速训练,速度提升 2x,显存降低 70%,无精度损失
- 多模态训练支持 — 支持文本、视觉、语音(TTS)、Embedding 模型的微调
- 强化学习(RL) — 支持 GRPO、FP8 等 RL 方法,显存占用降低 80%
- Unsloth Studio Web UI — 图形化界面搜索、下载、运行和导出 GGUF/safetensors 模型
- Data Recipes — 从 PDF、CSV、DOCX 等文件自动创建训练数据集,可视化节点编辑
- 广泛模型兼容 — 支持 500+ 模型,与 Qwen3、Llama 4、Gemma、gpt-oss 等团队直接合作修复 bug
适用场景
💡 本地微调开源大模型用于特定领域任务,如客服、代码生成、文档理解
💡 通过强化学习对齐模型行为,提升 Agent 的工具调用和推理能力
💡 构建本地 LLM 推理服务,通过 API 端点集成到 Claude Code 或 Codex 工具链
💡 从业务文档自动生成训练数据,快速构建领域专用模型
优势与不足
✅ 优势
- • 活跃维护,近期持续更新
- • 社区热度高(72.6k stars)
- • 开源许可证友好(Apache-2.0)
- • 项目有一定历史沉淀(已维护 2 年)
分类
快速开始
# macOS / Linux 安装 Unsloth Studio
curl -fsSL https://unsloth.ai/install.sh | sh
# 启动 Web UI(默认端口 8888)
unsloth studio -p 8888
# 或使用 Python 核心版本
pip install unsloth --torch-backend=auto