unslothai/unsloth

GitHub 2026-08-15T03:01:43.616055

项目简介

unsloth 是一个本地优先的 AI 模型训练与推理 UI,让 LLM 与扩散模型在消费级 GPU 上快速微调并直接运行。它的核心能力在于:用自定义算子内核将微调速度提升数倍、显存占用减少约 80%;同时覆盖从 Qwen、Gemma、DeepSeek 到 FLUX、Diffusion 的多种模型形态;并提供 OpenAI 兼容 API 和图形化界面,让开发者以极低成本完成模型训练、部署与 Agent 化对接。

技术亮点

架构解析

整体为三层架构:底层是核心优化引擎,基于 Triton 手写高性能内核,对注意力计算、前馈网络、低秩适配器做逐算子融合,大幅压缩计算图开销。中间层是模型适配层,将 Hugging Face Transformers、Diffusers、PEFT 封装为统一的模型加载与训练入口,自动识别模型类型并选择合适的算子布局。顶层是本地 UI 与 API 网关,提供模型管理、训练过程监控、对话测试、OpenAI 兼容接口和自托管的 Web 服务,让用户既能在浏览器内直观操作,也能以代码方式远程调用。整体设计强调训练、推理、服务一体化,减少工具链割裂。

适用场景

生态对比

延伸阅读

项目信息

查看原文