L
LlamaFactory
Apache-2.0PythonUnified Efficient Fine-Tuning of 100+ LLMs & VLMs (ACL 2024)
★ 74kFork 9k更新于 2026-07-29
Unified Efficient Fine-Tuning of 100+ LLMs & VLMs (ACL 2024)
LlamaFactory 是一个统一高效的大语言模型(LLM)和视觉语言模型(VLM)微调框架,支持 100 多种模型,包括 LLaMA、Qwen、DeepSeek、Gemma 等。它集成了多种训练方法,如全量微调、LoRA、QLoRA、DPO、PPO 等,并提供零代码的 CLI 和 Web UI(基于 Gradio),让用户轻松进行模型微调、推理和部署。该框架已被 Amazon、NVIDIA、阿里云等企业采用,并发表于 ACL 2024。
docker run -it --rm --gpus=all --ipc=host hiyouga/llamafactory:latest
支持 100+ 模型,包括 LLaMA、Qwen、DeepSeek、Gemma、GLM、Phi、Mistral、Mixtral、InternLM 等,具体列表见官方文档的 Supported Models 部分。
安装后可通过 CLI 命令 `llamafactory-cli train` 进行微调,或运行 `llamafactory-cli webui` 启动 Web 界面。详细步骤请参考官方 README 的 Getting Started 部分。
是的,支持 DeepSpeed 和 FSDP+QLoRA 等分布式训练方式,可在多 GPU 环境下高效微调大模型。
将数据集按指定格式(如 JSON 或 JSONL)准备,并在 `data/dataset_info.json` 中注册,然后在配置文件中指定数据集名称即可。