Axolotl
Axolotl 是面向训练数据、模型预训练、微调、对齐、实验或模型生命周期的 AI 模型训练工具。
分类:开源 LLM 后训练 / 配置式框架
公司 / 团队:Axolotl AI
详细介绍
该产品的主要能力包括SFT、全参数、LoRA、QLoRA、DPO、KTO、ORPO、GRPO、Reward Model、多模态、长序列、DeepSpeed、FSDP 和 Ray。
模型训练质量受到数据、模板、Tokenizer、超参数、并行策略、硬件、随机种子和评估方法影响。详情页应把支持模型、训练方法、硬件、数据格式、许可证、费用、版本和复现条件拆成动态字段维护。
适合场景
- 开源 LLM 和 VLM 微调
- 多节点训练
- 偏好优化
- 研究复现
- YAML 配置工作流
使用注意
- 功能和支持模型更新很快
- 配置项之间可能冲突
- 训练前应固定版本、保存完整 YAML 并验证数据模板
- 训练产物上线前应通过独立评测、安全测试、人工审核和真实流量灰度验证。