PaddleNLP
PaddleNLP 是面向训练数据、模型预训练、微调、对齐、实验或模型生命周期的 AI 模型训练工具。
分类:中文 NLP 与大模型训练 / 开源框架
公司 / 团队:PaddlePaddle / 百度
详细介绍
该产品的主要能力包括预训练、SFT、LoRA、QLoRA、DPO、RLHF、模型压缩、分布式训练、中文模型、PaddleFleet 和部署。
模型训练质量受到数据、模板、Tokenizer、超参数、并行策略、硬件、随机种子和评估方法影响。详情页应把支持模型、训练方法、硬件、数据格式、许可证、费用、版本和复现条件拆成动态字段维护。
适合场景
- 中文 NLP
- 大模型微调
- 国产 GPU/NPU
- 产业模型
- 研究和百度飞桨生态
使用注意
- Paddle、PaddleNLP 和硬件插件版本需匹配
- 不同模型示例成熟度不同
- 训练权重和数据许可证需核对
- 训练产物上线前应通过独立评测、安全测试、人工审核和真实流量灰度验证。