LlamaFactory
Getting Started
快速开始
Feature Guide
功能指南
数据准备
监督微调(SFT)
偏好优化(DPO)
奖励模型训练(RM)
批处理策略
分布式训练
优化器
模型保存与恢复
模型导出
推理
融合算子加速
Configuration
参数说明
数据参数
模型参数
训练参数
推理参数
Developer Guide
开发者指南
整体架构
Core(核心模块)
插件注册机制
插件实现
Multi-Backend
Ascend NPU
LlamaFactory
索引
索引