功能指南
功能指南面向使用 v1 完成训练与推理任务的用户。配置结构、默认值和可用选项统一放在参数配置。
训练任务
页面 |
内容 |
|---|---|
Messages 格式、数据集 YAML 和 converter |
|
全参、LoRA、Freeze、QLoRA |
|
DPO、ORPO、SimPO 与偏好数据 |
|
奖励模型训练 |
训练效率与扩展
页面 |
内容 |
|---|---|
四种 batching strategy |
|
FSDP2、FSDPTurbo、DeepSpeed、Ulysses |
|
AdamW 与 Muon 配置 |
|
Liger、融合算子和组合配置 |
模型保存与使用
页面 |
内容 |
|---|---|
最终模型、checkpoint、断点续训 |
|
LoRA 合并和 HF 格式导出 |
|
CLI 对话与 adapter 加载 |