LlamaFactory

Getting Started

  • 快速开始

Feature Guide

  • 功能指南
  • 数据准备
  • 监督微调(SFT)
  • 偏好优化(DPO)
  • 奖励模型训练(RM)
  • 批处理策略
  • 分布式训练
  • 优化器
  • 模型保存与恢复
  • 模型导出
  • 推理
  • 融合算子加速

Configuration

  • 参数说明
  • 数据参数
  • 模型参数
  • 训练参数
  • 推理参数

Developer Guide

  • 开发者指南
  • 整体架构
  • Core(核心模块)
  • 插件注册机制
  • 插件实现

Multi-Backend

  • Ascend NPU
LlamaFactory
  • 搜索


© 版权所有 2024, LlamaFactory Team。

利用 Sphinx 构建,使用的 主题 由 Read the Docs 开发.