logo
微调
  1. DPO 实战:训练一个更符合业务偏好的模型

    AI
    LLM
    DPO
    微调
    偏好优化
  2. SFT 指令微调:数据格式、清洗与训练

    AI
    LLM
    SFT
    微调
    数据工程
  3. QLoRA 实战:在消费级显卡上微调模型

    AI
    LLM
    QLoRA
    LoRA
    微调
  4. LoRA 原理:低秩矩阵为什么能微调大模型

    AI
    LLM
    LoRA
    微调
    Transformer