HANS
Home
Demo
Blog
Plog
Résumé
Github
Demo
Blog
Plog
Résumé
Demo
Blog
Plog
Résumé
微调
DPO 实战:训练一个更符合业务偏好的模型
August 18, 2024
AI
LLM
DPO
微调
偏好优化
SFT 指令微调:数据格式、清洗与训练
July 21, 2024
AI
LLM
SFT
微调
数据工程
QLoRA 实战:在消费级显卡上微调模型
July 7, 2024
AI
LLM
QLoRA
LoRA
微调
LoRA 原理:低秩矩阵为什么能微调大模型
June 23, 2024
AI
LLM
LoRA
微调
Transformer