AI Trainer Academy
三级/高级 · 大模型训练与微调

93 课:LoRA 微调

LoRA 微调 从核心概念到训练师实战 大模型训练与微调 · 第 93 课 面向 AI 训练师 / 数据标注 / 智慧图书馆应用 理解概念 · 掌握流程 · 连接岗位 为什么学习《LoRA 微调》?…

LoRA 微调

从核心概念到训练师实战

大模型训练与微调 · 第 93 课

面向 AI 训练师 / 数据标注 / 智慧图书馆应用

理解概念 · 掌握流程 · 连接岗位


为什么学习《LoRA 微调》?

本课把“LoRA 微调”放入 AI 训练师的真实工作流中,帮助你从概念理解走向可执行的项目实践。

痛点一:概念不清

只记住名词,无法判断它在数据、模型或项目流程中的作用。

痛点二:流程不稳

知道要做什么,却缺少可复用的步骤、模板和质量检查标准。

痛点三:应用脱节

无法把课堂知识迁移到智慧图书馆、多语种数据和真实标注任务中。

学习目标:把知识点转化为可执行、可检查、可交付的训练任务。

学习目标

01 理解

说清本课核心概念、适用场景与边界条件。

02 操作

掌握关键流程、常用工具和基础检查方法。

03 应用

能把本课方法迁移到数据标注、质检、模型评估或项目管理中。

概念

是什么→

流程

怎么做→

交付

如何验收


93.1 什么是 LoRA?

LoRA(Low-Rank Adaptation):冻结预训练模型的大部分参数,只训练少量新增参数(适配器)

![](../img/C2_大模型训练与微调_m2.svg)

LoRA 的优势

  • 显存需求降低 80%(7B 模型从 56GB 降至 12GB)
  • 切换任务只需换适配器文件(10MB vs 7GB)

93.2 LoRA 微调实践

from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import LoraConfig, get_peft_model

# 加载基座模型
model = AutoModelForCausalLM.from_pretrained(
    'Qwen/Qwen2.5-7B-Instruct',
    torch_dtype='auto',
    device_map='auto'
)

# 配置 LoRA
lora_config = LoraConfig(
    r=8,              # 秩(典型值 8-64)
    lora_alpha=32,    # 缩放因子
    target_modules=['q_proj', 'v_proj'],  # 应用 LoRA 的层
    lora_dropout=0.1,
    bias='none',
    task_type='CAUSAL_LM'
)

model = get_peft_model(model, lora_config)
model.print_trainable_parameters()
# Trainable params: 8,388,608 / 7,000,000,000 ≈ 0.1%

93.3 LoRA 训练脚本

from datasets import Dataset
from transformers import TrainingArguments, Trainer

# 准备训练数据(SFT 格式)
train_data = Dataset.from_list([
    {"instruction": "判断情感", "input": "好产品", "output": "正向"},
    {"instruction": "判断情感", "input": "差评", "output": "负向"},
])

# 配置训练参数
training_args = TrainingArguments(
    output_dir='./qwen-lora',
    num_train_epochs=3,
    per_device_train_batch_size=4,
    gradient_accumulation_steps=4,
    learning_rate=2e-4,
    fp16=True,
    logging_steps=10,
)

trainer = Trainer(
    model=model,
    args=training_args,
    train_dataset=train_data,
)

trainer.train()
model.save_pretrained('./qwen-lora-final')

动手实践

任务1: 按课堂演示步骤独立完成操作

任务2: 尝试处理不同的数据/场景

任务3: 总结问题和注意事项


案例讨论

智慧图书馆场景应用

本节课方法如何在北二外图书馆使用?

  1. 需要准备什么数据?
  2. 选择什么方法/工具?
  3. 预期效果和挑战?

随堂测验

  1. 本节课最核心的方法/概念是什么?
  2. 解决了什么具体问题?
  3. 与传统方法比优势在哪?
  4. 实际应用中注意什么?

常见错误

错误1:概念混淆 — 不同概念混合

错误2:步骤遗漏 — 操作不完整

错误3:理解偏差 — 原理理解不准


本节课总结

掌握等级内容
必须掌握核心概念、关键方法
需要理解技术原理、适用场景
能够操作独立完成实践任务

课后作业

必做: 复述核心内容 + 完成练习 + 回答测验

选做: 查找行业案例 + 应用到项目

📤 下次课前提交


考试实操 13:任务单

项目要求
考核等级三级/高级:方案设计、模型优化、大模型数据与项目管理
业务场景准备大模型微调或评估数据
原始材料指令样本、偏好对、知识库文档
限时要求20 分钟完成小样本,40 分钟完成批量与质检
提交物jsonl数据 + 评测集 + 风险说明
评分重点:过程可复现、结果可检查、异常有记录。

考试实操 14:样本表设计

样本编号样本内容处理要求预期记录
S01instruction:请用中文解释馆际互借流程;answer:分步骤回答按标准流程处理正常样本
S02preference_pair:A回答有事实错误,B回答引用馆规查阅规则后处理边界说明
S03rag_doc:数据库使用说明第3段,需切分并写metadata标记并提交复核异常原因

要求:不得只写结论,必须写出判断依据或处理参数。


考试实操 15:小样本试跑

  1. 从材料中抽取 5 条代表样本:instruction:请用中文解释馆际互借流程;answer:分步骤回答preference_pair:A回答有事实错误,B回答引用馆规rag_doc:数据库使用说明第3段,需切分并写metadata 至少各覆盖 1 条。
  2. 先手工完成 2 条,确认“LoRA 微调”的口径、字段、工具设置没有歧义。
  3. 再执行:构造 5 条指令/偏好/RAG 样本,完成格式校验和安全检查。
  4. 将错例写入 error_cases.csv,字段包含:样本ID、错误类型、修正依据、复核人。
小样本试跑不过关,不进入批量处理。

考试实操 16:操作步骤

Step 1

读取题目材料:指令样本、偏好对、知识库文档。→Step 2

构造 5 条指令/偏好/RAG 样本,完成格式校验和安全检查。→Step 3

提交:jsonl数据 + 评测集 + 风险说明。

禁止操作:临时改标签、覆盖原始文件、不记录异常、只提交截图不交数据。


考试实操 17:质量检查清单

  • 原始数据已备份,处理文件另存为新版本
  • “LoRA 微调”相关规则已写入 README 或报告
  • 至少抽检 10% 样本,且覆盖边界样本
  • 指标检查:格式合规、指令清晰、事实核查
  • 所有异常样本都有编号、原因和处理意见
质检记录是考试给分点,不是可选项。

考试实操 18:错例分析

错误类型本课常见表现修正方法
口径错误“LoRA 微调”判断标准前后不一致回到规则表统一定义
格式错误文件字段、编码、命名不符合要求按模板重新导出
漏标漏处理边界样本未进入复核建立待确认列表
不可追溯没有记录参数、版本或来源补充处理日志

复盘要求:至少写 2 条错例及修正依据。


考试实操 19:智慧图书馆应用

场景

准备大模型微调或评估数据,服务对象为读者、馆员或科研团队。

数据

指令样本、偏好对、知识库文档,需注意来源、权限和个人信息。

处理

把“LoRA 微调”方法嵌入采集、标注、训练或评估流程。

验收

用 格式合规、指令清晰、事实核查 判断是否达到交付要求。


考试实操 20:评分细则

评分项分值扣分点
数据准备20来源不明、字段缺失、未备份
操作执行30步骤跳跃、参数错误、结果不可复现
质量检查30无抽检、无错例、无指标解释
交付规范20文件命名混乱、缺少README、无法打开
满分答案通常包含:结果 + 过程 + 质检 + 复盘。

考试实操 21:提交包结构

第93课_LoRA 微调_考试提交包/
├── raw/              # 原始材料,只读保存
├── output/           # jsonl数据 + 评测集 + 风险说明
├── qc/               # 抽检表、错例表、指标计算
├── screenshots/      # 关键步骤截图
└── README.md         # 工具版本、步骤、结论、风险

检查:压缩包解压后,阅卷老师能按 README 复现主要结果。


考试实操 22:限时训练

10 分钟版

  • 读题并建立 raw/output/qc 目录
  • 处理 3 条样本:正常、边界、异常各 1 条
  • 写出 1 条与“LoRA 微调”直接相关的边界规则

30 分钟版

  • 按要求完成:构造 5 条指令/偏好/RAG 样本,完成格式校验和安全检查
  • 做 10% 抽检并解释 格式合规、指令清晰、事实核查
  • 生成 jsonl数据 + 评测集 + 风险说明

60 分钟版

  • 批量处理 + 指标计算 + 质量报告
  • 给出下一轮优化建议

考试实操 23:口头答辩题

  1. 本课“LoRA 微调”任务的输入、输出分别是什么?
  2. 如果结果不达标,你会优先检查数据、规则、工具还是人员执行?为什么?
  3. 本次提交物如何证明可追溯?
  4. 在智慧图书馆项目中,哪些数据不能直接用于训练?
答辩时要结合样本编号和处理记录,不要只背概念。

考试实操 24:任务单

项目要求
考核等级三级/高级:方案设计、模型优化、大模型数据与项目管理
业务场景准备大模型微调或评估数据
原始材料指令样本、偏好对、知识库文档
限时要求20 分钟完成小样本,40 分钟完成批量与质检
提交物jsonl数据 + 评测集 + 风险说明
评分重点:过程可复现、结果可检查、异常有记录。

考试实操 25:样本表设计

样本编号样本内容处理要求预期记录
S01instruction:请用中文解释馆际互借流程;answer:分步骤回答按标准流程处理正常样本
S02preference_pair:A回答有事实错误,B回答引用馆规查阅规则后处理边界说明
S03rag_doc:数据库使用说明第3段,需切分并写metadata标记并提交复核异常原因

要求:不得只写结论,必须写出判断依据或处理参数。


考试实操 26:小样本试跑

  1. 从材料中抽取 5 条代表样本:instruction:请用中文解释馆际互借流程;answer:分步骤回答preference_pair:A回答有事实错误,B回答引用馆规rag_doc:数据库使用说明第3段,需切分并写metadata 至少各覆盖 1 条。
  2. 先手工完成 2 条,确认“LoRA 微调”的口径、字段、工具设置没有歧义。
  3. 再执行:构造 5 条指令/偏好/RAG 样本,完成格式校验和安全检查。
  4. 将错例写入 error_cases.csv,字段包含:样本ID、错误类型、修正依据、复核人。
小样本试跑不过关,不进入批量处理。

考试实操 27:操作步骤

Step 1

读取题目材料:指令样本、偏好对、知识库文档。→Step 2

构造 5 条指令/偏好/RAG 样本,完成格式校验和安全检查。→Step 3

提交:jsonl数据 + 评测集 + 风险说明。

禁止操作:临时改标签、覆盖原始文件、不记录异常、只提交截图不交数据。


考试实操 28:质量检查清单

  • 原始数据已备份,处理文件另存为新版本
  • “LoRA 微调”相关规则已写入 README 或报告
  • 至少抽检 10% 样本,且覆盖边界样本
  • 指标检查:格式合规、指令清晰、事实核查
  • 所有异常样本都有编号、原因和处理意见
质检记录是考试给分点,不是可选项。

考试实操 29:错例分析

错误类型本课常见表现修正方法
口径错误“LoRA 微调”判断标准前后不一致回到规则表统一定义
格式错误文件字段、编码、命名不符合要求按模板重新导出
漏标漏处理边界样本未进入复核建立待确认列表
不可追溯没有记录参数、版本或来源补充处理日志

复盘要求:至少写 2 条错例及修正依据。


考试实操 30:智慧图书馆应用

场景

准备大模型微调或评估数据,服务对象为读者、馆员或科研团队。

数据

指令样本、偏好对、知识库文档,需注意来源、权限和个人信息。

处理

把“LoRA 微调”方法嵌入采集、标注、训练或评估流程。

验收

用 格式合规、指令清晰、事实核查 判断是否达到交付要求。


大学生学习拓展:大模型训练与应用:RAG、SFT与LoRA

本页为大学生培训增强内容:把本课知识连接到真实校园、科研与就业场景。

拓展 1

大模型项目的核心是数据、评估和部署,不只是调用API。

拓展 2

大学生应理解RAG知识库构建、SFT样本、偏好数据、LoRA微调和模型评估。

拓展 3

本地化部署与国产模型选型是高校和图书馆场景的重要能力。


知识加餐:本课在AI项目中的位置

维度大学生需要掌握AI训练师工作对应
概念能用自己的话解释 LoRA 微调面向客户/团队讲清任务边界
操作能完成一个最小可运行任务形成可验收交付物
质量能发现错误、记录问题、复核结果支撑模型效果与责任追溯
合规能说明数据来源、隐私与版权风险满足项目审计和上线要求

课堂实训升级:从“听懂”到“做出来”

建议实训任务(三级/高级)

  • 构建一个小型RAG知识库,设计5个评估问题。
  • 写出SFT样本格式和LoRA微调方案。
交付物建议:数据文件 / 处理脚本 / 截图证据 / 1页说明 / 课堂展示。

工具链建议:国产模型 + 本地工具 + 可复现记录

数据与标注

Excel/WPS、Label Studio、CVAT、JSONL/CSV、抽样质检表。

模型与评估

Qwen、DeepSeek、BGE-M3、RAG、LoRA、F1/Recall/MRR等指标。

记录与展示

Jupyter、Markdown、Git/版本记录、PPT答辩、学习档案。


课堂讨论与课后反思

  1. 本课内容如果用于智慧图书馆,会服务哪个具体场景?
  2. 本课最容易出现的数据质量问题是什么?如何检查?
  3. 哪些数据不能直接进入训练或评估?为什么?
  4. 如何把本课成果放进个人作品集?
  5. 如果你是项目负责人,本课对应的验收指标是什么?