1/6
第 0 步 · 8 分钟
先问清楚:你到底要微调什么
此步目标:能判断自己的需求该用 RAG、该用提示词,还是真的该微调。
微调教的是行为,不是百科
对话微调用「问题 → 理想回答」教模型怎么说话:更短、更像你、按表格输出、扮演一个角色。它不会可靠地记住「公司本周价格表」。事实会过期,应该去查,而不是写进权重。
和人物 LoRA 的对照:图像侧用 24 张图锁一张脸;文本侧用几百到几千条对话锁一种风格。两边都是低秩补丁,两边都会过拟合。
三种手段,别用错
提示词 / 系统设定
- 零训练
- 适合临时人设
- 长了会忘
- 格式偶尔会飘
RAG 检索
- 塞进最新文档
- 适合制度、价格、手册
- 不改性格
- 回答可追溯来源
SFT 微调
- 改口吻和格式
- 适合大量重复话术
- 要准备成对数据
- 事实仍应外挂检索
测一下
想让模型「用我的语气回复客户,并引用本周库存」——正确组合是?