1/6
v2 · 第 0 步 · 10 分钟
训练前:底模已经会什么,还不会什么
此步目标:写出一份成功合同。没有「前」,「后」无法证明。
v2 和 v1 的差别
你不是在「训练一个会画人的模型」
SDXL 家族的写实底模已经会画亚洲面孔、会换衣服、会摆姿势。把参考图塞给 ChatGPT 或 IP-Adapter,也能「有点像」。那为什么还要训?因为那两条路每次生成都要再给参考,权重里没有「这个人」。你要的是一份可反复加载的补丁:换装换场景,仍更像同一个人。
所以本课的对象不是「更好看」,是「身份更稳」。好看是底模的审美,稳才是 LoRA 的职责。开训前必须留下底模快照,否则你分不清是运气、是参考图,还是补丁真的工作了。
点开看动画
互动 · 训前 / 训后
训练是为了修哪个失败,不是为了「跑完 1200 步」
底模已经会画人、会聊天。你花钱改的是一份补丁:让某一张脸稳定,或让某一种口吻稳定。没有训练前快照,训练后的「好像更好」只是感觉。
失败模式
底模会画「一个好看的人」,但换场景就换身份。IP-Adapter 每次都要再贴参考图,权重里没有「这个人」。
此刻出图
一张好看的亚洲女性,脸和训练集对不上。换 prompt 就换一张脸。
成功合同(开训前写上):6 条未见过的场景、同一 seed、关掉参考图,换装仍被认出;侧脸若数据里没有,允许失败,并记进下一轮补拍。
先拍照,再动刀:同一组 prompt / 同一组问题,底模答一遍存档。没有这组「前」,你无法证明补丁解决了问题,只能证明 loss 下降了。
三种「像」,只有一种值得训
每次贴参考图
- 不改权重
- 换工具就要再贴
- 适合试妆
- 评测时必须关掉,否则分不清功臣
提示词堆外貌
- 「精致五官、丹凤眼」
- 换一张脸也还能用这些词
- 锁不住身份
- 不要写进 caption
人物 LoRA
- 特征进 .safetensors
- 触发词当档案号
- 以后只加载底模 + 补丁
- 本课要验收的那条
过关清单
测一下
训完第一张出图就觉得「像了」,为什么还不能宣布成功?