1/6

v2 · 0 步 · 10 分钟

训练前:底模已经会什么,还不会什么

此步目标:写出一份成功合同。没有「前」,「后」无法证明。

v2 和 v1 的差别

你不是在「训练一个会画人的模型」

SDXL 家族的写实底模已经会画亚洲面孔、会换衣服、会摆姿势。把参考图塞给 ChatGPT 或 IP-Adapter,也能「有点像」。那为什么还要训?因为那两条路每次生成都要再给参考,权重里没有「这个人」。你要的是一份可反复加载的补丁:换装换场景,仍更像同一个人。

所以本课的对象不是「更好看」,是「身份更稳」。好看是底模的审美,稳才是 LoRA 的职责。开训前必须留下底模快照,否则你分不清是运气、是参考图,还是补丁真的工作了。

点开看动画

互动 · 训前 / 训后

训练是为了修哪个失败,不是为了「跑完 1200 步」

底模已经会画人、会聊天。你花钱改的是一份补丁:让某一张脸稳定,或让某一种口吻稳定。没有训练前快照,训练后的「好像更好」只是感觉。

失败模式

底模会画「一个好看的人」,但换场景就换身份。IP-Adapter 每次都要再贴参考图,权重里没有「这个人」。

此刻出图

一张好看的亚洲女性,脸和训练集对不上。换 prompt 就换一张脸。

成功合同(开训前写上):6 条未见过的场景、同一 seed、关掉参考图,换装仍被认出;侧脸若数据里没有,允许失败,并记进下一轮补拍。

先拍照,再动刀:同一组 prompt / 同一组问题,底模答一遍存档。没有这组「前」,你无法证明补丁解决了问题,只能证明 loss 下降了。

三种「像」,只有一种值得训

每次贴参考图

  • 不改权重
  • 换工具就要再贴
  • 适合试妆
  • 评测时必须关掉,否则分不清功臣

提示词堆外貌

  • 「精致五官、丹凤眼」
  • 换一张脸也还能用这些词
  • 锁不住身份
  • 不要写进 caption

人物 LoRA

  • 特征进 .safetensors
  • 触发词当档案号
  • 以后只加载底模 + 补丁
  • 本课要验收的那条

过关清单

测一下

训完第一张出图就觉得「像了」,为什么还不能宣布成功?