方法论与洞察

物品先分档,像素级换工具 · 学员答疑案例 v1

入档:2026-08-27 触发:学员答疑——「MJ 如何控制物品的一致性」。作者初判「MJ 不擅长这个」,查库后确认方向对,但需要补一层精度 验证状态:综合档,零新实测 ⚠️。全部证据来自库内既有档案(逐条标注来源);本档新增的只有两样——编排(三档分级)与一条待验证推论(物品比脸好锁,见 §二) 性质:把「角色一致性」这条线的既有规律,整体迁移到「物品」这个新对象上


一句话

先问学员要的是哪一档:同款调性 / 跨图可辨认 / 像素级同一件。前两档 MJ 用描述锚定 + 三重锁定做得到,而且比锁脸容易;第三档 MJ 没有通道,必须换工具——在 MJ 上死磕只是丢一致性加拖时间。


案例底料

学员问:「MJ 如何控制物品的一致性?」 作者初判:「MJ 不擅长这个。」

方向对,但直接这么答会把学员劝到错误的方向上。 他听完会以为这事在 MJ 上完全没法做,于是要么转去死磕 sref(那是错的通道,见 §三),要么整个放弃;而他实际要的多半是中档,MJ 做得到。

这与 动作错做减法_风格错辨顺逆_学员答疑案例_v1 是同一类教学失误的镜像:那次是把工具天花板当成 prompt 问题去调,这次是把 prompt 能解决的事当成工具天花板去劝退。两个方向都错,判据都是先分类。


一、先分档(答疑第一动作)

档位学员真正想要的MJ 能不能做走哪条路
同一类物件、同款调性✅ 轻松纯描述锚定
跨图一眼认得出是「那把伞」✅ 做得到,要验收唯一真源文本 + 三重锁定 + 逐张验收(§四)
像素级同一件(商品图 / IP 周边 / 连续分镜)❌ 无通道换工具,MJ 只做环境镜(§五)

学员十次里有八次要的是中档,但嘴上说的是强档。 先把这一格问清楚,比给方法更重要——这一步没分,后面给的所有方法都会被用在错误的档位上。


二、为什么物品其实比脸好锁(本档新增推论 ⚠️)

装扮签名vs五官精度 的实测数据:同一段描述词跑 4 个全新场景——

该档给出的机制是:能被语言精确传递的才锁得住。五官是非语言的,写多少字都传不过去;而装扮件是几何 + 材质 + 颜色 + 结构,恰好全都是语言的强项。

本档的推论:那 4/4 锁住的三样东西,本身就是物品。所以「物品一致性」不是角色一致性的更难版本,而是它已经被验证过的那一半——难的那一半(脸)恰恰不是物品。

这条推论也解释了为什么「MJ 不擅长」这句话容易误导:它把角色一致性的困难度整体转移给了物品,而困难度并不在物品这边。

⚠️ 推论的边界(所以标未验证):装扮件是挂在人身上、与人同框、有固定佩戴位置的物品——人体本身就是它的环境参照。独立成图的物品(一把伞单独占满画面、一件商品正面特写)少了这个参照,是否同样 4/4,库内没有对照数据。列入待回验。


三、强档为什么真的做不到:MJ 没有物品参考通道

逐条盘点 MJ 的四个可能通道,没有一个能承担「像素级同一件」:

通道现状来源
oref只在 --v 7 可用,v8.1 明确不支持,v8.2 是否支持标着未测oref与sref的工具版本与挂载方式 · MJ_v8.1_无oref_混合工作流 · MJ_v8.2_行为档案_v1 §5
oref(退回 v7 硬用)高方差,当抽卡游戏:一次至少 8-12 张、默认大半要丢;且库内只验证过锁,锁物品无数据oref高方差律
sref写死了:管质感氛围,不管主体身份MJ_v8.2_行为档案_v1 §3
拉高 --sw 抢救机制上不可能:reference 只能传参考图里存在的信息,权重旋钮调的是已有信号强度,不是缺失信号的补全;拉高只会强化「这个维度可以缺席」参考图缺失维度不可继承律_v1

所以「MJ 不擅长」这句话的准确范围是:MJ 不擅长像素级复现同一件物品。 加上这个限定词,学员才不会把中档一起放弃掉。


四、中档四条操作(可直接给学员)

1. 物品锁定段只写一处,跨图逐字复制

MiniMaxH3_行为规律_v1 第六条原话:两个镜头必须是同一把伞,各写一遍描述,必然漂。做法是把物品描述当成一个变量存下来,每张图原样粘贴,一个字都不重写。

单锚点优于三视图_v1 把同一件事又推进了一步:能写清楚的写成文字,并显式声明文字优先于图——那个项目的旗袍形制(立领 / 右衽 / 一列盘扣 / 短袖 / 收腰)全部写在文本里,并写明「即使参考图里看不见,也以文字为准」。理由是文字是确定性的,图是采样出来的:同一段描述每次装配一模一样,而每一张图都带方差。

这条对物品尤其顺——物品的形制几乎可以 100% 文字化,不像脸有一部分永远只能交给图。

2. 关键属性走三重锁定

MJ关键属性三重锁定律_v1:正向锚 + 负向排除 + 环境参照。弱信号词单独用必漂,而且弱信号的范围比直觉大——数字、单个形容词、以及 narrow / thin / small / low / lower third 这类相对尺寸与位置词都算。

该档 2026-08-23 那次跨项目验证还暴露了一个更难缠的性质:四张图的偏差方向完全一致(全部厚到 ~17%)。这不是随机漂移,是模型对该词有它自己稳定的理解——「多抽几张」解决不了

配套的减法纪律见 prompt极简化原则_v1已有prompt的七步体检律_v1:只锁「错了就返工」的属性,先减后加。

3. 辨识锚要挑模型画得稳的特征,不是挑你验起来方便的

这条是学费换的,两个独立案例同向:

迁移到物品上:优先选轮廓 / 色块 / 材质 / 结构件数量这类体积大、结构性强的特征;单颗铆钉、一道划痕、一枚小吊坠这类点状细节,位置控不住,别拿来当辨识锚。

4. 三个具体写法(MJ_v8.1_无oref_混合工作流 实测)

症状错的写法对的写法
材质出不来(形容词弱权重)snowflakes with metallic sheentiny metallic silver shards mixed with snow particles —— 把材质做成视觉元素本身
尺寸不听话small markersthree small bright white circular markers, about 2 percent of the frame width each —— 形容词 + 量化,12/12 全稳
数量失控(single/one 执行率约 50%)a single lanterna single lantern and no other lanterns anywhere in the entire frame

五、强档的正确出路:换工具,MJ 退到环境镜

双工具分工_nano锁脸+MJ摄影质感_v1 的分工公式直接可用,把「脸」替换成「那件物品」逻辑不变:

这一镜要不要出现那件必须一致的物品?

   ├── 要 → nano / GPT Image 2(图生图,不重绘主体)

   └── 不要 → MJ(摄影质感最大化,自由发挥)

该档同时写死了一条陷阱,原样适用:「nano 跑不出来时换 MJ 试试」是错的——MJ 没有一致性通道,换了等于丢一致性,只会拖时间。工具归属要在 plan 阶段就标好,不要在出图阶段反复犹豫。

配套好消息:moodboard跨题材审美迁移_v1 实测过,无人体的静物 / 物件题可以大胆挂人物 moodboard 借审美,不触发 NSFW,能整体抬高出图天花板。物品题恰好落在这一格。


六、两条验收纪律

  1. 颜色单独列一条验收项。 单锚点优于三视图_v1 的反例值得原样转述:旗袍设定是靛蓝,封面阶段偏成墨黑,当时判断「差别看不见、不值得为它冒险返工」,结果 40 镜全是墨黑一路带到成片,歌词里唯一的颜色锚点(「像旧邮票发蓝」「你没带走的蓝衫」)作废。颜色最容易在上游漂掉且没人发现。
  2. 把验收放在最便宜的那一步。 同档:静图阶段 2 积分拦掉的两次身份事故,如果直接赌视频就是两次 64 积分。一致性的观感,很大程度上是「你拦掉了多少张不一致的图」,而不是「模型有多稳」。

待回验


关联文档


版本

升级触发:

类型/方法论工具/MJ主题/prompt方法来源/学员答疑