物品先分档,像素级换工具 · 学员答疑案例 v1
入档:2026-08-27 触发:学员答疑——「MJ 如何控制物品的一致性」。作者初判「MJ 不擅长这个」,查库后确认方向对,但需要补一层精度 验证状态:综合档,零新实测 ⚠️。全部证据来自库内既有档案(逐条标注来源);本档新增的只有两样——编排(三档分级)与一条待验证推论(物品比脸好锁,见 §二) 性质:把「角色一致性」这条线的既有规律,整体迁移到「物品」这个新对象上
一句话
先问学员要的是哪一档:同款调性 / 跨图可辨认 / 像素级同一件。前两档 MJ 用描述锚定 + 三重锁定做得到,而且比锁脸容易;第三档 MJ 没有通道,必须换工具——在 MJ 上死磕只是丢一致性加拖时间。
案例底料
学员问:「MJ 如何控制物品的一致性?」 作者初判:「MJ 不擅长这个。」
方向对,但直接这么答会把学员劝到错误的方向上。 他听完会以为这事在 MJ 上完全没法做,于是要么转去死磕 sref(那是错的通道,见 §三),要么整个放弃;而他实际要的多半是中档,MJ 做得到。
这与 动作错做减法_风格错辨顺逆_学员答疑案例_v1 是同一类教学失误的镜像:那次是把工具天花板当成 prompt 问题去调,这次是把 prompt 能解决的事当成工具天花板去劝退。两个方向都错,判据都是先分类。
一、先分档(答疑第一动作)
| 档位 | 学员真正想要的 | MJ 能不能做 | 走哪条路 |
|---|---|---|---|
| 弱 | 同一类物件、同款调性 | ✅ 轻松 | 纯描述锚定 |
| 中 | 跨图一眼认得出是「那把伞」 | ✅ 做得到,要验收 | 唯一真源文本 + 三重锁定 + 逐张验收(§四) |
| 强 | 像素级同一件(商品图 / IP 周边 / 连续分镜) | ❌ 无通道 | 换工具,MJ 只做环境镜(§五) |
学员十次里有八次要的是中档,但嘴上说的是强档。 先把这一格问清楚,比给方法更重要——这一步没分,后面给的所有方法都会被用在错误的档位上。
二、为什么物品其实比脸好锁(本档新增推论 ⚠️)
装扮签名vs五官精度 的实测数据:同一段描述词跑 4 个全新场景——
- 具体五官:0/4 锁住
- 装扮件(双侧白花 / 流苏耳坠 / 烟白汉服):4/4 锁住
该档给出的机制是:能被语言精确传递的才锁得住。五官是非语言的,写多少字都传不过去;而装扮件是几何 + 材质 + 颜色 + 结构,恰好全都是语言的强项。
本档的推论:那 4/4 锁住的三样东西,本身就是物品。所以「物品一致性」不是角色一致性的更难版本,而是它已经被验证过的那一半——难的那一半(脸)恰恰不是物品。
这条推论也解释了为什么「MJ 不擅长」这句话容易误导:它把角色一致性的困难度整体转移给了物品,而困难度并不在物品这边。
⚠️ 推论的边界(所以标未验证):装扮件是挂在人身上、与人同框、有固定佩戴位置的物品——人体本身就是它的环境参照。独立成图的物品(一把伞单独占满画面、一件商品正面特写)少了这个参照,是否同样 4/4,库内没有对照数据。列入待回验。
三、强档为什么真的做不到:MJ 没有物品参考通道
逐条盘点 MJ 的四个可能通道,没有一个能承担「像素级同一件」:
| 通道 | 现状 | 来源 |
|---|---|---|
| oref | 只在 --v 7 可用,v8.1 明确不支持,v8.2 是否支持标着未测 | oref与sref的工具版本与挂载方式 · MJ_v8.1_无oref_混合工作流 · MJ_v8.2_行为档案_v1 §5 |
| oref(退回 v7 硬用) | 高方差,当抽卡游戏:一次至少 8-12 张、默认大半要丢;且库内只验证过锁脸,锁物品无数据 | oref高方差律 |
| sref | 写死了:管质感氛围,不管主体身份 | MJ_v8.2_行为档案_v1 §3 |
拉高 --sw 抢救 | 机制上不可能:reference 只能传参考图里存在的信息,权重旋钮调的是已有信号强度,不是缺失信号的补全;拉高只会强化「这个维度可以缺席」 | 参考图缺失维度不可继承律_v1 |
所以「MJ 不擅长」这句话的准确范围是:MJ 不擅长像素级复现同一件物品。 加上这个限定词,学员才不会把中档一起放弃掉。
四、中档四条操作(可直接给学员)
1. 物品锁定段只写一处,跨图逐字复制
MiniMaxH3_行为规律_v1 第六条原话:两个镜头必须是同一把伞,各写一遍描述,必然漂。做法是把物品描述当成一个变量存下来,每张图原样粘贴,一个字都不重写。
单锚点优于三视图_v1 把同一件事又推进了一步:能写清楚的写成文字,并显式声明文字优先于图——那个项目的旗袍形制(立领 / 右衽 / 一列盘扣 / 短袖 / 收腰)全部写在文本里,并写明「即使参考图里看不见,也以文字为准」。理由是文字是确定性的,图是采样出来的:同一段描述每次装配一模一样,而每一张图都带方差。
这条对物品尤其顺——物品的形制几乎可以 100% 文字化,不像脸有一部分永远只能交给图。
2. 关键属性走三重锁定
MJ关键属性三重锁定律_v1:正向锚 + 负向排除 + 环境参照。弱信号词单独用必漂,而且弱信号的范围比直觉大——数字、单个形容词、以及 narrow / thin / small / low / lower third 这类相对尺寸与位置词都算。
该档 2026-08-23 那次跨项目验证还暴露了一个更难缠的性质:四张图的偏差方向完全一致(全部厚到 ~17%)。这不是随机漂移,是模型对该词有它自己稳定的理解——「多抽几张」解决不了。
配套的减法纪律见 prompt极简化原则_v1 与 已有prompt的七步体检律_v1:只锁「错了就返工」的属性,先减后加。
3. 辨识锚要挑模型画得稳的特征,不是挑你验起来方便的
这条是学费换的,两个独立案例同向:
- 装扮签名vs五官精度 2026-08-20 增量:给角色设「左眼下一颗小痣」当跨图校验位,理由是二值化好验证——结果痣落在了眉间。规则是「校验位要挑模型画得稳的特征,不是挑你验起来方便的特征」;
- MJ_v8.2_行为档案_v1 §6 边界:盘沿图标只在未被遮挡的盘子上执行,落点不可控。
迁移到物品上:优先选轮廓 / 色块 / 材质 / 结构件数量这类体积大、结构性强的特征;单颗铆钉、一道划痕、一枚小吊坠这类点状细节,位置控不住,别拿来当辨识锚。
4. 三个具体写法(MJ_v8.1_无oref_混合工作流 实测)
| 症状 | 错的写法 | 对的写法 |
|---|---|---|
| 材质出不来(形容词弱权重) | snowflakes with metallic sheen | tiny metallic silver shards mixed with snow particles —— 把材质做成视觉元素本身 |
| 尺寸不听话 | small markers | three small bright white circular markers, about 2 percent of the frame width each —— 形容词 + 量化,12/12 全稳 |
数量失控(single/one 执行率约 50%) | a single lantern | a single lantern and no other lanterns anywhere in the entire frame |
五、强档的正确出路:换工具,MJ 退到环境镜
双工具分工_nano锁脸+MJ摄影质感_v1 的分工公式直接可用,把「脸」替换成「那件物品」逻辑不变:
这一镜要不要出现那件必须一致的物品?
│
├── 要 → nano / GPT Image 2(图生图,不重绘主体)
│
└── 不要 → MJ(摄影质感最大化,自由发挥)
该档同时写死了一条陷阱,原样适用:「nano 跑不出来时换 MJ 试试」是错的——MJ 没有一致性通道,换了等于丢一致性,只会拖时间。工具归属要在 plan 阶段就标好,不要在出图阶段反复犹豫。
配套好消息:moodboard跨题材审美迁移_v1 实测过,无人体的静物 / 物件题可以大胆挂人物 moodboard 借审美,不触发 NSFW,能整体抬高出图天花板。物品题恰好落在这一格。
六、两条验收纪律
- 颜色单独列一条验收项。 单锚点优于三视图_v1 的反例值得原样转述:旗袍设定是靛蓝,封面阶段偏成墨黑,当时判断「差别看不见、不值得为它冒险返工」,结果 40 镜全是墨黑一路带到成片,歌词里唯一的颜色锚点(「像旧邮票发蓝」「你没带走的蓝衫」)作废。颜色最容易在上游漂掉且没人发现。
- 把验收放在最便宜的那一步。 同档:静图阶段 2 积分拦掉的两次身份事故,如果直接赌视频就是两次 64 积分。一致性的观感,很大程度上是「你拦掉了多少张不一致的图」,而不是「模型有多稳」。
待回验
- §二 推论的核心缺口:独立成图的物品(单件特写、无人体参照)用同一段描述词跑 N 个场景,锁住率是否接近装扮件的 4/4。这是本档唯一的新论点,目前零数据
- v8.2 到底支不支持 oref / cref(MJ_v8.2_行为档案_v1 §5 的占坑项)。若支持,§三 的通道盘点要整条重写
- oref 挂物品图(而非人脸图)的方差表现——oref高方差律 的 8-12 张抽卡口径是否同样适用
- 三重锁定用在物品上的命中率(该律的修法侧目前仍是 ⭐⭐,且样本全在角色属性)
关联文档
- 机制底座:装扮签名vs五官精度 —— 4/4 vs 0/4 那组数据是本档全部推论的起点
- 上位框架:角色一致性金字塔 —— 本档是它在「物品」这个对象上的一次迁移
- 中档四条的来源:MJ关键属性三重锁定律_v1 · MiniMaxH3_行为规律_v1 · 单锚点优于三视图_v1 · MJ_v8.1_无oref_混合工作流
- 通道盘点的来源:oref与sref的工具版本与挂载方式 · oref高方差律 · MJ_v8.2_行为档案_v1 · 参考图缺失维度不可继承律_v1
- 强档出路:双工具分工_nano锁脸+MJ摄影质感_v1 · moodboard跨题材审美迁移_v1
- 减法纪律:prompt极简化原则_v1 · 已有prompt的七步体检律_v1
- 同族学员答疑:动作错做减法_风格错辨顺逆_学员答疑案例_v1 —— 同为「先分类再给方法」的排错结构
- 邻近技巧:时空叠化的锚定物律 —— 同一物件跨象限出现的另一种用法(证明「这是同一处空间」)
- 对外版:
08_对外分发/MJ能不能锁住同一件物品_先分档再选工具_学员版.md(2026-08-27 经飞书助理小桁发布为云文档,互联网可阅读只读:https://ncnnb044q88x.feishu.cn/docx/ACcPdCNkUoAX7Rxc7Qic2Hd2nBw(标点全角化后重发,首版 docx/GwsPdz… 已作废)) - 小红书图文:
{aigc-creative-archive}/67_MJ物品一致性_学员答疑图文/(【AI 常识纠偏】02 期,8 图 carousel,沿用 62 期栏目视觉与脚本骨架;封面底图待出,正文 7 张已定)
版本
- v1 - 2026-08-27 - 学员答疑沉淀(三档分级编排 + 物品比脸好锁推论,零新实测,回验待做)
升级触发:
- §二 推论拿到独立物品的对照数据(无论正反)
- v8.2 oref 支持情况有结论
- 三档分级在第二次学员答疑里复用有效后,考虑从「案例」升格为独立判据