方法论与洞察

2026-08-26 《过风》雪雾珍珠人像动态写真 · 全链路复盘

事实记录(不可修改区)


一、作品回顾

创作思路

一张 MJ 出的冷白高调雪雾人像(齐耳短发 / 三层珍珠 / 白羽毛 / 瓷肌)。 原图是结果状态,按 图生视频_ForwardOnly原则 只能凝固延长或继续向后。 目标:把它做成动态写真,唯一标准是凸显她的美(主创原话)。

执行过程(实际发生的顺序,含全部返工)

  1. 接入 LibTV CLI(v1.1.3),实拉模型 schema 定参数
  2. Seedance 2.5 · 30s 一镜到底(v1 设计为 5×6s 藏切点 → 主创指出 6 秒分段结论已作废 → 改一镜到底) → 出片 → 主创判「假、无趣、质感不强」
  3. MiniMax H3,重写六段式 prompt → 《过风》中近景 → 过审
  4. 第二条 15s《抬眼》特写 → 主创判「太棒了,完美过审」
  5. 三比例封面 v1(微软雅黑)→ 判「别扭」
  6. 封面 v2(仿宋艺术字:超大压字 + 风向拖影 + 亮度遮罩)→ 判「别扭」
  7. 封面 v3(全英文刊名,照搬 59_头版 版式系统)→ 判「黑字压黑发」 → 修 → 判「文字离边缘太近」 → 重排版面 → 过审
  8. 配乐 v1(LibTV / Eleven Music V3)→ 判「太压抑,跟画面不符」
  9. 配乐 v2(Suno,无词哼鸣)→ 主创出稿修剪 → 接入 → 成片过审

最终输出

两条 15s(中近景「一阵风穿过」+ 特写「她把目光抬起来」)以 0.6s 交叉溶解相接, 配一层无词女声哼鸣,首尾淡白。


二、结果分析

我方判断 vs 主创裁决(逐条对照)

环节我的判断主创裁决事实
Seedance 30s 成片事实项全过(零硬切、脸稳、无手),未预判气质假 / 无趣 / 质感不强判废,转 H3
「冷」的可见化写成「缩肩 + 锁骨起鸡皮疙瘩」(标准的意图→物理结果转写)不要鸡皮疙瘩,写真要展示美改「合眼→睫毛压下→下巴微抬→唇松开→睁眼」
封面字形 v1微软雅黑 Light,理由「杂志=无衬线」别扭理由本身错,见方法论 3
封面字形 v2仿宋艺术字,自认解决了别扭根因不在字形,在文字系统与版式不匹配
封面文字脚本报「OK」黑字和黑发有遮挡我的检查方法错,见方法论 4
封面版面按「哪条带最亮」排文字离边缘太近被数据牵着走,丢了版式常识
配乐 v1brief 写 minor key / sub-bass drone / unresolved chord太压抑我把「冷」翻译成了「沉」

七次裁决里,我方预判与主创一致的次数:0。 唯一没被推翻的是事实项(分辨率、帧数、有无硬切、有无手、笔画有没有压在暗处)。

→ 这是 2026-08-24_擦干净_从素材到动态化制片_全链路复盘_v1 §三.3 「AI 视觉预审 ≠ 主创审美裁决,气质级判断不可代理 ⭐⭐」的第三次验证, 本次样本量更大(7 次),且方向完全一致:事实项可代理,气质项一次都不可代理。

我方误判全记录(六条,按严重度排)

  1. 🔴 把一条归因未完成的库内结论当硬约束用。v1 整个结构(5×6s 藏切点)建立在 Seedance2_5_行为规律_v1 §一「6 秒自动分段」上。主创指出该结论是 Flova 编排层的。 而该档案的上游档 Flova_平台档案 第 104 行当时就写着「三臂对照已设计、实际生成 0 次、结论待回填」—— 归因没做完,结论已经先落进模型层档案,而我读到的是那个越位版本,且没有回溯上游档就直接采信
  2. 🔴 设计了一个在这张底图上物理不可见的事件。核心事件「呼出的白气悬停不散」, 实测模型完全执行了(唇左区亮度 14s 谷底 87.6 → 15s 起跳 92.0 → 18–27s 稳在 93–95), 但白气背靠白雾、零对比度,整幅看过去几乎看不见。执行成功 ≠ 可见。
  3. 🔴 没查库就自己重试了两版封面59_头版 早已判死「两个字的中文刊名做不了满幅刊名」, 我到第三版才想起来查。前两版是纯重复劳动。
  4. 🔴 用错的度量方法让量化检查给出了虚假的通过。封面脚本按 12 段均值采样矩形区域, 把她的头发平均掉了;脚本其实打印过 封面线区 最暗段=79.8 的告警,我当成误报忽略。 改用逐列 min + 对真实字形像素核查后,同一版立刻暴露 10.9% 的笔画压在暗处。
  5. ⚠️ 被数据牵着走,丢了版式常识。按「哪条带最亮」排版,结果 16:9 刊名底距画幅底仅 14px。 页边距是硬约束,不该被亮度数据推翻。
  6. ⚠️ 工具里把约束写成了事后检查fit_music.py 初版「取全局最强沿 → 再检查长度约束 → 不满足就放弃」, 自测时选中幅度最大但长度不够的点而放弃,漏掉了满足约束、幅度略小的正确答案。

三、方法论沉淀

1. 白底上的白事件等于没发生 ⚠️首次

已单独立档:白底上的白事件等于没发生_v1核心:选事件之前先看底图影调。事件亮度必须与底图反着来; 高调片的动能只能交给深色主体 / 硬高光 / 结构性纹理。

2. 视频可以在一条镜头里从偷瞥走到邀请 ⚠️首次

已并入 主体不看镜头律 增量段。 核心:该律「一张图要么邀请要么偷瞥」写的是静图;视频有时间轴, 两种体裁可以是同一条镜头的前后两段,转折点用一次眨眼包住。

3. 满幅刊名需要拉丁刊名 ⭐⭐ 二次验证

核心:满幅刊名是为拉丁字母设计的——5–10 个字母才铺得满一行,字母宽窄不一本身构成节奏; 中文是等宽方块字,两个字铺满就得单字巨大,必然压到主体上。 中文刊名少于 4 个字,别做满幅刊名。

来源2026-08-20_雨里旧信_东方美人封面四轮复盘 同期的 59_头版 项目首次判定(「头版」两字); 本项目「过风」两字独立复现,故升二次验证。

⚠️ 同时修正该判据的成立条件59_头版 记的是「满幅刊名只在人物头部与背景明暗一致时才可行」, 并靠顶部+左上角柔光压暗去救。本项目是高调白片,压暗会直接伤掉高调感, 实测发现顶部/底部有跨全宽仍然明亮的带(最暗 152–160),深墨字直接可读,一道压暗都不用

原判据里「明暗段数」之所以致命,是因为那条带里同时有 224 的亮和 66 的暗, 一种字色必有一半读不出;整条带都亮时,段数无所谓。 准确表述应为:「满幅刊名要求刊名带内存在单一字色可通吃的亮度区间」,而不是「段数少」。

操作规则

  1. 先量刊名带的逐列最暗值(不是均值),确认单一字色能否通吃
  2. 通吃 → 直接排,不压暗;不通吃 → 才考虑压暗,且先确认压暗不会伤掉画面的调性身份
  3. 中文刊名 < 4 字 → 换拉丁刊名,或换不要求铺满的排法

4. 度量方法选错时,量化检查会给出虚假的通过 ⚠️首次

核心:「用了数据」不等于「量对了」。聚合方式(均值 / 最小值)和取样范围(矩形 / 真实字形) 本身就是判断,选错会让检查系统性地漏报。

来源:封面文字与黑发遮挡。按 12 段均值采样矩形区域 → 报 OK; 改成逐列 min + 对真实字形像素 → 同一版暴露 10.9% 笔画压在暗处。 两次用的都是「客观数据」,结论相反。

操作规则

  1. 检查「有没有任何一处不合格」时用 min / 分位,不用 mean——mean 会把局部问题平均掉
  2. 检查对象要贴到真实产物(字形像素)上,不是它的外接矩形
  3. 脚本自己打出的告警,先当真再判断——本次告警是对的,我按错误的方法否定了它

反例/边界:检查「整体观感」时 mean 仍然合适;min 对孤立噪点敏感,需配合平滑。

5. 氛围曲的结构在音色,不在响度 ⚠️首次

核心无词哼鸣 / ambient 这类素材没有响度乐段,RMS 包络找不到结构点, 必须用**频谱流量(spectral flux)**测音色变化。

来源:定版配乐 body 跨度仅 17 dB、连续波动无台阶(为废版写的 RMS 找点法直接失灵); 改频谱流量后一次找出 19 处边界,工具独立复现了手算选点(72.28 vs 手算 72.30)。

操作规则

  1. 先看 body 跨度(掐掉首尾淡入淡出再算):>25 dB 可用 RMS;≤25 dB 必须上频谱流量
  2. 全曲跨度会被淡入淡出撑大(本曲全曲 36 dB / body 仅 17 dB),不能拿全曲跨度做判据
  3. z 值是相对所分析片段的均值/标准差算的,换片段就换基准,成片复核时数值会变,属正常

反例/边界:有鼓点/节拍的素材用 onset 检测更直接;本条只针对无节拍网格的持续音乐。

6. 约束是筛选条件,不是事后检查 ⚠️首次(工程律)

核心:「取全局最优 → 再检查约束 → 不满足就放弃」会漏掉满足约束的次优解。 正确顺序是先用约束筛掉不可行解,再在可行域里排序

来源fit_music.py 选段逻辑;自测时它放弃了唯一可行的正确答案。

边界:这是通用的最优化常识,写在这里是因为它在一个只有十几行的小工具里也会犯


四、下次改进

  1. 行动清单
    • 动手前先查库,尤其是「这个题材/这个版式我们做过没有」——本次两版封面是纯重复劳动
    • 引用库内结论前回溯它的上游档,看归因有没有做完(本次 6 秒分段就是越位结论)
    • 设计事件之前先量底图影调,确认这个事件在这张图上看得见
    • 写量化检查时先想清楚聚合方式与取样范围;检查「有没有一处不合格」一律用 min/分位
    • 审片结论分两栏:事实项(我可判)与气质项(主创终审),不预判气质
  2. 最想改的一步:封面。三版里前两版可以完全避免,只要第一步查了 59_头版
  3. 未完事项
    • 平台数据未回填——本项目目前没有任何市场结果
    • 59_头版 的判据升格与成立条件修正尚未回写到该项目 README
    • Flova 6 秒分段的根因仍未定案(编排层 vs 上游是 2.0),三臂对照只跑了直连一臂

关联文档

类型/IP视觉主题/图生视频工具/MiniMaxH3工具/Seedance工具/Suno主题/封面排版