2026-08-26 《过风》雪雾珍珠人像动态写真 · 全链路复盘
事实记录(不可修改区)
- 作品名称:《过风》(雪雾珍珠人像动态写真,28.08s)
- 比赛/项目:个人创作项目,非比赛,无票数、无排名
- 提交时间:尚未发布(2026-08-26 主创宣布收口并前往发布)
- 最终结果:无平台数据。目前唯一的结果是主创逐项审片通过—— 这是审美裁决,不是市场结果,不能当作「作品成功」的证据。
- 数据来源:本会话交互记录;所有技术数字均为
ffprobe/ffmpeg/ numpy 实测; 主创裁决为原话记录。 - 产出清单(实测规格):
项 规格 成片 1440×2560 · 28.08s · 674 帧 · h264 High + AAC · −14.2 LUFS / LRA 4.0 LU 定版素材 ×2 MiniMax H3 · 1440×2560 · 15.084s · 各 362 帧 · h264 High 对照组(判废) Seedance 2.5 · 1080×1920 · 30.08s · 721 帧 · HEVC Main 10 / yuv420p10le 配乐 Suno Simple Mode B 版直出 + 主创修剪,101.12s(成片取 72.3~100.3s) 封面 3 比例 × 有字/无字 = 6 张 - ⚠️ 积分/扣费未记录——主创明确裁定不记账。本项目无法提供成本数据。
一、作品回顾
创作思路
一张 MJ 出的冷白高调雪雾人像(齐耳短发 / 三层珍珠 / 白羽毛 / 瓷肌)。 原图是结果状态,按 图生视频_ForwardOnly原则 只能凝固延长或继续向后。 目标:把它做成动态写真,唯一标准是凸显她的美(主创原话)。
执行过程(实际发生的顺序,含全部返工)
- 接入 LibTV CLI(v1.1.3),实拉模型 schema 定参数
- Seedance 2.5 · 30s 一镜到底(v1 设计为 5×6s 藏切点 → 主创指出 6 秒分段结论已作废 → 改一镜到底) → 出片 → 主创判「假、无趣、质感不强」
- 换 MiniMax H3,重写六段式 prompt → 《过风》中近景 → 过审
- 第二条 15s《抬眼》特写 → 主创判「太棒了,完美过审」
- 三比例封面 v1(微软雅黑)→ 判「别扭」
- 封面 v2(仿宋艺术字:超大压字 + 风向拖影 + 亮度遮罩)→ 判「别扭」
- 封面 v3(全英文刊名,照搬
59_头版版式系统)→ 判「黑字压黑发」 → 修 → 判「文字离边缘太近」 → 重排版面 → 过审 - 配乐 v1(LibTV / Eleven Music V3)→ 判「太压抑,跟画面不符」
- 配乐 v2(Suno,无词哼鸣)→ 主创出稿修剪 → 接入 → 成片过审
最终输出
两条 15s(中近景「一阵风穿过」+ 特写「她把目光抬起来」)以 0.6s 交叉溶解相接, 配一层无词女声哼鸣,首尾淡白。
二、结果分析
我方判断 vs 主创裁决(逐条对照)
| 环节 | 我的判断 | 主创裁决 | 事实 |
|---|---|---|---|
| Seedance 30s 成片 | 事实项全过(零硬切、脸稳、无手),未预判气质 | 假 / 无趣 / 质感不强 | 判废,转 H3 |
| 「冷」的可见化 | 写成「缩肩 + 锁骨起鸡皮疙瘩」(标准的意图→物理结果转写) | 不要鸡皮疙瘩,写真要展示美 | 改「合眼→睫毛压下→下巴微抬→唇松开→睁眼」 |
| 封面字形 v1 | 微软雅黑 Light,理由「杂志=无衬线」 | 别扭 | 理由本身错,见方法论 3 |
| 封面字形 v2 | 仿宋艺术字,自认解决了 | 别扭 | 根因不在字形,在文字系统与版式不匹配 |
| 封面文字 | 脚本报「OK」 | 黑字和黑发有遮挡 | 我的检查方法错,见方法论 4 |
| 封面版面 | 按「哪条带最亮」排 | 文字离边缘太近 | 被数据牵着走,丢了版式常识 |
| 配乐 v1 | brief 写 minor key / sub-bass drone / unresolved chord | 太压抑 | 我把「冷」翻译成了「沉」 |
七次裁决里,我方预判与主创一致的次数:0。 唯一没被推翻的是事实项(分辨率、帧数、有无硬切、有无手、笔画有没有压在暗处)。
→ 这是 2026-08-24_擦干净_从素材到动态化制片_全链路复盘_v1 §三.3 「AI 视觉预审 ≠ 主创审美裁决,气质级判断不可代理 ⭐⭐」的第三次验证, 本次样本量更大(7 次),且方向完全一致:事实项可代理,气质项一次都不可代理。
我方误判全记录(六条,按严重度排)
- 🔴 把一条归因未完成的库内结论当硬约束用。v1 整个结构(5×6s 藏切点)建立在
Seedance2_5_行为规律_v1§一「6 秒自动分段」上。主创指出该结论是 Flova 编排层的。 而该档案的上游档Flova_平台档案第 104 行当时就写着「三臂对照已设计、实际生成 0 次、结论待回填」—— 归因没做完,结论已经先落进模型层档案,而我读到的是那个越位版本,且没有回溯上游档就直接采信。 - 🔴 设计了一个在这张底图上物理不可见的事件。核心事件「呼出的白气悬停不散」, 实测模型完全执行了(唇左区亮度 14s 谷底 87.6 → 15s 起跳 92.0 → 18–27s 稳在 93–95), 但白气背靠白雾、零对比度,整幅看过去几乎看不见。执行成功 ≠ 可见。
- 🔴 没查库就自己重试了两版封面。
59_头版早已判死「两个字的中文刊名做不了满幅刊名」, 我到第三版才想起来查。前两版是纯重复劳动。 - 🔴 用错的度量方法让量化检查给出了虚假的通过。封面脚本按 12 段均值采样矩形区域,
把她的头发平均掉了;脚本其实打印过
封面线区 最暗段=79.8的告警,我当成误报忽略。 改用逐列 min + 对真实字形像素核查后,同一版立刻暴露 10.9% 的笔画压在暗处。 - ⚠️ 被数据牵着走,丢了版式常识。按「哪条带最亮」排版,结果 16:9 刊名底距画幅底仅 14px。 页边距是硬约束,不该被亮度数据推翻。
- ⚠️ 工具里把约束写成了事后检查。
fit_music.py初版「取全局最强沿 → 再检查长度约束 → 不满足就放弃」, 自测时选中幅度最大但长度不够的点而放弃,漏掉了满足约束、幅度略小的正确答案。
三、方法论沉淀
1. 白底上的白事件等于没发生 ⚠️首次
已单独立档:白底上的白事件等于没发生_v1。 核心:选事件之前先看底图影调。事件亮度必须与底图反着来; 高调片的动能只能交给深色主体 / 硬高光 / 结构性纹理。
2. 视频可以在一条镜头里从偷瞥走到邀请 ⚠️首次
已并入 主体不看镜头律 增量段。 核心:该律「一张图要么邀请要么偷瞥」写的是静图;视频有时间轴, 两种体裁可以是同一条镜头的前后两段,转折点用一次眨眼包住。
3. 满幅刊名需要拉丁刊名 ⭐⭐ 二次验证
核心:满幅刊名是为拉丁字母设计的——5–10 个字母才铺得满一行,字母宽窄不一本身构成节奏; 中文是等宽方块字,两个字铺满就得单字巨大,必然压到主体上。 中文刊名少于 4 个字,别做满幅刊名。
来源:2026-08-20_雨里旧信_东方美人封面四轮复盘 同期的 59_头版 项目首次判定(「头版」两字);
本项目「过风」两字独立复现,故升二次验证。
⚠️ 同时修正该判据的成立条件:59_头版 记的是「满幅刊名只在人物头部与背景明暗一致时才可行」,
并靠顶部+左上角柔光压暗去救。本项目是高调白片,压暗会直接伤掉高调感,
实测发现顶部/底部有跨全宽仍然明亮的带(最暗 152–160),深墨字直接可读,一道压暗都不用。
→ 原判据里「明暗段数」之所以致命,是因为那条带里同时有 224 的亮和 66 的暗, 一种字色必有一半读不出;整条带都亮时,段数无所谓。 准确表述应为:「满幅刊名要求刊名带内存在单一字色可通吃的亮度区间」,而不是「段数少」。
操作规则:
- 先量刊名带的逐列最暗值(不是均值),确认单一字色能否通吃
- 通吃 → 直接排,不压暗;不通吃 → 才考虑压暗,且先确认压暗不会伤掉画面的调性身份
- 中文刊名 < 4 字 → 换拉丁刊名,或换不要求铺满的排法
4. 度量方法选错时,量化检查会给出虚假的通过 ⚠️首次
核心:「用了数据」不等于「量对了」。聚合方式(均值 / 最小值)和取样范围(矩形 / 真实字形) 本身就是判断,选错会让检查系统性地漏报。
来源:封面文字与黑发遮挡。按 12 段均值采样矩形区域 → 报 OK; 改成逐列 min + 对真实字形像素 → 同一版暴露 10.9% 笔画压在暗处。 两次用的都是「客观数据」,结论相反。
操作规则:
- 检查「有没有任何一处不合格」时用 min / 分位,不用 mean——mean 会把局部问题平均掉
- 检查对象要贴到真实产物(字形像素)上,不是它的外接矩形
- 脚本自己打出的告警,先当真再判断——本次告警是对的,我按错误的方法否定了它
反例/边界:检查「整体观感」时 mean 仍然合适;min 对孤立噪点敏感,需配合平滑。
5. 氛围曲的结构在音色,不在响度 ⚠️首次
核心:无词哼鸣 / ambient 这类素材没有响度乐段,RMS 包络找不到结构点, 必须用**频谱流量(spectral flux)**测音色变化。
来源:定版配乐 body 跨度仅 17 dB、连续波动无台阶(为废版写的 RMS 找点法直接失灵); 改频谱流量后一次找出 19 处边界,工具独立复现了手算选点(72.28 vs 手算 72.30)。
操作规则:
- 先看 body 跨度(掐掉首尾淡入淡出再算):>25 dB 可用 RMS;≤25 dB 必须上频谱流量
- 全曲跨度会被淡入淡出撑大(本曲全曲 36 dB / body 仅 17 dB),不能拿全曲跨度做判据
- z 值是相对所分析片段的均值/标准差算的,换片段就换基准,成片复核时数值会变,属正常
反例/边界:有鼓点/节拍的素材用 onset 检测更直接;本条只针对无节拍网格的持续音乐。
6. 约束是筛选条件,不是事后检查 ⚠️首次(工程律)
核心:「取全局最优 → 再检查约束 → 不满足就放弃」会漏掉满足约束的次优解。 正确顺序是先用约束筛掉不可行解,再在可行域里排序。
来源:fit_music.py 选段逻辑;自测时它放弃了唯一可行的正确答案。
边界:这是通用的最优化常识,写在这里是因为它在一个只有十几行的小工具里也会犯。
四、下次改进
- 行动清单:
- 动手前先查库,尤其是「这个题材/这个版式我们做过没有」——本次两版封面是纯重复劳动
- 引用库内结论前回溯它的上游档,看归因有没有做完(本次 6 秒分段就是越位结论)
- 设计事件之前先量底图影调,确认这个事件在这张图上看得见
- 写量化检查时先想清楚聚合方式与取样范围;检查「有没有一处不合格」一律用 min/分位
- 审片结论分两栏:事实项(我可判)与气质项(主创终审),不预判气质
- 最想改的一步:封面。三版里前两版可以完全避免,只要第一步查了
59_头版。 - 未完事项:
- 平台数据未回填——本项目目前没有任何市场结果
59_头版的判据升格与成立条件修正尚未回写到该项目 README- Flova 6 秒分段的根因仍未定案(编排层 vs 上游是 2.0),三臂对照只跑了直连一臂
关联文档
- 本次新立/更新:白底上的白事件等于没发生_v1 · 主体不看镜头律 · Seedance2_5_行为规律_v1(§一 1 条作废 + 2 条降级,§三 补第二组数据) · MiniMaxH3_行为规律_v1(§四 补跨路线帧网格确认) · Flova_平台档案_编排层不是模型层_v1(回填一臂)
- 方法论母本:图生视频_ForwardOnly原则 · 2026-08-24_擦干净_从素材到动态化制片_全链路复盘_v1
- 同类前作:2026-08-20_雨里旧信_东方美人封面四轮复盘
- 库外产物(不双链):
{aigc-creative-archive}/65_过风_雪雾珍珠人像_H3动态写真/