案例复盘 · 2026-08-23 PB 主持控场卡 · 无 sref 四张成套
日期:2026-08-23 项目:
63_PB主持控场卡_复古科幻(AIGC 归档仓) 用途:不是比赛——主持 Prompt Battle 时在微信群里发出去控节奏的四张阶段卡底图 工具:Midjourney v8.2 关联:MJ_v8.2_行为档案_v1 / MJ关键属性三重锁定律_v1 / 骨架篇幅即权重_v1
一、事实先行(不可修改区)
交付物
四张 4:3 底图(2544×1904),对应控场四阶段:开始创作 / 开始上传 / 开始投票 / 投票截止。 文字与仪表壳由 Python 脚本合成,MJ 只出底图。
出图过程
| 项 | 事实 |
|---|---|
| 抽卡轮次 | 四张各提交一个 job,零重跑、零丢弃 |
| 挑选 | 每个 job 的四宫格里挑一张(01 挑第 3 张,02/03/04 挑第 2 张) |
| 耗时 | 四个 job 集中在 16:01–16:03,约 2 分钟 |
| prompt | 原样复制粘贴,一个字未改(含尾参) |
--sref | 完全没挂。四条 prompt 只共用同一句骨架 |
| 尾参 | --ar 4:3 --style raw --v 8.2 --stylize 100 --no text, letters, words, numerals, watermark, signature, people, human figures, ui overlay, hud graphics |
实测结构(脚本量的,非目视)
| 卡 | 控制台顶边 | 地平线 |
|---|---|---|
| 01 创作(琥珀) | 83.0% | 78.9% |
| 02 上传(青) | 93.0% | 65.2% |
| 03 投票(洋红) | 87.8% | 53.0% |
| 04 截止(暗红) | 85.2% | 67.0% |
| 跨度 | 10 个点 | 26 个点 |
prompt 词数构成
共用骨架 103 词,其中:
| 成分 | 词数 | 占比 |
|---|---|---|
| 控制台条(装置) | 31 | 30% |
| CRT 玻璃(装置) | 22 | 21% |
| 装置合计 | 53 | 51% |
| 中央留空(构图) | 15 | 15% |
| 地平线(景观) | 10 | 10% |
变量从句:01 = 13 词 / 02 = 21 词 / 03 = 31 词 / 04 = 28 词。
达成与未达成
| 意图 | 结果 |
|---|---|
| 零文字(后期要代码排中文) | ✅ 四张零伪字形,含控制台旋钮区 |
| 中央大片留空 | ✅ 四张全中 |
| 四张成一套 | ✅ 同装置同视点,控制台顶边跨度仅 10 个点 |
| 四色相明确拉开 | ✅ 琥珀 / 青 / 洋红 / 暗红 |
控制台条 very narrow(意图 ≤7%) | ❌ 四张全出到 ~17%,且偏差方向一致 |
地平线 across the lower third | ❌ 03 出到 53%,跑到了画面正中 |
未记录 / 未控变量
- MJ personalization(
--p)是否开启:未确认。这是本次最大的未控变量 - 每个四宫格里未被选中的另外三张:没下载,无法判断”一轮出”里的方差有多大
- 没有做 A/B:没有跑一组”挂 sref”的对照,所以不能证明 sref 无用,只能证明”不挂也成立过一次”
二、最该记的一条:我赛前的判断是错的
交付 prompt 时我写过一句:
「不挂 sref 四张就不是一套——骨架一致只能做到”像”,sref 才能让调色和手感接上。」
这句话在本案被证伪。 没挂 sref,四张的装置一致性做到了顶边跨度 10 个点。
如果复盘时不问”到底挂没挂”,我会顺着叙事惯性把功劳记到 sref 头上,写出一条假规律——而且是带着实测数据的假规律,更难被后来的人推翻。
事实冻结这一步救回来的就是这个。
三、为什么骨架能替代 sref:篇幅即权重
四张之间装置锁住了,景观没锁住,而且锁住的程度和 prompt 里的篇幅正好对应:
- 装置写了 53 词(占骨架一半)→ 控制台顶边跨度 10 个点
- 地平线只写了 10 词一笔带过 → 地平线跨度 26 个点,03 直接违反了
lower third
这不是”MJ 更擅长画装置”,而是同一句话在四次生成里重复出现的信息量决定了它被复现的稳定度。写得越细,可漂移的自由度越小。
细化沉淀见 骨架篇幅即权重_v1。
一个疑似相关,但样本不够
按变量从句长度排:01(13 词)< 02(21)< 04(28)< 03(31) 按地平线合规度排(越接近画面下方越合规):01(78.9%)> 04(67.0)> 02(65.2)> 03(53.0)
变量从句越长,骨架里的弱信号被挤得越狠——除 02/04 一处倒挂外基本单调。
⚠️ 但这个结论不能采信,两个原因:
- n=4,一次项目,还有一处倒挂
- 04 的变量从句里自己又写了一遍地平线(
the wireframe grid horizon barely visible... across the lower third),等于地平线在 04 里被提了两次——这是个明确的混杂因素,04 的数据点不干净
列在这里只作为值得下次专门 A/B 的假设,不作为规律。
四、very narrow 全军覆没:相对尺寸词是弱信号
prompt 里写了 very narrow horizontal strip,验收清单定的是 ≤7%。四张全出到 17% 左右,且偏差方向完全一致——不是随机漂移,是 MJ 对 “narrow” 有自己的稳定理解,和人心里的比例不是一回事。
同一句 prompt 里的 across the lower third(位置类相对词)也没守住,03 跑到了 53%。
这是 MJ关键属性三重锁定律_v1 的跨项目新样本,并把该律的适用范围从”年龄 / 衣着 / 新旧”扩到了 “尺寸 / 位置”这一类相对词。
⚠️ 注意本案只验证了该律的漂移侧(单个弱信号词必漂);修法侧(正锚 + 负向 + 环境参照)本次没用上,未获验证。
本案的处理:没重 roll
厚出来的控制台条是画面里最有说服力的部分,砍掉反而亏。改成量出顶边,让下游排版适配(脚本里 CONTENT_FLOOR = 840)。
“尺寸不符合预期”不一定是缺陷,先问它是不是反而更好。 重 roll 是最贵的选项,排版让位是最便宜的。
五、流程上的一条:先出图,再排版
原计划是先写完排版脚本再出图,中途被甲方拦下,改成先给 prompt、看到图再写代码。
事实证明这个纠正是对的——真底图一到手就推翻了两条排版预设:
- 控制台条比设想厚一倍多(预设 7%,实际 17%)
- 亮度分布和程序化预览完全不是一回事(第一版压暗
dim=0.52把橙色压成了土褐色,三轮才收回到 0.90)
要是按预设排完版再套真图,等于返工。底图定构图,构图定字号——顺序不能倒。
六、附带一条后期经验:压暗掉饱和度
高饱和底图(本案 01 琥珀)上压暗,走的是 Image.blend(img, 近黑色),会同时掉亮度和饱和度,高饱和的掉得最狠。
修法:整体压暗只留一点点(系数 0.90–0.98),可读性交给贴字边的暗描边(高斯半径 20 上下、3–4 遍)。描边只影响字周围一圈,不动画面其余部分。
⚠️ 反例:中间试过半径 52,糊成一团脏云,比不加还难看。描边半径要小、遍数要多,不是反过来。
七、下次改什么
- 补 A/B:同一骨架跑一组挂 sref 的对照,才能知道 sref 在”长骨架”条件下还有没有边际收益
- 确认 personalization 状态:本次最大的未控变量,下次出图前先记录
--p开关 - 真在意尺寸就别用形容词:给参照物(
the strip no taller than one knob)或直接接受实际值让下游适配 - 四宫格里没选中的三张也留档:否则判断不了”一轮出”到底是 prompt 稳还是运气好
关联文档
- 骨架篇幅即权重_v1 —— 本案主产出
- MJ关键属性三重锁定律_v1 —— 本案是其跨项目新样本(尺寸 / 位置类相对词)
- MJ_v8.2_行为档案_v1 —— 已回填第 7 条
- prompt极简化原则_v1 —— 张力方向:那条说约束要省着用,本案说装置描述要写足。两者的边界是”要锁的东西写细,不锁的省掉”
- 角色一致性金字塔 —— 本案是”同装置不同状态”,不适用于人物锁脸,别混用
- 默认落点的资产负债判断_v1 —— 同构:那条说”压掉默认落点前先分类,它可能是资产”;本案说”偏离预期的尺寸先别重 roll,它可能比你要的更好”。都是先判资产负债,再决定要不要修
版本
- v1 - 2026-08-23 - 首次入档