方法论与洞察

标签相同 ≠ 行为相同 · 第三方代跑平台律 v1

入档:2026-08-07 触发:《Last Stand》敌人精灵要透明底 PNG。在 liblib.tv 用它内置的 GPT 出图,返回的”透明背景”是把灰白棋盘格画进了像素;同一个模型名换去 GPT 官网出,直接给真 alpha。 状态:已验证(二例,跨两个工具族)——liblib.tv 的 GPT Image(能力缺失)+ 悠船的 niji 5(行为漂移,见 MJ_niji5_行为档案_v2 §10.5) 性质:本条是 §10.5 那条元教训的升格独立档(该档 §十一 预留的升格触发已达成)


一句话律

第三方平台标着同一个模型名,不等于同一份能力。 原厂能给的东西(尤其是通道级 / 文件级能力),代跑平台可能在自己的交付流水线里丢掉;更坏的是模型会用一个**“看起来对”的伪造品**把缺口填上,让你在验收环节察觉不到。同一个模型反复给不出某种硬能力时,先换回原厂入口试一次,别改 prompt。


案例一:假透明(liblib.tv 的 GPT Image)

《Last Stand》是 DOOM 式 2D 单面精灵敌人,怪物必须是**透明底 PNG(RGBA)**才能当 billboard 用。

❌ liblib.tv 内置 GPT✅ GPT 官网
要求”纯透明背景(PNG RGBA)“同一句话
拿到的灰白棋盘格被画进画面,文件是全不透明 RGB真 RGBA,alpha 通道有效
后果抠图才能用,边缘毛糙drop-in 直接进引擎

为什么是棋盘格:灰白棋盘格是 PS / 看图软件用来显示”这里是透明”的 UI 约定。当交付管线吐不出 alpha 通道时,模型要满足”透明背景”这句话,唯一能做的就是在 RGB 里画出”透明的样子”——它照着人类看到的透明长什么样画。这不是模型不懂,是它被逼着在没有通道的画布上表达通道。

实际代价E:\last-stand git 史):v0.5 只能退回颜色键控当占位——commit 7564efa「GPT Image2 抠图 boss / 颜色键控占位 grunt-runner-brute,待额度恢复重抠」;三只小怪一直拖到 v0.6 换官网图才补齐——commit 5526a5c「grunt/runner/brute 换 GPT Image2 高清透明图(取景一致,仅按分辨率调 pixel_size)」。一个入口选择,卡了一个版本。

案例二:行为漂移(悠船的 niji 5)

同样标 niji 5,悠船因渲染管线 / 默认参数 / 模型版本快照不同,实际脾气显著不同:默认非方形画幅、对 half body shot 不敏感、复杂奇幻题材被简化成立绘、质感天花板明显更低。完整差异见 MJ_niji5_行为档案_v2 §十。

两例的分量不同,都要记住:悠船是降质(能出,但差一档,肉眼可辨、可接受可折中);liblib 的 GPT 是能力缺失 + 伪造(根本给不了,还交出一个骗过验收的替代品)。后者更危险。


真正的坑:这类缺陷伪装成成功

假透明图看起来是对的——缩略图里棋盘格甚至像一层细网纹底;预览、发群、贴进文档,全程没人觉得不对。它只在下游炸:进引擎、进合成、叠图层的那一刻才暴露。

所以判据不能靠眼睛,要验通道。拿到号称透明的图,一行命令验掉:

python -c "from PIL import Image; im=Image.open('x.png'); print(im.mode, im.getextrema()[-1] if im.mode=='RGBA' else '无alpha')"

如何使用

接到”某平台上这个模型做不到 X”时,按这个顺序走,别从 prompt 开始改

  1. 先分清 X 是哪一类能力
    • 画面内容类(构图、风格、姿势)→ 属 prompt / 模型能力,正常调 prompt;
    • 通道 / 文件类(alpha、分辨率、位深、比例、格式、元数据)→ 高度怀疑是平台交付层,直接跳第 2 步。
  2. 换回原厂入口出一次同样的图——这是最便宜的一次实验,几分钟出结论,比调十版 prompt 快。
  3. 原厂能出 → 结论是平台缺口,把这条记进该平台的档案,以后这类活不走它。
  4. 原厂也出不了 → 才是模型能力边界,这时再谈绕道方案(如精灵图走绿幕 #00FF00 + 后期抠像,见 GPTImage2游戏动作精灵图_三段锁定法_v1)。

顺带的排产纪律:吃通道 / 文件规格的素材(精灵、贴图、logo、印刷稿),第一张就验,不要等攒完一批。案例一里三只怪是攒完才发现的。


举一反三

同一个坑在这些地方等着,判据都是”模型能力 ≠ 平台交付能力”:

易在代跑平台被压掉的能力
图像alpha 通道、16bit、CMYK、无损 PNG(被转 JPG)、原始尺寸(被降采样)、EXIF
视频帧率 / 码率、带 alpha 的 ProRes 4444、原始时长、导出容器(见 青春记忆MV_四镜头组验证法_v1 里 liblib 导出必须先转码)
音频采样率 / 位深、无损格式、多轨分离
文本 / API上下文长度、参数开关(如负向提示词入口有无)、结构化输出

通用形态:凡是”原厂官网有、代跑平台的界面上找不到对应开关”的能力,默认它不存在,除非实测验过。界面上没有的开关,往往不是藏起来了,是那一层根本没接。


关联文档


版本

类型/洞察律工具/GPT-Image工具/MJ通用/工具选择状态/已验证