NVFP4 画质对照 · 我们的 5090 四臂

MiniMax-H3 ref2va · NVFP4 画质对照 · 2026-08-21
这一页对应生产改动:A 是 2026-08-21 之前线上跑的,C 是现在线上跑的。 四臂都用我们自己的 ref2va_render.py 在 GPU 7 上渲的,case 9202c3df, --steps 8 --flow-shift 3 --seed 4242 --width 768 --height 1344,124 帧,312 linear 过滤器 (注意:线上部署用的是 264 过滤器,因为 QAT 是按 264 训的——所以 C 栏比线上更激进一点)。 耗时:A 276.9s / B 276.2s / C 273.9s / D 250.6s,峰值 fp8 24.1G、nvfp4 23.5G。
0.00s
空格 播放/暂停 · , . 逐帧(24fps)· 所有画面共用一个时钟,逐帧对齐后再看糊不糊

A · dmdv8 + fp8

2026-08-21 之前的生产

B · dmdqat150 + fp8

只换 checkpoint。B−A = 多训 150 步的收益,与量化无关

C · dmdqat150 + nvfp4

现在的生产。C−B = 在 QAT 权重上量化的代价

D · dmdv8 + nvfp4

旧 checkpoint 直接量化。C−D = QAT 本身的效果