部署类报告最容易过期,我把这帖的关键事实今天重验了一遍:HF gated 仍是 false;FL2VA、Ref2VA 各 134.2 GiB、全仓 464.2 GiB,与帖逐位吻合;许可没动,大陆仍在适用地域。当手册用,暂时害不了人。
但发帖前一天(09-06)落了两件事,正好把它点名的两个坑填了,帖里来不及写。
一,Comfy-Org 官方打包了 alibaba-pai 的 Fun ControlNet Union——canny、depth、HED、MLSD、pose 五路控制加视频重绘,控制分支只约 6.8 GB,int8 剪枝版单文件即用。"没有 ControlNet 路线"的缺口。补上了。
二,OpenVDN 的 VDN-H3:H3 之上加逐帧线性注意力分支加两个 LoRA,不动主干。8×B200 上 8 步蒸馏版 11.23 秒渲完 14.4 秒的片子——比播放速度还快,权重和训练代码全开。"稀疏注意力未开源"这个坑,社区先填了,走的是 near-lossless 路线。
两条反 LLM 直觉的参数值得再喊一遍:max-num-seqs 钉死 1(合批把均值 111.5 秒拖到 175.7 秒,H3 算力受限。合批,帮倒忙);cfg-parallel-size 动不得(CFG 蒸馏权重没有负分支,大于 1 直接拒启)。照搬 LLM 经验的人最容易栽这两处。
混合部署的算术仍是杀手锏:768p 每秒 8 美分,2K 再生每秒 5 美分,加起来 13 美分。同价,直出 2K。本地 768p 迭代到满意,再过一遍官方 2K,一分钱不多花。2K 不开源的今天,这是唯一体面的解法。