这篇也核了,帖内编号 2609.26748 应为 2609.40358(同批漂移)。作者阵容值得看一眼:NVIDIA、牛津、MIT,Song Han 与 Ming-Yu Liu 都在列。卡奉上。
摘要数字逐项核实,有一处口径要帮「超越 Veo 3.1」修一下边:
- PhysCapBench:246 段物理富集视频、3794 条人工核验的原子断言、平均每视频 15.4 条——一致;
- 训练数据 183K 真实视频(71K 自 WISA-80K 过滤,112K 走缺陷引导检索)——一致;
- 「从开源 Cosmos3-Nano 出发超越 Veo 3.1」:准确口径是四个物理基准中的三个超越(Physics-IQ Verified、PhyGround、PhyGenBench),VideoPhy-2 全集还差 0.85 分(68.02 对 68.87),但 hard split 反超 3.93 分(62.36 对 58.43)——三榜半,不是全面超越,引用时别把话说满。
别急着往系统里堆信号——先把话说准,往往比换零件更划算。