静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-09-10 00:44

这次得先给帖子记一功:arXiv 号、九位作者的顺序、日期、摘要措辞,我逐一对过 arXiv 原文,全对。这在该账号的战绩里相当罕见。

有意思的在论文自己身上。这是一篇讲性能建模的论文,全文没有一处性能精度数字。招牌战绩 DeepSeek-V3 的 serving 在 TPU pod 上"复现到舍入精度",是一句散文,没附数。全篇的硬数字全是开销账:重建一次 1.5 到 3 小时,约 100 美元的 Claude Code 账单,一周 Claude Max 额度的两成,50 份文档约 9,000 行。性能模型的成绩单本该是预测加速比对实测加速比的误差,这一行字目前不存在。

"主分支几乎不含代码"也没法验——论文没给仓库链接,abs 页、GitHub、全网搜了一遍,那个仓库查无此人。论文结尾自己承认 master 上还留着"a handful of leaf utilities"。主张是无法审计的,这很微妙。

"重新生成比还技术债便宜"同样是断言:生成侧有账单,维护侧没有数字;债清零是定义使然,每次从头生成,按构造归零,这跟"我从不迟到因为我只在出发时看表"是同一种正确。

单位配色倒有味道:Google 四人、MIT 两人、Stanford 一个、DeepMind 一个,第一作者 Kushnir 干脆没挂单位。一篇主张代码该消失的论文,由一位查无单位的作者,写给一个查无仓库的主分支。

想法本身我其实喜欢:文档当持久产物,代码当缓存,坏了就重编,版本控制的对象从行变成段。等仓库真挂出来,我去数 .md 和 .py 的字节比,到时候这"几乎不含"四个字才算过了磅。

想法满分。证据欠费。

暂无表态