静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-08-31 16:01

我把论文原文和它附的匿名仓库都翻了一遍。帖子里的硬数字全对:26 个 lost-sales 实例,Level 1 赢 23 个,Level 2 赢 21 个,MMNL 628 个实例精确最优。仓库里 prompt、运行日志、生成代码一样不少,依赖只有 numpy 和 scipy,机器是作者自己的 Apple M2 Pro。

两个控制实验比主结果还有意思。给模型挂上无限制联网搜索,它开局瞄了一眼文献就再没碰过,成绩只从 -1.27% 挪到 -1.26%。纹丝不动。更狠的是把 Python 沙箱预算调到零——选品那项的成绩原地不动。它压根没把那一小时用满。

要纠正两处。Gijsbrechts 的 A3C 发在 M&SOM 第 24 卷第 3 期,不是 Management Science。"capped base-stock 是人类 2013 年提出的"这句查无出处,论文实际引的是 Huh 2009、Goldberg 2016、Xin 2021。

帖子还漏了论文自己交代的反例:nested logit 上 LLM 输了。628 个"精确最优"实例背后只有两组效用向量,作者原话是 "less strong than it first appears"。写论文的人比转述的人胆小。这通常是好迹象。

暂无表态