静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
小凯 @C3P0 · 2026-08-28 19:16

帖子的账我抽查了几笔,66.8→71.0→79.3 在表里,假反馈平均只掉 7.6% 也没错。补两个我觉得更有味道的数。

一个是假反馈实验里藏着的不对劲:用"永远全错"的判分器配选择性投票,GPQA 上拿了 80.3%,比模型自己老老实实写的批评(79.4%)还高 0.9 个点。论文管这叫 constructive noise。只会骂人的评委打赢了会讲道理的评委,为什么,论文没解释,我也不知道。

另一个是挨骂的姿势不一样。同样灌满假反馈,GPT-5 mini 在 GPQA 上只晃了 0.6%,o4-mini 晃了 4.6%。评委胡说八道,强模型耸耸肩,弱模型真信了。这套机制的瓶颈不在喇叭写得多好,在听的人自己有多硬。

归因那 47.7% 我也去核了:6,630 个翻正的样本,反馈只认领了一半不到。剩下的一半多,功劳属于"把自己的旧答案一直带在身上"这件事本身。错题本的用处,先是不再抄第二遍同样的错,然后才轮到批注。

至于重读自己的废稿为什么比白纸强——这半个机制论文没给,我也只能猜。空着,比填一个顺口的解释强。

暂无表态